OpenAI gác lại ra mắt GPT-6.1 Astra vì mô hình “chưa hoàn toàn đạt chuẩn” về an toàn
- Bảo Minh
- •
OpenAI hôm thứ Hai (28/9) xác nhận gác lại GPT-6.1 Astra, mô hình dự kiến ra mắt trong tháng 10, vì theo trưởng bộ phận hệ thống an toàn của hãng, mô hình “chưa hoàn toàn đạt chuẩn”.
Công ty đưa ra xác nhận sau khi The Wall Street Journal (WSJ) cùng ngày đưa tin OpenAI đã hủy kế hoạch phát hành Astra, TheWrap cho biết.
“[Astra] chưa hoàn toàn đạt chuẩn về việc làm đúng phạm vi và quyền hạn được giao,” bà Saachi Jain, trưởng bộ phận hệ thống an toàn của OpenAI, nói với báo giới hôm thứ Hai.
Bà cho biết mô hình cũng chưa đạt ở khâu báo lại cho người dùng những việc đã làm. Trong an toàn và căn chỉnh (alignment) AI, theo bà, vấn đề nào cũng có “sự đánh đổi”.
Bà Jain cho biết các mô hình của OpenAI phải đạt mức chuẩn “cực kỳ cao” về an toàn trước khi đến tay người tiêu dùng. “Tất nhiên, chúng tôi muốn bảo đảm việc phát triển mô hình an toàn, dù là trong nội bộ công ty hay khi đưa đến tay người dùng,” bà nói thêm.
WSJ còn nêu thêm chi tiết, theo bản tóm tin của Investing.com. Trả lời tờ báo này, bà Jain cho biết Astra không đạt chuẩn nội bộ trong các bài kiểm tra căn chỉnh và có biểu hiện lừa dối nhiều hơn mô hình trước đó.
Bản tin của WSJ cũng cho biết Astra mạnh hơn các mô hình trước của OpenAI, và thay vì phát hành, công ty sẽ tập trung cải thiện độ an toàn cho những mô hình sau này mà OpenAI dự kiến còn mạnh hơn nữa.
Thông báo của bà Jain mà hãng tin AP dẫn lại cho biết Astra kiên trì hơn khi thực hiện nhiệm vụ, nhưng OpenAI phải cân bằng năng lực đó với nguy cơ mô hình hành động khi không được phép.
Tạm dừng huấn luyện mô hình tiên tiến nhất sau các vụ tác nhân AI vượt quyền
Tuần trước, OpenAI đã tạm dừng huấn luyện các mô hình tiên tiến nhất của mình và cho biết chỉ nối lại “khi chúng tôi tin chắc đã có thêm các biện pháp bảo vệ”, theo AP.
Trước đó, công ty công bố các trường hợp tác nhân AI làm vượt chỉ dẫn, trong đó có việc truy cập trang web chính phủ khi không được phép. Trong quá trình huấn luyện, các mô hình của OpenAI đã nhắm vào trang web của Chính phủ Mỹ theo những cách công ty không lường trước, Investing.com cho biết.
Hôm thứ Sáu (25/9), CEO OpenAI Sam Altman viết trên X rằng công ty đang tiến hành “một cuộc rà soát sâu rộng” về việc các tác nhân AI của mình truy cập Internet trong quá trình huấn luyện và đánh giá.
Ông thừa nhận công ty “chưa nhanh như mong muốn”, vì phải vừa bảo đảm minh bạch, vừa phân tích hàng petabyte nhật ký hoạt động của tác nhân AI và làm việc với các tổ chức bị ảnh hưởng.
Ông Altman ủng hộ làm chậm việc phát triển AI
Theo Investing.com, trong tháng 9, CEO Anthropic Dario Amodei đã kêu gọi làm chậm việc phát triển AI trên diện rộng vì những rủi ro công nghệ này có thể gây ra.
Ông Altman cũng lên tiếng ủng hộ đề xuất này. Ông cùng nhiều lãnh đạo khác trong ngành kêu gọi làm chậm lại, và cảnh báo các công ty chưa có đủ biện pháp bảo vệ để kiểm soát những hệ thống AI mạnh nhất, AP cho biết.
Cũng theo hãng tin này, OpenAI công bố quyết định này một ngày trước cuộc gặp giữa lãnh đạo các công ty AI với Tổng thống Mỹ Donald Trump tại Washington.
Chủ tịch OpenAI Greg Brockman dự kiến có mặt tại sự kiện ở Nhà Trắng hôm thứ Ba (29/9). Cùng ngày, ông Altman có lịch phát biểu chính tại hội nghị thường niên dành cho các nhà phát triển phần mềm mà OpenAI tổ chức ở San Francisco.
Từ khóa AI an toàn AI GPT-6.1 Astra openAI Sam Altman tác nhân AI trí tuệ nhân tạo

































