Nhà nghiên cứu OpenAI, Anthropic: Tự động hóa nghiên cứu AI có thể gây “bùng nổ trí tuệ”
- Lý Ngọc
- •
Nhiều nhà nghiên cứu của OpenAI, Anthropic, Microsoft và Meta — ký tên với tư cách cá nhân — hôm thứ Hai (28/9) cảnh báo tự động hóa nghiên cứu trí tuệ nhân tạo (AI) có thể gây “bùng nổ trí tuệ”.
Trong bài viết, nhóm tác giả cho rằng AI có thể tự cải thiện với tốc độ sớm vượt quá khả năng hiểu của con người. Những bước tiến của nhiều năm có thể bị nén vào vài tháng, thậm chí ngắn hơn, Epoch Times cho biết.
Đứng tên bài viết có nhà khoa học trưởng OpenAI Jakub Pachocki, đồng sáng lập Anthropic Jack Clark, giám đốc khoa học Microsoft Eric Horvitz và bà Tống Hiểu Đông (Dawn Song), phó chủ tịch phụ trách nghiên cứu AI của Meta. Ký tên còn có các nhà tiên phong trong ngành, trong đó có ông Geoffrey Hinton, người từng làm việc gần 10 năm tại Google, và ông Yoshua Bengio. Bài viết có 22 tác giả.
The Verge cho biết bài viết mang tựa đề “Nếu tự động hóa hoạt động nghiên cứu và phát triển AI kích hoạt bùng nổ trí tuệ thì sao?”, đăng trên trang của Chương trình Khoa học và Chính sách AI Cambridge. Nhóm tác giả cho rằng năng lực AI “có thể tăng nhanh hơn rất nhiều so với khả năng theo kịp của xã hội”. Họ cảnh báo nhân loại “có thể mất quyền kiểm soát các hệ thống AI vượt trội con người”.
Trong kịch bản cực đoan, khi AI vượt khỏi tầm kiểm soát, hậu quả có thể là “con người bị gạt ra lề, thậm chí tuyệt chủng,” bài viết cảnh báo.
Kêu gọi minh bạch và thỏa thuận quốc tế
Các nhà nghiên cứu ký tên với tư cách cá nhân. Họ kêu gọi giới hoạch định chính sách khẩn trương yêu cầu các công ty công khai họ đã tự động hóa đến đâu trong chính quá trình phát triển mô hình của mình.
Bài viết cũng đề nghị lãnh đạo các nước đàm phán thỏa thuận quốc tế “để ngăn việc phát triển và sử dụng các hệ thống AI năng lực cao gây bất ổn xã hội”.
Đề xuất này trùng với lời kêu gọi kiểm soát nhịp phát triển AI của lãnh đạo OpenAI và Anthropic, trong đó có ý tưởng lập một cơ quan quốc tế đặt tiêu chuẩn cho AI. Một số nước phương Tây đã âm thầm vận động thành lập một cơ quan như vậy.
Cuộc đua phát triển AI tự cải thiện
Các công ty AI hàng đầu đã bắt đầu chạy đua phát triển những hệ thống có thể tự cải thiện.
Anthropic mới đây cho biết mô hình Claude của hãng “dẫn dắt” 26% công việc nghiên cứu và phát triển. Ở một số mảng, tỷ lệ sử dụng vượt 90%. OpenAI đặt mục tiêu có một “nhà nghiên cứu AI” hoàn toàn tự động trước năm 2028. Hãng cho biết khoảng 70% nhà nghiên cứu của mình đang sử dụng từ 4 tác nhân AI (AI agent) trở lên để hỗ trợ công việc.
Khi con người dần rút khỏi quy trình, họ có thể mất cơ hội phát hiện vấn đề và vận dụng chuyên môn để xử lý, bài viết nhận định.
Hồi tháng 7, hàng trăm tác nhân AI của OpenAI đã tự truy cập Internet và xâm nhập hệ thống của công ty Hugging Face. Số tác nhân này vốn chỉ được chạy thử nghiệm an ninh mạng trong môi trường khép kín. Chúng chiếm quyền quản trị cao nhất (root) trên một máy chủ đang vận hành và tải về các kho mã nguồn không công khai, theo Investing.com.
Các nhà nghiên cứu độc lập được giao xem xét vụ việc theo thỏa thuận với OpenAI. Họ cho biết vụ việc lớn đến mức phải dựa vào AI mới phân tích được.
“Chúng ta đã đến giai đoạn cần hệ thống AI để giám sát hành vi của các tác nhân AI. Ngoài cách đó, không còn cách nào khác để quan sát và giám sát chúng. Năng lực của con người đã không còn đủ,” bà Tống nói.
“Xã hội loài người thực sự chưa sẵn sàng cho những thay đổi và xáo trộn nhanh đến như vậy,” bà nói thêm. Bà Tống, giáo sư Đại học California, Berkeley, cũng là đồng giám đốc Trung tâm Trí tuệ Phi tập trung Có trách nhiệm của trường.
Sau vụ Hugging Face, OpenAI cho biết đã tạm dừng một phần việc huấn luyện hồi tháng 8 và bổ sung các biện pháp an toàn, giám sát. Tuần trước, hãng lại dừng huấn luyện mô hình mạnh nhất của mình sau khi phát hiện thêm trường hợp tác nhân AI hành xử bất thường.
OpenAI, Anthropic, Meta và Google đều thừa nhận một số mô hình của họ từng có hành vi bất thường trong lúc thử nghiệm.
Hôm thứ Hai, hãng chip Nvidia giới thiệu công cụ phần mềm mới mà hãng cho biết sẽ giúp doanh nghiệp giám sát và kiểm soát tác nhân AI tốt hơn.
OpenAI, Microsoft và Meta từ chối bình luận. Anthropic chưa trả lời đề nghị bình luận.
Từ khóa nguy cơ của trí tuệ nhân tạo Geoffrey Hinton Anthropic an toàn AI tác nhân AI trí tuệ nhân tạo openAI

































