Các công ty AI hàng đầu thiếu phương án ứng phó khi AI mất kiểm soát
Cao Sam
•
Chia sẻ FB
Chia sẻ Twitter
Bình luận
Một báo cáo phân tích mới nhất cho thấy, trong số 5 công ty trí tuệ nhân tạo (AI) hàng đầu, rất ít phòng nghiên cứu từng công bố hoặc trình bày các phương án ứng phó với tình huống AI vượt khỏi tầm kiểm soát.Trí tuệ nhân tạo thổi bùng nỗi lo sợ! (Ảnh minh họa: Shutterstock)
Các công ty AI hàng đầu thiếu phương án ứng phó khi AI mất kiểm soát
Theo hãng truyền thông công nghệ TechCrunch đưa tin hôm thứ Bảy (22/8), báo cáo phân tích trên do Guidelight AI Standards, một tổ chức chuyên thúc đẩy phát triển AI tiên tiến theo hướng an toàn, thực hiện. Tổ chức này đánh giá mức độ chuẩn bị của các phòng nghiên cứu AI tiên phong thuộc 5 công ty gồm Anthropic, Google, OpenAI, Meta và xAI trong việc ứng phó với những tình huống AI mất kiểm soát. Trong đó, OpenAI đứng đầu về thành tích, còn Anthropic và Meta có điểm số thấp nhất.
Guidelight chủ yếu đánh giá các tài liệu được các công ty công khai, tập trung xem xét liệu khi mô hình AI xuất hiện hành vi nguy hiểm, công ty có các biện pháp ứng phó rõ ràng như thu hồi quyền hạn, giám sát hoạt động, tạm dừng khối lượng công việc và ngừng hoạt động hoàn toàn hay không. Tổ chức này cũng quan tâm đến hệ thống nhật ký nội bộ, theo dõi hành vi vi phạm và các cuộc đánh giá an toàn của bên thứ ba.
Steven Adler, nhà khoa học trưởng của Guidelight và cựu nhà nghiên cứu an toàn của OpenAI, nói với TechCrunch rằng điều khiến ông bất ngờ là các công ty AI rất ít khi công khai cách thức họ sẽ xử lý nếu một mô hình AI xảy ra tình trạng mất kiểm soát nghiêm trọng.
Ông cho rằng, khi các hệ thống tác nhân AI ngày càng được trao nhiều quyền tự chủ hơn, các công ty cần xây dựng trước những khuôn khổ quản lý và cơ chế giám sát hành vi của mô hình, đồng thời can thiệp trước khi các hành động nguy hiểm xảy ra.
OpenAI đạt điểm cao nhất
Trong 5 công ty, OpenAI có kết quả tốt nhất với 3/5 điểm. Guidelight cho biết OpenAI trước đây từng tạm dừng hoặc chấm dứt một số hoạt động sau khi phát hiện các vấn đề an toàn, bao gồm triển khai và huấn luyện các mô hình AI nội bộ. Công ty cũng nêu rõ những biện pháp cần thực hiện trước khi khôi phục các hoạt động liên quan.
Tuy nhiên, Guidelight vẫn chưa tìm thấy trong các tài liệu công khai của OpenAI một kế hoạch ứng phó chính thức và hoàn chỉnh đối với tình huống AI mất kiểm soát, trong đó quy định rõ khi nào và bằng cách nào cần xử lý những mô hình AI có nguy cơ vượt khỏi tầm kiểm soát trong tương lai.
Một phát ngôn viên OpenAI cho biết công ty đã xây dựng các quy trình nội bộ cho phép hạn chế quyền của mô hình AI, tạm dừng hoạt động, thu hẹp phạm vi triển khai hoặc đưa mô hình hoàn toàn ngoại tuyến. Theo người này, OpenAI cũng đã thực tế áp dụng những biện pháp trên trong quá khứ.
Anthropic và Meta công khai ít thông tin
Guidelight giải thích rằng Anthropic và Meta đạt điểm thấp nhất trong đánh giá chủ yếu vì hiện chưa có đủ bằng chứng công khai cho thấy hai công ty đã xây dựng các phương án cụ thể để kiềm chế những mô hình AI mất kiểm soát.
Anthropic cho biết nếu phát hiện mô hình tìm cách né tránh sự giám sát, thoát khỏi hoặc phá vỡ sự kiểm soát của con người, công ty sẽ tiến hành đánh giá rủi ro trước khi quyết định có áp dụng các biện pháp kiềm chế hay không.
Meta cho biết công ty đã có một khuôn khổ đánh giá rủi ro AI. Tuy nhiên, Meta không nói rõ liệu công ty có một kế hoạch ứng phó khẩn cấp nội bộ chưa được công khai hay không.
Google cũng phản hồi về báo cáo phân tích này, cho rằng cuộc đánh giá chưa bao quát toàn bộ các biện pháp an toàn và bảo mật AI của công ty.
Cần chuẩn bị trước phương án ứng phó khi AI mất kiểm soát
Tuy nhiên, Guidelight nhấn mạnh rằng điểm số thấp chỉ phản ánh tình trạng thiếu thông tin công khai, không có nghĩa các công ty chắc chắn không sở hữu các biện pháp an toàn nội bộ.
Adler cho rằng tốc độ phát triển của AI đang rất nhanh. Ngay cả khi những phương án được xây dựng trước có thể không còn phù hợp trong dài hạn, việc chủ động lập kế hoạch ứng phó rủi ro vẫn vô cùng quan trọng.
Ông nói rằng nếu doanh nghiệp chuẩn bị trước các phương án ứng phó, họ sẽ có khả năng xử lý tốt hơn khi một cuộc khủng hoảng thực sự xảy ra.