Mô hình AI của Meta vô tình xâm nhập một công ty vì lỗi trong quá trình kiểm thử
- Trần Đình
- •
Tập đoàn công nghệ Meta hôm thứ Tư (5/8) xác nhận một mô hình trí tuệ nhân tạo (AI) của hãng đã vô tình giành được quyền truy cập Internet trong quá trình tham gia một cuộc kiểm thử an ninh mạng do bên thứ ba thực hiện, do lỗi cấu hình trong môi trường thử nghiệm. Sau đó, mô hình này đã xâm nhập vào hệ thống của một công ty khác và thay đổi môi trường nội bộ của công ty đó.
Trước đó, OpenAI và Anthropic cũng từng gặp các sự cố tương tự, làm dấy lên lo ngại trong ngành về cơ chế kiểm soát an toàn và phòng vệ đối với các mô hình AI tiên tiến.
Lỗi cấu hình trong môi trường thử nghiệm, mô hình bị cho là Muse Spark 1.1
Theo nguồn tin của The Information, mô hình liên quan là Muse Spark 1.1 của Meta. Trước đây, Meta từng giới thiệu đây là mô hình có năng lực mạnh nhất của hãng trong các tác vụ lập trình thực tế và các nhiệm vụ tác nhân AI (agentic tasks).
Người phát ngôn Meta cho biết: “Công ty kiểm thử độc lập Irregular mà Meta thuê đã xảy ra lỗi cấu hình, vô tình khiến một trong các mô hình của chúng tôi có quyền truy cập Internet trong quá trình đánh giá”.
Meta cho biết mô hình này “đã khai thác một lỗ hổng bảo mật của một dịch vụ bên thứ ba theo cách tương tự như các trường hợp mà những công ty khác từng báo cáo trước đây”.
Công ty Irregular, đơn vị phụ trách đánh giá an toàn, cho biết sự cố lần này “hoàn toàn giống với vấn đề về môi trường đánh giá mà Anthropic công bố vào tuần trước”. Trước đó, Anthropic cho biết do lỗi cấu hình, mô hình Claude đã kết nối được với Internet công cộng và sau đó xâm nhập hệ thống của ba tổ chức khác nhau.
Irregular nhấn mạnh: “Sự cố này không liên quan đến việc thoát khỏi môi trường sandbox và cũng không phải là một cuộc tấn công mạng phức tạp. Hiện không còn vấn đề nào chưa được giải quyết”.
Công ty này cho biết đang chuẩn bị công bố một sách trắng nhằm chia sẻ các phương pháp tốt nhất về cô lập hệ thống và tiến hành đánh giá an ninh mạng một cách an toàn.
Meta cho biết Irregular đã thông báo ngay về sự cố và công ty đang tiến hành điều tra. Hãng khẳng định sẽ công bố báo cáo phân tích đầy đủ sau khi “nắm được toàn bộ sự việc”.
AI ngày càng mạnh, việc kiểm thử cũng trở nên phức tạp hơn
Mặc dù Meta, Anthropic và OpenAI đều gần đây công bố các sự cố AI xâm nhập hệ thống bên ngoài trong quá trình thử nghiệm, nguyên nhân của các vụ việc không hoàn toàn giống nhau.
Đối với Meta và Anthropic, mô hình AI có quyền truy cập Internet do lỗi cấu hình trong môi trường kiểm thử. Trong khi đó, ở sự cố của OpenAI, tác nhân AI đã tự khai thác một lỗ hổng chưa từng được biết đến để kết nối Internet, sau đó tấn công nhiều dịch vụ có thể truy cập công khai, trong đó có nền tảng AI Hugging Face.
Một nguồn tin am hiểu vụ việc nói với CNN rằng trong một số môi trường thử nghiệm, các mô hình AI được cấp quyền truy cập Internet ở mức hạn chế nhằm mô phỏng các mối đe dọa trong thế giới thực. Tuy nhiên, cuộc thử nghiệm của Meta đã gặp một “lỗi thiết lập” hiếm gặp.
Nguồn tin này nhận định: “Hiện nay, năng lực của các mô hình AI đang tăng lên rất nhanh, trong khi các bài kiểm thử dùng để đánh giá chúng cũng phải trở nên phức tạp hơn nhiều. Điều đó tạo ra nhiều khoảng trống cho sai sót và đồng nghĩa với việc chúng ta cần… nâng tiêu chuẩn lên đáng kể”.
Mỹ thúc đẩy khung thử nghiệm an toàn tự nguyện
Sau sự cố của OpenAI, nhiều tổng chưởng lý thuộc Đảng Cộng hòa tại các bang của Mỹ đã yêu cầu công ty lưu giữ toàn bộ tài liệu có thể liên quan đến vụ xâm nhập nền tảng Hugging Face. OpenAI cho biết sẽ nghiêm túc thực hiện yêu cầu này và công bố báo cáo kỹ thuật về sự cố.
Trong bối cảnh năng lực AI phát triển nhanh chóng, chính phủ Mỹ cũng đang thúc đẩy việc xây dựng các tiêu chuẩn an toàn mới.
Trong tuần này, Nhà Trắng đã tổ chức cuộc họp với đại diện của Meta, Anthropic, OpenAI, Google và Nvidia để thảo luận về một khung thử nghiệm an ninh mạng tự nguyện mới dành cho các mô hình AI tiên tiến.
Theo Reuters, chính quyền Tổng thống Donald Trump đã trao đổi với các doanh nghiệp về bộ quy tắc thử nghiệm chưa được công bố và thông báo rằng các mô hình AI có trọng số mở (open-weight models) như Llama của Meta và Nemotron của Nvidia sẽ không nằm trong chương trình thử nghiệm an toàn tự nguyện này.

































