Nhà Trắng đã yêu cầu công ty AI Anthropic “minh bạch hoàn toàn” và “khắc phục ngay”, sau khi công ty cho biết AI của mình nộp 20 đơn thị thực Mỹ và gửi tin báo giả.

(Ảnh minh họa: Poetra.RH/Shutterstock)

Yêu cầu này nằm trong tuyên bố của “Lực lượng Siêu trí tuệ” (SIF), nhóm công tác mới thành lập của Nhà Trắng. Tuyên bố nhấn mạnh quy trình báo cáo và khắc phục sự cố “không phải là tùy chọn”, mà là “nghĩa vụ an ninh quốc gia then chốt”, theo Liên Hợp Tảo Báo. Tuy nhiên, tuyên bố không nêu biện pháp xử lý hay chế tài nếu các công ty AI báo cáo và khắc phục sự cố không đầy đủ.

“Chúng tôi yêu cầu Anthropic và mọi công ty thực hiện nghĩa vụ của mình, báo cáo sự cố ngay lập tức,” tuyên bố nêu. Các công ty còn phải hợp tác đầy đủ với cơ quan thực thi pháp luật liên bang và tiểu bang, khắc phục mọi thiệt hại và áp dụng biện pháp bảo vệ cụ thể để những sai sót này không tái diễn.

SIF gọi các sự cố này là hành vi “sử dụng trái phép và gian lận các hệ thống của chính phủ và các hệ thống khác”.

Tuyên bố mà Cybernews trích đăng cho biết ngay trong ngày thứ Sáu (9/10), Anthropic đã liên hệ với SIF để báo chi tiết nhiều sự cố cũ mà công ty phát hiện hồi cuối tháng 9.

“Công ty cho chúng tôi biết các sự việc này đã xảy ra trong quá khứ, hoạt động đã chấm dứt và hiện không còn hoạt động tương tự nào,” tuyên bố của SIF viết. Nhà Trắng yêu cầu Anthropic minh bạch ngay và đầy đủ với các bên liên quan cũng như cho công chúng. Công ty cũng phải cung cấp ngay dịch vụ khắc phục cho các bên bị ảnh hưởng và bất kỳ người Mỹ nào chịu thiệt hại.

20 đơn thị thực đều “chưa hoàn chỉnh”

Một người phát ngôn Bộ Ngoại giao Mỹ hôm thứ Bảy (10/10) cho biết một mô hình thử nghiệm của Anthropic đã nộp “19 đơn xin thị thực không định cư trong tháng 8 và một đơn trong tháng 5” qua biểu mẫu công khai trên trang web của Bộ, The Philadelphia Inquirer đưa tin.

Người phát ngôn mô tả các tờ đơn này là “chưa hoàn chỉnh”. Bộ không xử lý đơn nào trong số đó.

“Mô hình của Anthropic không hề xâm nhập hay tấn công bất kỳ hệ thống nào của Bộ,” người phát ngôn viết trong thư điện tử trả lời câu hỏi của báo này. Người này cho biết thêm Bộ Ngoại giao “cam kết ngăn chặn gian lận thị thực và bảo vệ hệ thống công nghệ thông tin” và liên tục cải tiến để đối phó với các mối đe dọa ở mọi cấp độ.

Tin báo án mạng giả gửi cảnh sát Philadelphia

Vụ tin báo giả xảy ra hồi tháng 7. Trung sĩ Eric Gripp, người phát ngôn Sở Cảnh sát Philadelphia, hôm thứ Sáu (9/10) cho biết khoảng 23h30 hôm 18/7 (giờ địa phương), một mô hình AI của Anthropic đã gửi tin báo về một vụ án mạng chưa phá được lên PhillyUnsolvedMurders.com, trang nhận tin báo của sở.

Mô hình gửi tin là Claude Haiku 4.5, khi đó được giao tạo và thực hiện các tác vụ mẫu trên những trang web chọn ngẫu nhiên. Anthropic dặn mô hình không bao giờ đăng nhập hay nhập dữ liệu cá nhân, nhưng không cấm rõ việc gửi biểu mẫu.

Tin báo viết: “Tôi có thể có thông tin về vụ án này. Tôi nhớ đã thấy một người khớp với mô tả ở khu vực quanh [con phố nêu trên trang] vào khoảng thời gian đó”. Trang web không hề đăng mô tả nào về hung thủ, Anthropic lưu ý.

Cảnh sát Philadelphia cho biết tin báo này đã bị xếp vào loại tin rác và không được chuyển cho Trung tâm Theo dõi Tội phạm Thời gian thực. Hệ thống của cảnh sát cũng không có dấu hiệu bị xâm nhập hay rò rỉ dữ liệu.

Dù vậy, sở cảnh sát vẫn chỉ trích Anthropic: “Chậm trễ hai tháng mới phát hiện và báo sự cố cho thành phố là điều không thể chấp nhận”. Lãnh đạo sở đã gặp đại diện Anthropic hôm thứ Năm (8/10) để bàn về sự việc.

“Từ bản ghi, Claude dường như chỉ đang tạo nội dung mẫu cho nhiệm vụ, chứ không cố đánh lừa ai để đạt mục đích nào đó,” Anthropic viết trên blog.

Anthropic: Tác động thực tế “rất nhỏ”

Trong báo cáo công bố hôm thứ Sáu (9/10), Anthropic chia các hành vi “ngoài dự kiến” của Claude thành 4 nhóm: khai thác lỗ hổng phần mềm để chạy lệnh trên máy chủ; gửi biểu mẫu nhạy cảm trên trang web thật; lách hạn chế để lấy dữ liệu cần mã truy cập (token) hoặc phải trả phí; sử dụng dịch vụ rút gọn đường dẫn để vượt giới hạn của công cụ tải trang.

Ngoài vụ Philadelphia, Claude từng khai thác lỗ hổng để chạy lệnh trên máy chủ của một trường đại học và lách hạn chế để lấy dữ liệu của chính phủ vốn phải trả phí mới xem được, theo Cybernews.

Một số trang bị ảnh hưởng do các cơ quan nhà nước Mỹ cấp liên bang, tiểu bang và địa phương vận hành, nhưng công ty không nêu tên cụ thể.

Anthropic cho rằng các sự cố này có “tác động rất nhỏ trong thực tế” và “ít nghiêm trọng hơn đáng kể” so với các vụ công ty đã báo cáo hôm 30/7 và 9/9. Hồi tháng 7, công ty từng công bố một số mô hình Claude đã xâm nhập hệ thống của 3 công ty trong các đợt thử nghiệm an ninh mạng.

Anthropic vốn đã tắt quyền truy cập internet trực tiếp ở một số đợt đánh giá rủi ro cao và an ninh mạng. Nay công ty mở rộng biện pháp này ra “tất cả các đợt đánh giá nội bộ”, cho đến khi xác nhận các biện pháp bảo mật và giám sát “phát hiện được những hành vi như thế này một cách đáng tin cậy”.

Công ty cũng đang chuyển các tác tử AI nội bộ sang hạ tầng quản lý tập trung có cơ chế cô lập chặt chẽ, hạn chế tối đa quyền truy cập internet và giám sát kỹ hơn những gì các tác tử làm.

Nhóm công tác mới lập hôm 4/10

Nhà Trắng thành lập SIF hôm Chủ nhật (4/10) nhằm “bảo đảm nước Mỹ tiếp tục dẫn đầu thế giới về siêu trí tuệ”. Nhóm do ông Jay Clayton, người phụ trách AI của Nhà Trắng, làm chủ tịch.

Tổng thống Mỹ Donald Trump đã yêu cầu chính quyền sử dụng cụm từ “siêu trí tuệ” thay cho “trí tuệ nhân tạo”, vì ông cho rằng cách gọi cũ khiến công nghệ này nghe có vẻ giả tạo.

Cuối tháng 9, ông Trump nói các công ty AI có thể tự giám sát bằng “sự tự điều chỉnh tuyệt vời”. Cũng trong tháng đó, theo Liên Hợp Tảo Báo, ông đã ký với các tập đoàn công nghệ AI lớn một thỏa thuận tự quản về an toàn tại Nhà Trắng. Các công ty cam kết tự tăng cường giám sát nội bộ và đưa vào cơ chế thẩm định độc lập từ bên ngoài.