Khoa Học - Công Nghệ

Mô hình Kimi K3 của Moonshot AI vượt rào bảo mật, tính chất nghiêm trọng

Các nhà nghiên cứu cho biết mô hình trí tuệ nhân tạo (AI) Kimi K3 của công ty khởi nghiệp Trung Quốc Moonshot AI đã phá vỡ môi trường sandbox kiểm thử an ninh mạng, “vượt rào” và kết nối với Internet thực.

Kimi K3. (Ảnh minh họa: Shutterstock)

Khác với những sự cố vượt rào gần đây liên quan đến OpenAI và Anthropic, sự việc lần này liên quan đến một mô hình mã nguồn mở mà bất kỳ ai cũng có thể tải xuống, đồng thời mô hình đang sử dụng cơ chế bảo vệ an toàn mặc định.

Hôm thứ Năm (6/8), công ty khởi nghiệp an ninh mạng Mỹ Frontier Security công bố báo cáo cho biết, Kimi K3 đã thoát khỏi môi trường kiểm thử an ninh mạng do Viện An toàn Trí tuệ Nhân tạo Anh (AISI) thiết lập, thường được gọi là sandbox.

AI vượt rào rồi trực tiếp kết nối Internet để tìm câu trả lời

Các mô hình AI thường được vận hành trong một “sandbox” biệt lập trong quá trình kiểm thử an ninh mạng, nhằm ngăn chúng truy cập thông tin bên ngoài và đánh giá khả năng tự mình giải quyết vấn đề.

Yaron Singer, nhà sáng lập kiêm giám đốc điều hành Frontier Security, cho biết họ phát hiện một lỗ hổng trong sandbox, sau đó phát hiện Kimi K3 đang lợi dụng lỗ hổng này để thoát khỏi sandbox và bắt đầu truy cập thông tin bên ngoài môi trường kiểm thử.

Họ cho rằng điều này cho thấy bên trong mô hình Kimi K3 thiếu các cơ chế kiểm soát an ninh mạng, “cho thấy Kimi K3 không có các hàng rào nội tại hoặc những giới hạn được tích hợp sẵn để ngăn mô hình vượt khỏi phạm vi nhiệm vụ đã được thiết lập”, giống như các mô hình khác.

Sự cố lỗ hổng an ninh mạng của Kimi K3 tương tự một loạt sự cố gần đây được Meta, OpenAI và Anthropic báo cáo, một lần nữa làm dấy lên lo ngại về khả năng tự chủ của AI và những rủi ro đối với an ninh mạng.

Được biết, sau khi phá vỡ các giới hạn, Kimi K3 không tìm cách xâm nhập các trang web bên ngoài hoặc thực hiện các cuộc tấn công độc hại, mà truy cập những trang web công khai như GitHub để tìm đáp án cho bài kiểm thử.

Các nhà nghiên cứu cho rằng nếu một “mô hình có năng lực suy luận cao” phát hiện ra một lối tắt như vậy, những mô hình khác có quyền truy cập tương tự cũng có thể bắt chước.

Cuộc kiểm thử lần này do Frontier Security độc lập thực hiện, sử dụng phần mềm sandbox miễn phí do AISI cung cấp.

Một đại diện AISI cho biết viện này không tham gia cuộc kiểm thử nói trên và cho rằng bản thân công cụ sandbox không có “lỗ hổng cố hữu”, qua đó ám chỉ kết quả kiểm thử của Frontier Security có thể liên quan đến cách công ty này thiết lập sandbox.

Mô hình mở nếu bị đối tượng thù địch lợi dụng sẽ nguy hiểm hơn

Các nhà nghiên cứu cảnh báo mô hình Kimi K3 được công khai hiện nay chưa được trang bị đầy đủ các hàng rào an toàn, “về cơ bản khiến nó trở thành một mô hình hacker có hiệu năng cực cao”.

Do Kimi K3 là một mô hình được công khai cho mọi người sử dụng, Frontier Security đã sử dụng cơ chế bảo vệ an toàn mặc định của Kimi K3, tức cơ chế được cung cấp cho người dùng thông thường.

Các nhà nghiên cứu cảnh báo rằng tính chất mở này khiến các đối tượng có ý đồ thù địch có thể dễ dàng khai thác cùng một lỗ hổng, qua đó khiến tác hại tiềm tàng của sự việc trở nên nghiêm trọng hơn.

Singer nói với Bloomberg: “Mô hình của Kimi được công khai, nhưng nó không có những biện pháp bảo vệ này”.

Đại diện Moonshot AI chưa đưa ra bình luận về sự việc.

Xác định ranh giới của mô hình là yếu tố then chốt trong phòng thủ an toàn

Paul Kassianik, nhà nghiên cứu của Frontier Security, nói với WIRED rằng Kimi K3 “rất giỏi trong việc đạt được mục tiêu bằng mọi cách” và thiếu các biện pháp bảo vệ để ngăn nó gian lận hoặc thoát khỏi môi trường được thiết lập.

Kassianik cho rằng việc Kimi K3 vượt rào cho thấy tầm quan trọng của việc xác định rõ ranh giới khi ứng dụng các mô hình mã nguồn mở.

Về hành vi “vượt rào” của các mô hình AI, Matt Fredrikson, phó giáo sư Đại học Carnegie Mellon kiêm giám đốc điều hành Gray Swan, cho biết ông không bất ngờ.

Ông nói rằng nếu giao cho mô hình một mục tiêu không có giới hạn rõ ràng, đồng thời không xác định rõ ranh giới, “nó sẽ tìm cách để tìm ra câu trả lời”.

Ông cảnh báo rằng nếu kết nối các tác nhân AI (Agent) với những công việc tự động hóa hằng ngày mà không xác định rõ ranh giới, việc hệ thống mất kiểm soát sớm muộn cũng sẽ xảy ra.

Chris McGuire, cựu quan chức Hội đồng An ninh Quốc gia Nhà Trắng dưới thời Tổng thống Joe Biden, đăng trên mạng xã hội X rằng: “Xét việc Kimi K3 có khả năng tự chủ phá vỡ môi trường kiểm thử, rõ ràng nó cũng nên được kiểm thử an toàn tại Mỹ giống như các mô hình khác của Mỹ”.

“Vì sao chúng ta yêu cầu các mô hình trí tuệ nhân tạo hàng đầu của Mỹ phải trải qua kiểm thử an toàn, nhưng lại miễn trừ các mô hình Trung Quốc đang tích cực thể hiện hành vi nguy hiểm,” ông đặt câu hỏi.

Lâm Yến

Published by
Lâm Yến

Recent Posts

FAA yêu cầu kiểm tra hàng trăm máy bay Boeing 737 MAX vì nguy cơ nứt kết cấu

Cơ quan Hàng không Liên bang Mỹ (FAA) hôm thứ Năm (6/8) đã ban hành…

21 phút ago

Thượng Hải siết giám sát bằng dữ liệu lớn: Rời thành phố 28 ngày lập tức bị ‘hỏi thăm’

Nếu một người có “hồ sơ không tốt”, việc xuất cảnh, xin giấy công chứng…

36 phút ago

Ông Trump nối lại nỗ lực cách chức Thống đốc Fed Lisa Cook

Ông Trump gọi đây là “một vấn đề lớn” và nói tại lễ ký rằng…

1 giờ ago

AI lần đầu thiết kế virus mới, giới khoa học lo ngại rủi ro an toàn sinh học

Việc công khai mã nguồn làm dấy lên lo ngại về an toàn sinh học

1 giờ ago

Tòa phúc thẩm Mỹ chặn dự án xây đại sảnh mới, ông Trump quyết kháng cáo

Kinh phí được tài trợ bởi các cá nhân, doanh nghiệp và chính ông Trump,…

1 giờ ago

Giám đốc FBI: Tăng cường trấn áp hoạt động gián điệp nước ngoài

FBI luôn “tập trung cao độ” vào việc đối phó với hoạt động gián điệp…

1 giờ ago