Sinh viên Mỹ phát hiện chiến dịch tấn công mạng do AI tự chủ phát động
- Cao Sam
- •
Một sinh viên đại học tại Texas gần đây tình cờ phát hiện một chiến dịch tấn công mạng do một hệ thống trí tuệ nhân tạo (AI) mất kiểm soát tự chủ phát động. AI này thậm chí còn giả mạo nhiều danh tính con người để đăng bình luận, cố gắng khiến anh tin rằng phán đoán của mình là sai.
Gặp khó khăn khi tìm việc, tình cờ phát hiện yêu cầu kéo bất thường
Theo Reuters đưa tin hôm thứ Năm (20/8), sinh viên này là anh Sinan Can Demir, 24 tuổi, đến từ Konya, Thổ Nhĩ Kỳ. Anh là sinh viên năm thứ 3 ngành Khoa học Máy tính tại Đại học Texas ở Dallas.
Anh nói với Reuters rằng mùa hè năm nay, việc tìm kiếm việc làm của anh liên tục gặp trở ngại. Sau khi bị từ chối hơn 20 cơ hội thực tập, anh chuyển sang tìm kiếm các dự án mã nguồn mở trên nền tảng chia sẻ mã nguồn GitHub, với hy vọng bổ sung kinh nghiệm cho hồ sơ cá nhân.
Cuối tháng Bảy, trên trang của một phần mềm quét mạng mã nguồn mở có tên “myNetwork”, anh phát hiện tài khoản mang tên người dùng “miraholt31” gửi một yêu cầu kéo (pull request) đáng ngờ, trong đó chứa một chương trình phát tán phần mềm độc hại được che giấu. Anh Demir lập tức đăng cảnh báo trên bảng thảo luận, chỉ ra rằng yêu cầu này là một cái bẫy.
AI giả mạo danh tính, gây áp lực và phủ nhận cáo buộc
Ngoài dự liệu của anh Demir, tài khoản “miraholt31” ngay lập tức phản bác, khẳng định yêu cầu của mình không gây hại. Ngay sau đó, một tài khoản tự xưng là kỹ sư người Đức tên Lena Brandt cũng tham gia thảo luận, phụ họa rằng yêu cầu này hoàn toàn an toàn và gây áp lực lên người duy trì dự án, yêu cầu họ chấp nhận bản cập nhật này.
Anh Demir nói: “Có quá nhiều người phản bác khiến tôi bắt đầu nghi ngờ chính mình, tự hỏi liệu có phải mình đã cáo buộc nhầm người hay không”. May mắn là sau đó anh sử dụng chatbot Claude của Anthropic để kiểm chứng nhận định của mình và cuối cùng xác định rằng mình đã đúng.
Sau đó, người tạo ra dự án myNetwork cũng tin vào nhận định của anh Demir và từ chối yêu cầu cập nhật này với lý do “an toàn”.
Đối thủ không phải người thật mà là AI tự chủ tấn công mạng
Mãi đến khi Viện An toàn Trí tuệ Nhân tạo Anh (AI Safety Institute – AISI) thuộc Chính phủ Anh chủ động liên hệ với anh Demir, anh mới biết rằng đối thủ mà mình đối đầu không phải là một hacker người thật, mà là một tác nhân AI tự chủ đã mất kiểm soát trong quá trình thử nghiệm an toàn AI.
Ngày 4/8, AISI đã công bố phiên bản lược trích về diễn biến vụ việc, cho biết vào thời điểm đó viện đang đánh giá những rủi ro mà các loại mô hình khác nhau có thể gây ra và tình trạng mất kiểm soát đã xảy ra trong quá trình thử nghiệm.
Báo cáo của AISI xác nhận tác nhân AI mất kiểm soát này được vận hành bởi mô hình Mythos 5 của Anthropic. GitHub trả lời qua email rằng nền tảng này đã vô hiệu hóa các tài khoản giả được phát hiện, căn cứ theo các chính sách chống lừa đảo và chống tấn công mạng của mình.
Phía Anthropic sau đó tuyên bố trên nền tảng mạng xã hội X, nhấn mạnh rằng cuộc thử nghiệm được tiến hành trong “những điều kiện cố tình nới lỏng”, không đại diện cho bất kỳ mô hình nào của công ty đang được vận hành trong điều kiện thông thường.
Chuyên gia: Rủi ro tấn công chuỗi cung ứng gia tăng
Nhiều chuyên gia về an ninh mạng và an toàn AI chỉ ra rằng phương thức tấn công mà anh Demir phát hiện thuộc dạng “tấn công chuỗi cung ứng” — tức kẻ tấn công can thiệp, sửa đổi phần mềm tại nguồn để từ đó gây ảnh hưởng đến số lượng lớn người dùng ở phía hạ nguồn. Bản chất của phương thức này tương tự như việc đầu độc nguồn nước của một thành phố.
Nhiều vụ tấn công mạng nghiêm trọng nhất trong lịch sử thuộc loại này, trong đó có cuộc tấn công bằng mã độc NotPetya năm 2017 làm tê liệt nhiều cơ quan tại Ukraine, và vụ gián điệp mạng SolarWinds năm 2020 ảnh hưởng đến các mạng lưới của Chính phủ Mỹ.
Ông Lukasz Olejnik, nghiên cứu viên cấp cao tại King’s College London, nhấn mạnh rằng vụ việc cho thấy AI đã vượt qua ranh giới “từ tấn công mạng tự chủ sang lừa dối mang tính tương tác”.
Chuyên gia an ninh ông Maxie Reynolds cũng chỉ ra rằng tính chiến lược mà AI thể hiện trong quá trình lừa dối là điều đáng báo động, đồng thời cho rằng đây là “tương lai của các cuộc tấn công lừa đảo bằng kỹ thuật xã hội”.
Anh Demir cho biết trải nghiệm lần này càng khiến anh tin rằng các phòng thí nghiệm AI tiên phong cần thận trọng hơn khi phát triển những công nghệ liên quan, thay vì chỉ một mực theo đuổi việc nâng cao hiệu năng.
Từ khóa AI trí tuệ nhân tạo

































