Tranh cãi về an toàn trí tuệ nhân tạo (AI) tiếp tục nóng lên. Các nhà nghiên cứu từng và đang làm việc tại hai công ty khởi nghiệp AI nổi tiếng là Anthropic và OpenAI lần lượt đưa ra những cảnh báo nghiêm túc, cho rằng xác suất AI hủy diệt nhân loại trong 10 năm tới đã vượt quá 10%.

(Nguồn: Shutterstock)

Trong bối cảnh những người tố giác nội bộ rời công ty và lên tiếng phơi bày cuộc cạnh tranh khốc liệt trong ngành, dư luận đang đặc biệt quan tâm đến nguy cơ sinh tồn và bài toán căn chỉnh do “siêu trí tuệ” gây ra.

Ông Evan Hubinger, người đứng đầu bộ phận khoa học căn chỉnh (Alignment Science) tại Anthropic, hôm thứ Ba (8/9) công khai cho biết ông cá nhân cho rằng AI có hơn 10% khả năng “hủy diệt toàn bộ nhân loại” trong 10 năm tới. Trước đó, cựu nghiên cứu viên của công ty là Jacob Coxon đã chỉ trích Anthropic hành xử thiếu trách nhiệm và tuyên bố nghỉ việc.

Jacob Coxon viết trong một bài đăng dài trên nền tảng X hôm Chủ nhật (6/9), giải thích về quyết định nghỉ việc: “Những người xây dựng AI thực sự tin rằng nó có thể hủy diệt tất cả chúng ta trong 10 năm tới. Hôm nay tôi đã từ chức khỏi Anthropic. Trong ba năm qua, tôi đã làm công việc nghiên cứu tiền huấn luyện (pre-training) tại OpenAI và Anthropic. Cả hai công ty đều hành xử thiếu trách nhiệm. Họ đang trực tiếp lao tới siêu trí tuệ có khả năng tự cải thiện, và đặt mạng sống của chúng ta lên bàn cược”.

Ông Hubinger thừa nhận rằng mặc dù rủi ro an toàn từ các mô hình AI hiện nay tương đối thấp, nhưng trước viễn cảnh xuất hiện siêu trí tuệ thông qua khả năng “tự cải thiện” (Self-Improvement), ngành AI cho đến nay vẫn chưa tìm ra giải pháp hiệu quả cho bài toán căn chỉnh AI (Alignment), cũng như chưa đi đúng hướng để giải quyết vấn đề này.

Alignment, thường được gọi là “căn chỉnh AI” hoặc “siêu căn chỉnh” (Superalignment), là quá trình bảo đảm mục tiêu, ý định và hành vi của trí tuệ nhân tạo siêu cấp (ASI) phù hợp với các giá trị, đạo đức và lợi ích sinh tồn của con người, thay vì thực hiện những hành động gây hại cho nhân loại.

Ông Coxon cũng chỉ ra rằng mặc dù các nhà khoa học của Anthropic nhận thức rõ những rủi ro công nghệ, họ vẫn rơi vào tình thế “buộc phải đi trước một bước”, do lo ngại các đối thủ thiếu trách nhiệm khác sẽ là bên đầu tiên mở khóa những năng lực nguy hiểm của AI.

Liên quan đến những cáo buộc và phản hồi này, kênh FOX Business đã đề nghị ông Coxon, ông Hubinger, cùng Anthropic và OpenAI đưa ra bình luận.

Tâm điểm của cuộc tranh luận nằm ở công nghệ “tự cải thiện” của AI và những động cơ thương mại tiềm ẩn phía sau.

Trước hết, công nghệ cho phép AI liên tục tự sửa đổi mã nguồn hoặc phương pháp huấn luyện của chính mình có thể nhanh chóng tạo ra những hệ thống siêu phàm sở hữu năng lực tấn công mạng, đồng thời có khả năng giành được nguồn lực và quyền lực thực tế trong nhiều lĩnh vực.

Ông Coxon cho rằng để ngăn một cuộc chạy đua vũ trang AI trên toàn cầu dẫn đến thảm họa hoàn toàn, các quốc gia có thể cần thực hiện những biện pháp tốn kém, chẳng hạn như tạm thời cấm nâng cao năng lực nền tảng của các mô hình AI.

Một số chuyên gia bên ngoài, trong đó có nhà khoa học máy tính và cố vấn AI của Liên Hợp Quốc Wendy Hall, bày tỏ sự kinh ngạc trước những cảnh báo này. Tuy nhiên, bà cũng đặt câu hỏi liệu một số phát ngôn có mang yếu tố “chiến lược PR và tiếp thị” hay không, trong bối cảnh Anthropic và OpenAI đang cạnh tranh để chuẩn bị cho kế hoạch phát hành cổ phiếu lần đầu ra công chúng (IPO) được thị trường rất kỳ vọng.

Ông Hubinger phân biệt rõ giữa “các mô hình hiện tại” “siêu trí tuệ trong tương lai”, nhấn mạnh rằng rủi ro từ AI hiện nay vẫn có thể kiểm soát. Theo ông, mối đe dọa cốt lõi nằm ở khả năng AI tự cải thiện, từ đó tạo ra một quá trình gia tăng năng lực nhanh chóng và có khả năng vượt khỏi tầm kiểm soát.

Lý Ngôn/ Epoch Times