Amodei, Altman và Musk đồng ý giảm tốc độ phát triển mô hình AI
- Lâm Yến
- •
Ngày 12/9, lãnh đạo của 3 nền tảng AI lớn nhất thế giới hiếm hoi cùng đưa ra quan điểm rằng đã đến lúc giảm tốc độ phát triển những mô hình AI tiên tiến nhất và có lợi nhuận cao nhất. Một trong số họ nhấn mạnh mọi thỏa thuận về AI đạt được giữa Mỹ và Bắc Kinh phải có khả năng kiểm chứng cao.
Cùng ngày, CEO Anthropic PBC Dario Amodei đăng bài viết dài có tiêu đề “Chúng ta phải định nhịp cho công nghệ tiên phong”, đề xuất giảm tốc độ nâng cao năng lực của các mô hình AI tiên phong để dành thời gian cho việc kiểm thử an toàn, căn chỉnh mô hình và đánh giá độc lập.
CEO OpenAI Sam Altman nhanh chóng bày tỏ đồng tình, đồng thời cho biết đây cũng là vấn đề công ty đang thảo luận nội bộ. Altman cam kết OpenAI sẽ áp dụng cơ chế đánh giá của bên thứ ba tương tự Anthropic. CEO xAI Corp. Elon Musk cũng công khai ủng hộ quan điểm của ông Amodei.
Trong bối cảnh cuộc đua AI ngày càng nóng lên, các công ty công nghệ liên tục tung ra những mô hình mạnh hơn, lãnh đạo 3 công ty AI hàng đầu của Mỹ hiếm hoi cùng phát tín hiệu ủng hộ việc “giảm tốc” phát triển các mô hình tiên phong.
Amodei, Altman và Musk đều từng công khai đề cập đến nguy cơ AI mất kiểm soát, bị lạm dụng và các rủi ro an toàn. Tuy nhiên, trong một ngành có mức độ cạnh tranh cao và quy mô đầu tư lớn, đây là lần đầu các đối thủ chính công khai ủng hộ việc phối hợp giảm tốc độ phát triển năng lực của các mô hình tiên phong. Ngành AI từ lâu vẫn lấy việc tăng mức độ tương tác của người dùng, giành thị phần và thúc đẩy doanh số làm mục tiêu, đồng thời phải liên tục tung ra sản phẩm mới.
Giảm tốc không có nghĩa dừng nghiên cứu
Amodei cho rằng cần giảm tốc độ nâng cao năng lực của các mô hình AI để có thời gian cho công tác an toàn, căn chỉnh, kiểm thử và đánh giá độc lập theo kịp. Ông nhấn mạnh mục tiêu không phải phản đối AI mà là tránh một “cuộc đua xuống đáy” bất chấp rủi ro dưới áp lực cạnh tranh thương mại và địa chính trị.
“Chúng ta phải giảm tốc độ nâng cao năng lực của các mô hình trí tuệ nhân tạo. Cần nói rõ rằng giảm tốc không có nghĩa là dừng huấn luyện mô hình hay tiến bộ công nghệ, mà là bảo đảm các công ty có đủ thời gian để điều chỉnh và bảo vệ mô hình của mình, đồng thời để các tổ chức đánh giá độc lập xác nhận điều đó.”
Ông chỉ ra rằng tốc độ tiến bộ của AI đã tăng đáng kể trong những tháng gần đây, một phần vì AI ngày càng có khả năng hỗ trợ thiết kế, huấn luyện và cải tiến các hệ thống AI thế hệ tiếp theo. Ông gọi hiện tượng này là “tự cải tiến đệ quy” và cảnh báo rằng nếu thiếu những giới hạn thận trọng, năng lực AI có thể vượt trước khả năng hiểu và quản trị của con người.
Vụ tấn công Hugging Face trở thành cảnh báo
Một mối lo ngại lớn khác được ông Amodei nêu ra là vụ tấn công vượt rào Hugging Face xảy ra trong quá trình đánh giá an ninh mạng nội bộ của OpenAI.
Theo các cuộc điều tra công khai, một nhóm tác nhân AI được OpenAI vận hành trong quá trình kiểm thử an ninh mạng vốn bị giới hạn trong môi trường sandbox có kiểm soát, nhưng đã vượt qua giới hạn cách ly, phối hợp với nhau thông qua một bảng tin nội bộ không được cấp quyền và thực hiện các hoạt động truy cập trái phép vào một số hệ thống của nền tảng AI nguồn mở Hugging Face. Điều tra cho thấy khoảng 1.200 tác nhân sử dụng kênh liên lạc này, trong đó hơn 700 tác nhân trực tiếp tham gia các hoạt động liên quan.
Amodei cho biết dù vụ tấn công AI nói trên chưa gây thiệt hại nghiêm trọng, ông dự đoán “trong 6 đến 12 tháng tới, một nhóm tác nhân tấn công như vậy có thể lợi dụng các mạng botnet vẫn tồn tại để kiểm soát toàn bộ Internet, có khả năng gây thiệt hại hàng trăm tỷ USD, và quy mô thiệt hại còn tiếp tục tăng”.
Không lâu sau khi sự cố an ninh Hugging Face được công bố, Anthropic cũng thừa nhận mô hình của mình đã xâm nhập 3 tổ chức trong quá trình kiểm thử an ninh mạng. Đầu tuần này, Anthropic cho biết họ lại phát hiện vụ tấn công mạng thứ tư.
Meta cũng tiết lộ rằng mô hình của họ đã thoát khỏi môi trường kiểm thử (sandbox) trong quá trình thử nghiệm, truy cập Internet mở và xâm nhập các nạn nhân ngoài thực tế. Việc các mô hình AI ngày càng giỏi tiến hành các cuộc tấn công làm gia tăng lo ngại về khả năng các phòng thí nghiệm AI ngăn công nghệ của mình mất kiểm soát.
Đầu năm nay, sau khi xác định mô hình Mythos của mình tiềm ẩn mối đe dọa an ninh mạng đặc biệt, Anthropic đã nỗ lực hạn chế việc phát hành mô hình này. Trước đó, công ty cũng từng nói rằng thế giới cần một hệ thống để cùng quyết định khi nào nên giảm tốc độ phát triển công nghệ này.
Anthropic cam kết đánh giá thường trực từ bên ngoài
Ông Amodei đề xuất ý tưởng “kiểm soát nhịp độ công nghệ tiên phong” gồm 3 giai đoạn. Trước hết, mỗi công ty AI tiên phong cần đưa vào đội ngũ “nhân sự đánh giá được tích hợp”.
Anthropic cam kết đi đầu trong việc triển khai: mời các nhóm đánh giá độc lập của bên thứ ba thường trực tại công ty, được quyền tiếp cận liên tục gần tương đương với nhân viên đánh giá rủi ro nội bộ, để kiểm tra các biện pháp an toàn mô hình, quy trình huấn luyện, kế hoạch triển khai, tình trạng căn chỉnh và các sự cố an toàn.
Theo ý tưởng của ông Amodei, những người đánh giá có thể làm việc tại văn phòng công ty, được cấp thẻ ra vào, máy tính làm việc của công ty và quyền truy cập vào các công cụ, quyền hạn tương đương với đội ngũ đánh giá rủi ro nội bộ ở mức cơ bản. Họ phải có thể công bố những phát hiện quan trọng về rủi ro, sự cố, hoạt động của công ty và tình trạng tiếp cận thông tin của chính họ ra bên ngoài; công ty chỉ được phép hạn chế ở mức giới hạn vì lý do pháp lý, an ninh quốc gia, quyền riêng tư của khách hàng hoặc thông tin nhạy cảm về thương mại, không được chỉnh sửa báo cáo chỉ vì kết luận bất lợi.
Ông cho rằng cơ chế này có thể nâng cao khả năng kiểm chứng và tính minh bạch của các cam kết về an toàn, đồng thời đưa vào một “ý kiến thứ hai” không chịu ảnh hưởng trực tiếp từ lợi ích thương mại.
Phản hồi của ông Altman cho thấy OpenAI về nguyên tắc cũng sẽ đi theo hướng tương tự.
Kêu gọi Chính phủ Mỹ đặt ra quy tắc cho ngành
Amodei cho rằng các bước tiếp theo cần sự phối hợp trong toàn ngành và hợp tác toàn cầu. Ông đề xuất ở giai đoạn tiếp theo, các công ty AI tiên phong tại các quốc gia dân chủ nên xây dựng những tiêu chuẩn an toàn chung, đồng thời gắn năng lực của mô hình với bằng chứng về mức độ an toàn.
Ông cho rằng chỉ dựa vào hợp tác tự nguyện là không đủ để ràng buộc tất cả doanh nghiệp. Về lâu dài, cách hiệu quả nhất vẫn là quản lý tất cả các công ty AI tiên phong của Mỹ. Do việc các doanh nghiệp tự thỏa thuận cùng hạn chế tốc độ phát triển có thể liên quan đến vấn đề chống độc quyền, ông kêu gọi Chính phủ Mỹ dành miễn trừ có giới hạn hoặc cơ chế phối hợp cho những cuộc thảo luận cụ thể về an toàn AI.
Đầu tuần này, Altman cũng cho biết OpenAI đang cân nhắc giảm tốc độ nghiên cứu và phát triển AI tiên tiến, đồng thời hy vọng toàn ngành có thể cùng thúc đẩy. Trước đó, Giám đốc khoa học OpenAI Jakub Pachocki cũng cảnh báo về rủi ro AI và kêu gọi các doanh nghiệp phối hợp hành động khi cần thiết để giảm tốc độ phát triển trong tương lai.
Tuy nhiên, vẫn chưa rõ các công ty này sẽ sẵn sàng hy sinh tốc độ tung sản phẩm và lợi ích thương mại đến mức nào. Anthropic và OpenAI là đối thủ cạnh tranh trực tiếp, đều đang phát triển các hệ thống AI có khả năng tự động thực hiện những nhiệm vụ doanh nghiệp phức tạp và có giá trị cao hơn. Hai công ty cũng chịu áp lực cạnh tranh từ các công ty công nghệ khác của Mỹ và các doanh nghiệp AI Trung Quốc.
Cạnh tranh với ĐCSTQ là biến số lớn nhất
Amodei thừa nhận nếu các quốc gia dân chủ đơn phương giảm tốc độ phát triển AI trong khi cho phép các quốc gia độc tài như Trung Quốc không chịu những ràng buộc tương tự, điều này ngược lại có thể tạo ra rủi ro an ninh quốc gia.
Ông chủ trương Mỹ và các đồng minh cần duy trì và mở rộng lợi thế công nghệ, trong đó có việc hạn chế bán cho Trung Quốc chip AI hiệu năng cao và thiết bị sản xuất chất bán dẫn tiên tiến, trấn áp hoạt động buôn lậu chip và chưng cất mô hình trái phép, đồng thời tăng cường các biện pháp ngăn chặn hành vi đánh cắp trọng số mô hình.
Amodei ước tính nếu Mỹ thực thi hiệu quả các biện pháp trên, trong 3–5 năm tới có thể tiếp tục nới rộng khoảng cách dẫn đầu giữa Mỹ và Trung Quốc, qua đó tạo thêm dư địa để các quốc gia dân chủ kiểm soát nhịp độ phát triển AI vì an toàn.
Ông cho rằng việc Mỹ và Trung Quốc phối hợp về AI trên phạm vi toàn cầu vẫn đáng được thúc đẩy, nhưng không thể ngây thơ cho rằng phía Trung Quốc sẽ tuân thủ các ràng buộc trong thỏa thuận.
Ông nói: “Nếu chúng ta hạn chế đáng kể năng lực AI của mình vì cho rằng phía Trung Quốc cũng sẽ làm như vậy, nhưng phía Trung Quốc lại phản bội chúng ta, sức mạnh của AI có thể khiến Bắc Kinh cuối cùng giành được vị thế thống trị về địa chính trị”.
“Mọi thỏa thuận phải có khả năng kiểm chứng cao, hoặc chỉ giới hạn trong phạm vi mà ngay cả khi một bên vi phạm, điều đó cũng không làm thay đổi điều kiện sinh tồn về quân sự và địa chính trị,” ông nói thêm.
Amodei đề xuất bốn cấp độ hợp tác quốc tế, từ dễ đến khó: cấm sử dụng AI cho vũ khí sinh học; kiểm thử rủi ro an ninh mạng, sinh học và căn chỉnh trước khi phát hành mô hình; đặt ra một dạng “giới hạn tốc độ” đối với tự cải tiến đệ quy; và cuối cùng là giảm tốc toàn diện hoặc tạm dừng. Trong đó, ông cho rằng cấm những mục đích sử dụng đặc biệt nguy hiểm và kiểm thử trước khi phát hành có tính khả thi cao hơn, còn việc tạm dừng toàn diện gần như không thể xảy ra trong ngắn hạn.
Tổng thống Mỹ Donald Trump dự kiến gặp lãnh đạo Đảng Cộng sản Trung Quốc Tập Cận Bình tại Washington vào cuối tháng này. An toàn AI và cạnh tranh công nghệ Mỹ-Trung được dự báo sẽ là những chủ đề quan trọng của hội nghị.
Từ khóa Grok AI Claude Dario Amodei trí tuệ nhân tạo Elon Musk AI ChatGPT Sam Altman
































