Anthropic: Claude chiếm 26% khối lượng công việc R&D AI nội bộ
- Vương Quân Nghi
- •
Trí tuệ nhân tạo (AI) đang ngày càng tham gia sâu hơn vào quá trình nghiên cứu và phát triển (R&D) các công nghệ AI thế hệ tiếp theo. Dữ liệu mới nhất của công ty AI Mỹ Anthropic cho thấy, mức độ tham gia của mô hình AI Claude vào hoạt động R&D AI nội bộ của công ty đang tăng nhanh, trong đó sự hợp tác giữa con người và AI đang trở thành một phương thức quan trọng trong công tác R&D.
Hôm thứ Năm (17/9), Anthropic cho biết, tính đến tháng 8/2026, 26% công việc R&D AI của công ty đã đạt mức độ “chủ đạo” với sự tham gia của Claude. Dữ liệu liên quan sử dụng tiêu chuẩn về mức độ tự động hóa do tổ chức nghiên cứu AI Epoch AI xây dựng. Trong đó, “chủ đạo” có nghĩa là AI có thể thực hiện phần lớn quy trình của một công việc dựa trên các chỉ dẫn ở cấp độ cao, trong khi con người chịu trách nhiệm giám sát.
Tỷ lệ này đã tăng mạnh so với mức chưa đến 1% vào tháng 2/2026. Tuy nhiên, Anthropic nhấn mạnh rằng hiện tại Claude vẫn chưa có khả năng hoạt động hoàn toàn tự chủ trong bất kỳ công việc R&D AI nào được đo lường. Trong cùng thời kỳ, hơn 90% công việc R&D AI đã đạt mức “AI hợp tác” hoặc cao hơn, nghĩa là AI có thể thực hiện phần lớn công việc dưới sự hướng dẫn chặt chẽ của con người.
Anthropic cho biết, nếu xu hướng hiện tại tiếp diễn, tỷ lệ công việc R&D AI đạt mức độ “chủ đạo” của Claude có thể tăng lên khoảng 80% vào cuối năm 2026.
Khoảng 30.000 tác nhân AI tham gia R&D
Ngoài việc đánh giá mức độ AI tham gia vào hoạt động R&D, Anthropic lần đầu tiên công bố dữ liệu về tình hình sử dụng các tác nhân AI nội bộ. Công ty cho biết, trong tháng 8/2026, nền tảng nội bộ được sử dụng rộng rãi nhất của Anthropic có trung bình khoảng 30.000 tác nhân AI cùng lúc thực hiện các công việc nghiên cứu và kỹ thuật.
Anthropic cho biết mọi hoạt động của các tác nhân AI này đều được giám sát trực tuyến và kiểm tra bởi hệ thống. Sau khi phân tích hơn 1 tỷ quyết định trong tháng 8, công ty phát hiện khoảng 0,002% số quyết định bị hệ thống chặn, tương đương khoảng 1/47.000 quyết định. Những hoạt động bị chặn cũng sẽ được con người kiểm tra lại trong vòng 1 tuần.
Anthropic đồng thời công bố tỷ lệ năng lực tính toán được sử dụng cho nghiên cứu an toàn AI. Dữ liệu trong 1 tuần của tháng 7/2026 cho thấy khoảng 6% năng lực tính toán mà công ty sử dụng cho R&D AI được dành cho nghiên cứu an toàn; trong số các công việc R&D có AI tham gia, tỷ lệ này là khoảng 12%. Anthropic chỉ ra rằng những công việc tính toán vừa góp phần nâng cao năng lực AI vừa góp phần nâng cao tính an toàn cũng được tính vào R&D AI. Do đó, các tỷ lệ trên được xem là những ước tính thận trọng.
AI tự chủ trong R&D làm dấy lên lo ngại về an toàn
Anthropic cho biết, một trong những mục đích của việc công bố các chỉ số này là giúp bên ngoài hiểu rõ hơn về tốc độ phát triển công nghệ và mức độ AI tham gia vào hoạt động R&D bên trong các phòng thí nghiệm AI tiên phong.
Công ty cho biết hiện chưa có một tiêu chuẩn thống nhất để đo lường giữa các công ty AI khác nhau, trong khi việc để chính các mô hình AI đánh giá những công việc này cũng có thể dẫn đến sai lệch. Do đó, trong tương lai, dữ liệu liên quan có thể được bên thứ ba xác minh độc lập, qua đó giúp tăng khả năng so sánh dữ liệu giữa các công ty.
Việc công bố này diễn ra trong bối cảnh sự quan tâm của ngành đối với tốc độ gia tăng nhanh chóng của năng lực tự chủ của AI đang ngày càng tăng. Các nhà nghiên cứu trước đó cảnh báo rằng khi mức độ tự chủ của các tác nhân AI tăng lên, hành vi của chúng có thể lệch khỏi các mục tiêu do nhà phát triển đặt ra, đồng thời làm gia tăng khó khăn trong việc giám sát và kiểm soát.
Giám đốc điều hành của Anthropic Dario Amodei gần đây đã đăng một bài viết trên trang web cá nhân, kêu gọi các doanh nghiệp AI giảm tốc độ nâng cao năng lực của mô hình, nhằm có thêm thời gian cho các biện pháp an toàn.
Ngày 16/9, đối thủ của Anthropic là OpenAI cũng tuyên bố thiết lập một cơ chế báo cáo mới về “hành vi căn chỉnh sai lệch của mô hình” (misalignment), nhằm theo dõi, điều tra và công khai những hành vi bất ngờ hoặc đáng lo ngại của mô hình, đồng thời lần đầu tiên công bố 6 trường hợp liên quan.
Vương Quân Nghi, theo The Epoch Times
Từ khóa AI Công nghệ AI Anthropic Claude an toàn AI AI tự chủ tác nhân AI R&D

































