(Ảnh minh họa: ChatGPT)
Ngày 17/7, công ty khởi nghiệp AI Trung Quốc Moonshot AI ra mắt mô hình ngôn ngữ lớn thế hệ mới Kimi K3. Tuy nhiên, trong một số bài kiểm tra của người dùng, mô hình này được phát hiện trả lời: “Tôi là Claude, không phải Kimi”, làm dấy lên nghi vấn liệu Kimi K3 có sử dụng dữ liệu đầu ra từ các mô hình AI của Mỹ để tiến hành “chưng cất tri thức” trong quá trình huấn luyện hay không. Vụ việc cũng một lần nữa thu hút sự chú ý đến tranh cãi về quyền sở hữu trí tuệ trong cuộc cạnh tranh AI Mỹ–Trung.
Theo hình ảnh các bài kiểm tra được lan truyền trên mạng xã hội, một người dùng hỏi Kimi K3: “Này Kimi, dạo này thế nào?”. Tuy nhiên, mô hình lại trả lời: “Tôi là Claude, không phải Kimi”. Nội dung này nhanh chóng thu hút sự chú ý trên X và các nền tảng mạng xã hội khác.
Tài khoản X “CEO Briefing” phân tích rằng sự cố “nhầm lẫn danh tính” lần này của Kimi K3 một lần nữa làm dấy lên nghi vấn trên thị trường về việc liệu các mô hình AI Trung Quốc có phụ thuộc vào các mô hình đóng của Mỹ để huấn luyện hay không.
Theo tài khoản này, ngay cả khi các doanh nghiệp Trung Quốc thu hẹp khoảng cách công nghệ thông qua chưng cất tri thức, họ vẫn khó sao chép được hệ sinh thái kinh doanh của các doanh nghiệp AI Mỹ. Tính tuân thủ của dữ liệu mô hình, mức độ tin cậy của doanh nghiệp, quản trị dữ liệu và trách nhiệm pháp lý mới là những yếu tố then chốt đối với các doanh nghiệp lớn khi sử dụng dịch vụ AI.
Công nghệ “chưng cất” AI là phương pháp trong đó nhà phát triển trước tiên đặt một lượng lớn câu hỏi cho một mô hình AI lớn có năng lực mạnh, chẳng hạn Claude hoặc ChatGPT, sau đó thu thập các câu trả lời của mô hình này để dùng huấn luyện mô hình của mình.
Có thể hình dung như một học sinh không học qua sách giáo khoa mà liên tục lấy đáp án của học sinh giỏi để học, thậm chí chép lại đáp án của người giỏi và luyện tập nhiều lần. Theo thời gian, dù không học đầy đủ nội dung trong sách giáo khoa, học sinh đó vẫn có thể đạt thành tích gần với học sinh giỏi.
Đáng chú ý, “chưng cất” là một phương pháp huấn luyện rất phổ biến và hiệu quả trong lĩnh vực AI. Tuy nhiên, nếu không được cấp phép mà sử dụng trên quy mô lớn dữ liệu đầu ra từ các mô hình thương mại của công ty khác để huấn luyện sản phẩm AI của mình, hành vi này có thể liên quan đến việc vi phạm điều khoản dịch vụ (TOS), thậm chí làm dấy lên tranh chấp về quyền sở hữu trí tuệ.
Trong khoảng một năm qua, các công ty AI Mỹ liên tục cáo buộc các công ty Trung Quốc nâng cao năng lực mô hình của mình thông qua phương thức chưng cất không được cấp phép.
Tháng Một năm nay, OpenAI cho biết họ đã nắm được các dấu hiệu cho thấy công ty AI Trung Quốc DeepSeek có thể đã sử dụng dữ liệu đầu ra từ các mô hình của OpenAI để huấn luyện mô hình riêng.
Tháng Sáu năm nay, Anthropic đệ trình tài liệu lên Thượng viện Mỹ, cáo buộc Tập đoàn Alibaba đã gửi khoảng 28,8 triệu yêu cầu tới dịch vụ Claude trong vòng 2 tháng, bị nghi ngờ tiến hành tấn công chưng cất thông qua hoạt động truy cập tự động quy mô lớn. Anthropic cho biết đây là vụ việc có quy mô lớn nhất mà công ty từng phát hiện liên quan đến hành vi này.
Một quan chức phụ trách chính sách AI của Nhà Trắng cũng từng cho biết một số doanh nghiệp Trung Quốc sử dụng số lượng lớn tài khoản đại diện và kỹ thuật “jailbreak” để vượt qua các hạn chế an toàn, trích xuất nội dung đầu ra của các mô hình tiên tiến của Mỹ làm dữ liệu huấn luyện.
Việc Kimi K3 lần này tự nhận “Tôi là Claude” khiến tranh cãi về chưng cất một lần nữa trở thành tâm điểm dư luận.
Nhiều nhà nghiên cứu và nhà phát triển AI đã thảo luận về việc liệu điều này có cho thấy Kimi K3 đã hấp thụ nội dung đầu ra của mô hình Claude trong quá trình huấn luyện, từ đó xuất hiện hiện tượng được gọi là “rò rỉ danh tính” hay không.
Giới nghiên cứu an toàn AI nhìn chung cho rằng trong tương lai, việc Kimi K3 có tiếp tục xuất hiện “rò rỉ danh tính” hoặc “nhầm lẫn danh tính” hay không sẽ là một chỉ dấu quan trọng để quan sát phương thức huấn luyện mô hình.
Nếu mô hình thường xuyên tự nhận là Claude, thậm chí có phong cách trả lời, cách dùng từ đặc biệt và mô thức sai sót tương đồng cao với Claude, kết hợp với các bằng chứng kỹ thuật khác, những nghi vấn về việc chưng cất có thể sẽ gia tăng.
Tuy nhiên, cho đến nay, Moonshot AI vẫn chưa phản hồi những nghi vấn liên quan. Cũng chưa có bằng chứng kỹ thuật công khai nào chứng minh Kimi K3 đã sử dụng Claude để tiến hành huấn luyện bằng phương pháp chưng cất. Vì vậy, các thảo luận hiện vẫn chỉ dừng ở mức nghi vấn trên thị trường và suy đoán kỹ thuật.
Mặt khác, theo giới thiệu của Moonshot AI, Kimi K3 hỗ trợ khả năng hiểu hình ảnh, có cửa sổ ngữ cảnh lên tới 1 triệu token và được tối ưu hóa cho các tình huống nhiệm vụ phức tạp nhằm nâng cao năng lực xử lý những nhiệm vụ này.
Kết quả thử nghiệm của nhiều nhóm đánh giá cho thấy Kimi K3 có thể cạnh tranh với các mô hình AI hàng đầu của Mỹ. Tuy nhiên, trong một số bài đánh giá tổng hợp, mô hình này vẫn đứng sau Fable 5 của Anthropic.
Về việc Kimi K3 có thể thay đổi cục diện cạnh tranh AI toàn cầu hay không, tổ chức nghiên cứu đầu tư độc lập Morningstar phân tích rằng nếu Kimi K3 tiếp tục cải thiện trong việc triển khai tại doanh nghiệp, hệ sinh thái nhà phát triển và tỷ lệ được sử dụng trên quốc tế, điều này có thể đẩy nhanh xu hướng giảm giá mô hình AI và xu hướng mã nguồn mở, tiếp tục thu hẹp lợi thế thương mại của các mô hình đóng như OpenAI và Anthropic.
Ngược lại, nếu hiệu quả ứng dụng thực tế không đạt được như các bài kiểm tra chuẩn, cơn sốt này có thể giống như nhận định của một số nhà phân tích: một câu chuyện “DeepSeek 2.0” do tâm lý thị trường thúc đẩy, thay vì một sự thay đổi căn bản trong cục diện ngành.
Cuộc bức hại của ĐCSTQ đối với Pháp Luân Công, một nhóm tín ngưỡng hòa…
Theo ước tính của Bộ Tài chính, việc giảm các khoản thanh toán sai quy…
Trong những tháng gần đây, lượng dầu thô Iran mà Trung Quốc mua từ Iran…
Bộ trưởng Tài chính Mỹ Scott Bessent cho biết chính quyền Tổng thống Trump sẽ…
Quân đội Philippines cáo buộc lực lượng Hải cảnh Trung Quốc áp sát tàu của…
Ảnh vệ tinh cho thấy công trình ngầm vẫn tiếp tục được mở rộng