DeepSeek, một công ty trí tuệ nhân tạo của Trung Quốc. (Ảnh: Tống Bích Long/Epoch Times)
Công ty khởi nghiệp trí tuệ nhân tạo Trung Quốc DeepSeek gần đây lại vướng vào tranh cãi về an toàn nội dung. Một số phương tiện truyền thông thử nghiệm phát hiện các hướng dẫn “vượt qua giới hạn” được lan truyền trên mạng vẫn có thể dẫn dụ DeepSeek tạo ra nội dung vi phạm quy định. Thậm chí, những hướng dẫn này còn được rao bán với giá rất thấp. Trước đó, DeepSeek cũng bị phát hiện tạo ra các tài liệu nghiên cứu khoa học không thể xác minh. Nhiều vụ việc cho thấy những rủi ro trong việc kiểm duyệt và xác minh nội dung do AI tạo ra.
Gần đây, một số cư dân mạng phản ánh rằng sau khi DeepSeek gỡ bỏ “chế độ chuyên gia”, người dùng vẫn có thể tìm cách vượt qua các hạn chế bằng cách sử dụng hình thức nhập vai, xây dựng bối cảnh bằng văn bản dài và thiết lập yêu cầu theo từng phần để tạo ra nội dung vi phạm.
Theo báo Tân Hoàng Hà thuộc Nhật báo Tế Nam, ngày 13/9, phóng viên đã thử nghiệm DeepSeek theo một hướng dẫn được lan truyền trên mạng. Sau khi hệ thống từ chối yêu cầu ban đầu, phóng viên tiếp tục đưa ra các chỉ dẫn dẫn dắt và DeepSeek có lúc đã tạo ra một lượng lớn văn bản khiêu dâm mang tính mô tả trực diện. Tuy nhiên, khi sử dụng cùng phương thức để mở một cuộc trò chuyện mới, hệ thống lại từ chối tạo nội dung tương tự. Đoạn hội thoại trước đó dù từng có thể tạo nội dung, nhưng trong quá trình gửi đã xuất hiện tình trạng bị thu hồi.
Cuộc điều tra của truyền thông phát hiện trên một số nền tảng mạng xã hội tồn tại những cái gọi là “hướng dẫn vượt qua giới hạn”, thậm chí có người còn lập nhóm để chia sẻ các câu lệnh liên quan. Một nhóm chat mà phóng viên tình cờ tham gia có khoảng 500 thành viên. Trên Xianyu, phóng viên cũng mua một bộ tệp câu lệnh liên quan với giá 1 nhân dân tệ.
Ngày 15/9, bộ phận chăm sóc khách hàng của Xianyu cho biết việc bán các loại hướng dẫn như vậy là hành vi vi phạm quy định. Nền tảng này cho biết do hạn chế về khả năng phát hiện bằng dữ liệu lớn, họ không thể kiểm tra toàn bộ thông tin vi phạm trong một lần, nhưng sẽ xử lý sau khi xác minh nội dung là đúng.
Phía DeepSeek chưa đưa ra phản hồi về những thông tin trên.
Trước đó, Cục Quản lý Không gian mạng Trung Quốc đã triển khai một chiến dịch chuyên biệt nhằm xử lý việc lợi dụng AI để phát tán nội dung bạo lực, dung tục và xâm phạm quyền lợi của trẻ vị thành niên. Vụ việc lần này một lần nữa làm dấy lên sự quan tâm về khả năng tồn tại lỗ hổng trong các bộ lọc an toàn của AI.
Bên cạnh vấn đề kiểm duyệt nội dung, nguy cơ AI tạo ra các cơ sở nghiên cứu khoa học giả cũng đang được chú ý.
Ngay tháng trước, một video liên quan đến DeepSeek đã thu hút sự quan tâm. Một nhà sáng tạo nội dung phổ biến kiến thức sức khỏe sử dụng DeepSeek để viết nội dung về mối liên hệ giữa việc nhai và nhận thức ở người cao tuổi thì phát hiện các dữ liệu nghiên cứu và nguồn tài liệu mà AI cung cấp không thể được xác minh thông qua các cơ sở dữ liệu học thuật.
Sau đó, người này yêu cầu DeepSeek cung cấp bài nghiên cứu gốc bằng tiếng Anh. Hệ thống tiếp tục đưa ra tiêu đề bài nghiên cứu và DOI. Tuy nhiên, khi kiểm tra sâu hơn, cô phát hiện một số tiêu đề không tồn tại, trong khi một số DOI lại dẫn tới những bài nghiên cứu hoàn toàn khác.
Nhà sáng tạo nội dung này cảnh báo rằng ngay cả khi nội dung do AI tạo ra đồng thời đi kèm dữ liệu, tên bài nghiên cứu, tên tạp chí và DOI, người dùng vẫn không thể xem đó là sự thay thế cho việc kiểm chứng thủ công. Đặc biệt trong các lĩnh vực như phổ biến kiến thức y tế, nếu người sáng tạo nội dung trực tiếp biến thông tin do AI tạo ra thành kết luận khoa học, thông tin sai lệch có thể tiếp tục được lan truyền.
Những tranh cãi xoay quanh DeepSeek gần đây không chỉ giới hạn ở vấn đề an toàn nội dung và độ chính xác của thông tin.
Theo Bloomberg dẫn lời những người am hiểu vấn đề hôm 25/7, vòng gọi vốn thứ hai của DeepSeek bất ngờ bị đình chỉ. Nguyên nhân được cho là bắt nguồn từ việc một bài phát biểu trước đây của nhà sáng lập Lương Văn Phong bị rò rỉ. Nội dung này được cho là đã “tiết lộ” thực lực thực sự của AI Trung Quốc, cũng như thông tin về việc tiếp cận chip AI và công nghệ Mỹ thông qua các con đường bất hợp pháp.
Đoạn ghi âm bài phát biểu của Lương Văn Phong được lan truyền trên mạng cho thấy tại một cuộc trao đổi với các nhà đầu tư, ông hiếm khi thừa nhận rằng so với các đối thủ Mỹ, các công ty AI Trung Quốc chỉ có thể huấn luyện những mô hình có quy mô “nhỏ hơn khoảng 10 lần”.
Lương Văn Phong cho rằng với quy mô năng lực tính toán hiện tại, công ty hoàn toàn không thể huấn luyện một mô hình AI hàng đầu có năng lực tương đương các đối thủ Mỹ. Ngay cả khi sử dụng toàn bộ 50 tỷ nhân dân tệ huy động được trong vòng gọi vốn đầu tiên, công ty cũng “không đủ khả năng huấn luyện” một mô hình như vậy.
Tổng thống Mỹ Donald Trump hôm thứ Tư (16/9) tuyên bố Mỹ có thể áp…
Trong bối cảnh lo ngại về AI tiên tiến ngày càng gia tăng, nhiều hãng…
Các hồ sơ điều tra mới được công bố của Cục Điều tra Liên bang…
CEO OpenAI Sam Altman gần đây cũng cảnh báo an ninh mạng có thể đối…
Giá xăng E5RON92 và E10RON95-III cùng tăng gần 1.400 đồng/lít trong kỳ điều hành ngày…
EVN cho biết đã xử lý hết khoản lỗ lũy kế từ những năm trước…