Blogger sức khỏe kiểm chứng DeepSeek: Dữ liệu khoa học do AI tự bịa
- Lý Tịnh
- •
Trong lúc công ty khởi nghiệp trí tuệ nhân tạo (AI) Trung Quốc DeepSeek đang tiến hành vòng gọi vốn thứ hai, một video liên quan đến việc DeepSeek bịa đặt tài liệu nghiên cứu đã thu hút sự chú ý trên mạng. Một nhà sáng tạo nội dung phổ biến kiến thức về sức khỏe phát hiện, khi sử dụng DeepSeek để viết nội dung khoa học sức khỏe, các tiêu đề bài nghiên cứu, số liệu, thậm chí cả mã DOI do AI tạo ra đều trông có vẻ đầy đủ và chi tiết, nhưng sau khi lần lượt kiểm chứng, không tài liệu nào có thể đối chiếu với nghiên cứu có thật. Điều này cho thấy nguy cơ AI bịa đặt thông tin khi tạo nội dung chuyên môn.
Viết nội dung phổ biến kiến thức, DeepSeek đưa ra những bài nghiên cứu tự bịa đặt
Gần đây, một video liên quan đến DeepSeek đã gây tranh luận trên mạng xã hội X. Trong video, một blogger lâu năm chuyên sáng tạo nội dung phổ biến kiến thức về sức khỏe sử dụng DeepSeek để viết nội dung về mối liên hệ giữa việc nhai và khả năng nhận thức ở người cao tuổi, nhưng bất ngờ phát hiện các căn cứ khoa học mà AI cung cấp có vấn đề nghiêm trọng.
Yêu cầu mà cô nhập vào là: “Hãy giúp tôi viết một nội dung TikTok về việc nhai có thể giúp người cao tuổi cải thiện nhận thức não bộ, làm chậm quá trình lão hóa não, đồng thời nhấn mạnh rằng nội dung phải dựa trên dữ liệu khoa học”.
Sau đó, DeepSeek tạo ra một nội dung có kèm các căn cứ khoa học. Một số liệu đặc biệt khiến cô chú ý là: “Người cao tuổi nhai từ 30 lần trở lên mỗi ngày có nguy cơ suy giảm nhận thức thấp hơn 42%”, đồng thời cung cấp nguồn tài liệu được cho là căn cứ.
“Lúc đó khi nhìn thấy bằng chứng khoa học này, tôi đã đọc rất nhiều tài liệu nghiên cứu nhưng dường như không nhớ mình từng thấy số liệu như vậy.”
Khi đó, cô không lập tức nghi ngờ AI, mà cho rằng có thể mình đã bỏ sót một nghiên cứu liên quan. Vì vậy, cô bắt đầu tìm kiếm trong nhiều cơ sở dữ liệu học thuật, dựa trên các từ khóa, tên tạp chí và những thông tin khác.
Kết quả là cô không tìm thấy nghiên cứu tương ứng.
Sau đó, cô tiếp tục hỏi DeepSeek về “bằng chứng khoa học cho thấy nhai giúp cải thiện nhận thức”. DeepSeek lại tạo ra một tài liệu dài hơn, liệt kê nhiều căn cứ được cho là nghiên cứu khoa học, đồng thời còn tổng kết rằng so với việc tập aerobic 2 lần mỗi tuần, nhai có hiệu quả tốt hơn trong việc phòng ngừa chứng mất trí nhớ.
“Tôi cũng chưa từng thấy bằng chứng khoa học này,” cô nói.
Truy vấn bản tiếng Anh, DeepSeek thừa nhận những phát biểu trước đó có vấn đề
Để xác nhận thêm nguồn tài liệu, blogger này sao chép những nội dung liên quan mà DeepSeek đưa ra trước đó và yêu cầu AI cung cấp tên bài nghiên cứu gốc bằng tiếng Anh.
Lần này, DeepSeek trước tiên thừa nhận những phát biểu trước đó có vấn đề, đồng thời cho biết không tìm thấy những bài nghiên cứu liên quan mà nó đã đề cập trước đó. Sau đó, DeepSeek lại đưa ra 3 nghiên cứu được cho là “có thẩm quyền hơn”, đồng thời cung cấp tên bài nghiên cứu và mã DOI.
DOI là mã nhận dạng toàn cầu duy nhất và có giá trị lâu dài dành cho các tài nguyên số như bài nghiên cứu, dữ liệu nghiên cứu…, do Tổ chức Tiêu chuẩn hóa Quốc tế (ISO) xây dựng, giống như “chứng minh thư” của tài liệu trên mạng.
Sau đó, cô lần lượt tìm kiếm theo tiêu đề và mã DOI. Kết quả không tài liệu nào có thể đối chiếu được.
Bài nghiên cứu thứ nhất hoàn toàn không tồn tại khi tìm kiếm theo tiêu đề. Sau đó, cô tìm theo mã DOI mà DeepSeek cung cấp. Mặc dù có một bài nghiên cứu xuất hiện, nhưng tiêu đề của bài này hoàn toàn khác với tiêu đề DeepSeek đưa ra.
Bài nghiên cứu thứ hai cũng không thể tìm thấy bằng tiêu đề, trong khi mã DOI được cung cấp thậm chí không tồn tại.
Bài nghiên cứu thứ ba cũng xảy ra tình trạng tương tự: không thể tìm thấy bài nghiên cứu theo tiêu đề, còn mã DOI lại dẫn đến một bài viết hoàn toàn khác.
Hàng loạt lần kiểm chứng này khiến cô xác nhận rằng các tài liệu và bằng chứng nghiên cứu liên quan mà DeepSeek cung cấp trước đó về cơ bản là do AI bịa ra.
DeepSeek bịa đặt nhưng “đóng gói” hoàn hảo, blogger cảnh báo không nên tin mù quáng
Sau khi xác nhận vấn đề DeepSeek bịa đặt tài liệu nghiên cứu, blogger này tiếp tục suy ngẫm về những rủi ro sâu xa hơn mà nội dung do AI tạo ra có thể mang lại.
Theo cô, vấn đề trong nội dung do DeepSeek tạo ra không chỉ nằm ở việc các bài nghiên cứu có tồn tại hay không, mà còn có thể thể hiện ở việc phóng đại hoặc bóp méo kết luận nghiên cứu.
Theo cô, vấn đề dễ xảy ra nhất với DeepSeek chính là khả năng đóng gói một kết luận vốn không đáng tin cậy thành một nội dung hoàn chỉnh đến mức gần như hoàn hảo: có số liệu, có tên bài nghiên cứu, có tên tạp chí, có DOI, thậm chí còn có cả một hệ thống giải thích trông rất logic.
“DeepSeek vậy mà lại bịa ra một dữ liệu khoa học cực kỳ hoàn hảo, mà dữ liệu này đối với tôi lại có thể đúng là điều tôi thích, điều tôi cần.”
Cô thừa nhận rằng nếu không phải bản thân đã có nhiều năm làm công việc kiểm tra tài liệu nghiên cứu, rất có thể cô cũng sẽ bị những dữ liệu giả “hoàn hảo” như vậy thuyết phục.
AI được sử dụng để sản xuất hàng loạt nội dung phổ biến kiến thức sức khỏe, nguy cơ thông tin giả càng đáng cảnh giác
Điều khiến blogger này đặc biệt lo ngại là hiện nay nội dung về “sức khỏe toàn diện” đang được quan tâm, và không ít blogger đang sử dụng AI để nhanh chóng sản xuất văn bản, video ngắn và nội dung phổ biến kiến thức.
Trong cuộc cạnh tranh về lượng truy cập, nếu người sáng tạo nội dung trực tiếp coi những nội dung do AI tạo ra là tài liệu khoa học đã được kiểm chứng, thông tin sai lệch có thể tiếp tục lan truyền.
Cô cho rằng AI có thể được sử dụng như công cụ hỗ trợ tìm kiếm, tổng hợp và viết lách, nhưng không thể thay thế việc con người kiểm tra tài liệu gốc.
Blogger này cũng nhắc nhở rằng việc phổ biến kiến thức khoa học cần tránh quan niệm sai lầm “một bài nghiên cứu quyết định kết luận”.
Cô nói: “Mỗi lần nói về một chủ đề, tôi không chỉ đọc một bài nghiên cứu, mà phải xem xét gần như toàn bộ các nghiên cứu trong lĩnh vực đó”.
Đối với những nhận xét trên của blogger, một cư dân mạng nói: “Đây không phải là cố tình làm giả, mà là kết quả tạo sinh của phần mềm AI Trung Quốc thời kỳ đầu, được tổng hợp dựa trên ‘một lượng lớn tài liệu trong quá khứ’, chứ không phân tích đối với từng tài liệu cụ thể. AI phương Tây trong vài năm gần đây dần dần có thể tạo ra tài liệu nghiên cứu chính xác”.
Một cư dân mạng khác cho biết: “Ngày càng có nhiều người vừa nhìn thấy một sự việc là lập tức hỏi AI xem có thật hay không. Ngày càng có nhiều người khi thảo luận vấn đề lại coi kết luận do AI đưa ra là chân lý, là luận cứ để chứng minh quan điểm của mình. Sau này nếu gặp những người không có đầu óc hoặc có đầu óc mà không chịu dùng, tôi sẽ trực tiếp gửi video này cho họ xem, để họ thấy AI có thể ‘bịa đặt và lừa người một cách trơn tru’ như thế nào, khỏi mất thời gian”.
Đáng chú ý, theo một bài báo của New York Post ngày 19/8, một báo cáo nghiên cứu có tiêu đề “Hình phạt học tập do AI tạo sinh mang lại: Bằng chứng từ giáo dục trung học ở Trung Quốc” cho thấy học sinh Trung Quốc nhìn chung đang sử dụng AI để hỗ trợ học tập.
Nghiên cứu cho thấy mặc dù điểm bài tập của những học sinh sử dụng AI tăng đáng kể, thành tích của các em trong các kỳ thi lại giảm rõ rệt.
Nghiên cứu cho biết, trong số những học sinh được khảo sát, khoảng 80% cho biết đã sử dụng các mô hình AI nội địa Trung Quốc, bao gồm DeepSeek, Doubao và các mô hình khác; 20% còn lại được sử dụng làm nhóm đối chứng.
DeepSeek dừng vòng gọi vốn, nhà sáng lập tiết lộ năng lực tính toán thực sự của chip nội địa Trung Quốc
Ngoài thông tin DeepSeek bị cáo buộc bịa đặt các tài liệu nghiên cứu khoa học nói trên, gần đây xung quanh DeepSeek còn xuất hiện nhiều thông tin liên quan đến hoạt động vận hành và năng lực công nghệ của công ty, cũng thu hút sự chú ý từ bên ngoài.
Theo Bloomberg dẫn lời những người nắm rõ tình hình hôm 25/7, vòng gọi vốn thứ hai của DeepSeek bất ngờ bị đình chỉ, nguyên nhân trực tiếp là một bài phát biểu trước đây của nhà sáng lập Lương Văn Phong (Liang Wenfeng) bị phát tán. Trong bài phát biểu này, ông Lương “tiết lộ” trình độ thực sự của ngành AI Trung Quốc cũng như những thông tin nội bộ về việc thu được chip AI và công nghệ của Mỹ thông qua các con đường bất hợp pháp, qua đó xác nhận những cáo buộc mà phía Mỹ đưa ra từ trước đến nay. Điều này có thể khiến công ty đồng thời phải đối mặt với sự chú ý đặc biệt của các cơ quan quản lý ở cả Trung Quốc và Mỹ.
Theo bản ghi âm bài phát biểu của ông Lương Văn Phong đang được lan truyền trên mạng, tại một cuộc gặp gỡ với các nhà đầu tư, ông hiếm khi thẳng thắn thừa nhận rằng so với các công ty cùng ngành ở Mỹ, các công ty AI Trung Quốc chỉ có thể huấn luyện những mô hình nhỏ hơn khoảng 10 lần.
Ông cho biết hiện DeepSeek chỉ có khoảng 20.000 chip có năng lực tính toán tương đương dòng H của NVIDIA, và phần lớn số chip này chỉ mới được giao trong một, hai tháng gần đây.
Ông thẳng thắn nói rằng với quy mô năng lực tính toán hiện tại, công ty hoàn toàn không thể huấn luyện một mô hình ngôn ngữ lớn hàng đầu có năng lực tương đương các công ty Mỹ. Ngay cả khi đầu tư toàn bộ 50 tỷ nhân dân tệ huy động được trong vòng gọi vốn đầu tiên cũng “không đủ để huấn luyện”.
Ông nói: “Đối với mô hình lớn nhất hiện nay, thực ra chúng tôi không đủ khả năng huấn luyện. Cho dù chúng tôi tiêu hết 50 tỷ (toàn bộ số tiền của vòng gọi vốn đầu tiên), thực ra cũng không huấn luyện nổi. Cho dù có thể chất (mô hình) lên được thì cũng không dùng nổi”.
Ông còn tiết lộ rằng quy mô tham số kích hoạt (Active Parameter Size) của các mô hình lớn nhất trong ngành AI Mỹ hiện nay vào khoảng 80 tỷ tham số, trong khi mô hình lớn nhất của Trung Quốc hiện chỉ ở mức vài tỷ tham số, chênh lệch tới một bậc độ lớn.
Trong công nghệ mô hình AI lớn, “quy mô tham số kích hoạt” là tổng số tham số thực sự tham gia tính toán khi mô hình xử lý mỗi đầu vào hoặc tạo ra từng chữ (Token).
Ông nói thêm: “Đối với chúng tôi, chúng tôi có thể mua một số card không tuân thủ (chịu sự kiểm soát xuất khẩu của Mỹ). Vì vậy, mục đích chúng tôi mua Huawei 950 vẫn là hy vọng giúp Huawei xây dựng hệ sinh thái này tốt hơn. 16.000 card Huawei 950 chỉ tương đương với 4.000 card dòng B (của NVIDIA). Vì vậy đây không phải là một số lượng lớn, ý nghĩa cũng không lớn lắm.”
Tháng Sáu năm nay, DeepSeek hoàn tất vòng gọi vốn cổ phần bên ngoài đầu tiên, với định giá công ty vượt 400 tỷ nhân dân tệ.
Theo các báo cáo, vòng gọi vốn này sử dụng một cấu trúc đặc biệt, trong đó các tổ chức đầu tư không có quyền biểu quyết, đồng thời cổ phần phải chịu thời hạn khóa 5 năm.
Tuy nhiên, khoản đầu tư 1 tỷ nhân dân tệ của Quỹ Đầu tư Công nghiệp Mạch tích hợp Quốc gia của Đảng Cộng sản Trung Quốc (thường được gọi là “Đại Quỹ”) có tính chất khá đặc biệt. Khoản tiền này được rót trực tiếp vào pháp nhân DeepSeek, đồng thời vẫn giữ quyền biểu quyết và không chịu thời hạn khóa 5 năm.
“Đại Quỹ” là quỹ đầu tư công nghiệp do chính quyền ĐCSTQ thành lập trong lĩnh vực bán dẫn.
Từ khóa AI DeepSeek trí tuệ nhân tạo































