Khoa Học - Công Nghệ

Reflection AI được Nvidia hậu thuẫn ra mắt mô hình mở Beam, cạnh tranh DeepSeek, Kimi

Reflection AI, công ty khởi nghiệp Mỹ được Nvidia hậu thuẫn, hôm thứ Hai (5/10) ra mắt Beam, mô hình mở đầu tiên của mình, để cạnh tranh với mô hình giá rẻ Trung Quốc như DeepSeek và Kimi.

Tổng giám đốc Nvidia Jensen Huang. (Ảnh: Tống Bích Long/ Epoch Times)

Trong các bài kiểm tra hiệu năng (benchmark) do chính Reflection thực hiện, Beam đạt điểm tương đương GLM-5.2, mô hình mở mà công ty Z.ai ở Bắc Kinh ra mắt hồi tháng 7, theo Fortune. Z.ai đã ra mắt bản kế nhiệm GLM-5.3 vào tháng 8.

Công ty có trụ sở tại Brooklyn, New York này còn cho rằng Beam đang tiến sát mô hình Qwen3.8-Max của Trung Quốc trong các tác vụ lập trình và tác nhân AI (agent), Reuters đưa tin.

Epoch Times lưu ý chưa có bên độc lập nào kiểm chứng các tuyên bố của Reflection về hiệu năng.

501 tỷ tham số, mỗi tác vụ chỉ kích hoạt 23 tỷ

Trong bài blog đăng hôm thứ Hai, Reflection mô tả Beam là mô hình “hỗn hợp chuyên gia” (MoE) chỉ xử lý văn bản, mạnh về suy luận, lập trình và tác vụ tác nhân.

Công ty cho biết Beam có tổng cộng 501 tỷ tham số, nhưng mỗi tác vụ chỉ kích hoạt 23 tỷ, giúp mô hình chạy nhanh và rẻ hơn vì chỉ dùng một phần mạng lưới. Reflection huấn luyện trước Beam trên 23,8 nghìn tỷ token. Mô hình xử lý được ngữ cảnh dài tới 1 triệu token.

Để so sánh, GLM-5.2 của Z.ai có khoảng 744 tỷ tham số tổng và 40 tỷ tham số kích hoạt.

Nhờ học tăng cường với sức tính toán lớn, Beam “suy luận cực kỳ hiệu quả”, cho hiệu năng cạnh tranh về lập trình và tác vụ tác nhân “với chi phí token và lượng tính toán suy luận chỉ bằng một phần nhỏ,” theo công ty.

Reflection cho biết Beam hiệu quả gấp 3–4 lần các mô hình mở của những công ty phương Tây khác: điểm số cao hơn các mô hình mở hàng đầu hiện nay của phương Tây, trong khi lượng tính toán khi suy luận chỉ bằng “một phần tư đến một phần ba”.

Mô hình mở Trung Quốc được sử dụng rộng rãi

Fortune nhận định Mỹ vừa có thêm một ứng viên trong cuộc đua xây dựng mô hình AI mở tốt nhất. Trung Quốc hiện chiếm ưu thế trong cuộc đua này với các mô hình phổ biến như Kimi K3 của Moonshot và DeepSeek V4.

Beam ra mắt khi các công ty công nghệ Mỹ đang tìm cách đối phó với mô hình trọng số mở của Trung Quốc. Reuters mô tả các mô hình này rẻ hơn, dễ tùy biến hơn và có khả năng viết mã gần ngang các mô hình hàng đầu của OpenAI và Anthropic.

OpenAI, Anthropic và Google DeepMind chủ yếu cung cấp mô hình qua giao diện lập trình ứng dụng (API): khách hàng gửi câu lệnh và nhận câu trả lời. Ngược lại, người dùng có thể tải toàn bộ mô hình mở về, chạy trên phần cứng hay hạ tầng đám mây của mình và tinh chỉnh theo nhiều cách.

Ngày càng nhiều doanh nghiệp lớn chuyển sang mô hình mở vì kiểm soát được bảo mật dữ liệu và chi phí, dù trong nhiều trường hợp, mô hình mở vẫn kém mô hình độc quyền về hiệu năng.

Tính đến lúc Fortune đăng bài, trên bảng xếp hạng mô hình ngôn ngữ lớn của OpenRouter, nền tảng trung gian theo dõi mức độ sử dụng các mô hình AI, Nemotron của Nvidia là mô hình Mỹ đứng cao nhất, ở vị trí thứ 6. Mô hình Mỹ kế tiếp là gpt-oss của OpenAI, xếp thứ 19. Khi chỉ lọc các mô hình mở, nhóm dẫn đầu gồm mô hình của DeepSeek, Z.ai, Xiaomi, Tencent và Nvidia.

Nhắm đến doanh nghiệp, chính phủ bằng ý tưởng “nhà máy AI”

Reflection định vị Beam là mô hình “chủ lực” cho doanh nghiệp, khu vực công và giới lập trình viên. Hồi tháng 5, công ty đã hợp tác cung cấp mô hình cho Bộ Năng lượng và Bộ Chiến tranh Mỹ.

Theo Epoch Times, công ty dự định đưa Beam và các mô hình kế tiếp đến các doanh nghiệp và quốc gia. Ý tưởng cốt lõi là xây dựng “nhà máy AI”: mỗi tổ chức dùng dữ liệu độc quyền của mình để huấn luyện mô hình của Reflection, từ đó có hệ thống AI riêng, đặt tại chỗ và may đo theo nhu cầu.

Ông Jensen Huang (Hoàng Nhân Huân), giám đốc điều hành Nvidia, từ lâu đã cổ vũ khái niệm “nhà máy AI” và thúc đẩy một hệ sinh thái AI mở. Nvidia là bên hậu thuẫn Reflection và cũng sẽ hưởng lợi, vì các hệ thống này chạy trên GPU của hãng.

Epoch Times cho biết mùa hè năm nay, Reflection đã ký các thỏa thuận tổng trị giá hơn 7 tỷ USD với SpaceX và Nebius để bảo đảm quyền sử dụng chip GB300 của Nvidia đến năm 2029. Theo tin của CNBC và Bloomberg mà Fortune dẫn lại, thỏa thuận với SpaceX trị giá 6,3 tỷ USD được ký hồi tháng 6, cho phép dùng chip tại trung tâm dữ liệu Colossus 2. Một tháng sau, công ty ký thêm thỏa thuận 1 tỷ USD với nhà cung cấp đám mây Nebius.

Reflection do hai cựu nhà nghiên cứu Google DeepMind là Misha Laskin và Ioannis Antonoglou thành lập vào tháng 3/2024. Ông Laskin hiện là giám đốc điều hành, còn ông Antonoglou giữ chức chủ tịch kiêm giám đốc công nghệ.

Công ty phát triển các công cụ tự động hóa việc viết phần mềm, một mảng ứng dụng AI đang tăng trưởng nhanh. Hồi tháng 4, ông Laskin nói với CNBC rằng công ty được định giá 25 tỷ USD, Fortune thuật lại.

Reflection cho biết họ “đang huấn luyện mô hình tiếp theo, lớn hơn” trong lộ trình phát triển.

Bảo Minh

Published by
Bảo Minh

Recent Posts

Nepal dừng tìm kiếm cứu nạn sau lũ: 1.455 người chết, 5.285 người còn mất tích

Chính phủ Nepal quyết định dừng tìm kiếm, cứu nạn sau trận lũ làm ít…

31 giây ago

ĐCSTQ nâng cấp mạng lưới giám sát trên không, mặt đất, trên mạng, mở rộng tới toàn dân

Đảng Cộng sản Trung Quốc liên tục nâng cấp giám sát, ghép máy bay không…

6 phút ago

Bộ Quốc phòng Đài Loan: Mỹ sẽ cử 2 đại diện thường trực tại trụ sở Bộ

Bộ Quốc phòng Đài Loan cho biết Lầu Năm Góc và Viện Phân tích Quốc…

15 phút ago

2 tàu đâm nhau trên sông Congo, ít nhất 30 người chết, hàng chục người mất tích

Cú va chạm làm tàu chở khách chìm xuống độ sâu 12 mét. Đến tối…

24 phút ago

Sự thật về Giang Trạch Dân (12.1) – Vinh quang và lẫm lỡ của Hợp chúng quốc Hoa Kỳ

“Hợp chúng quốc Hoa Kỳ” từng một thời là hy vọng của nhân loại. Trong…

25 phút ago

Cựu thư ký báo chí Nhà Trắng Karoline Leavitt gia nhập Fox News làm bình luận viên

Fox News Media thông báo bà Karoline Leavitt, cựu Thư ký báo chí Nhà Trắng,…

33 phút ago