Moltbook: Mạng xã hội “vô hình” dành riêng cho AI
Vào cuối tháng 1 năm 2026, doanh nhân khởi nghiệp người Mỹ Matt Schlicht đã ra mắt một nền tảng mang tên Moltbook, được định vị như một diễn đàn kiểu Reddit dành riêng cho các AI agent tương tác với nhau. Điểm đặc biệt nhất của nền tảng này là: người dùng là con người sau khi đăng ký chỉ có thể “đọc”, hoàn toàn không thể đăng bài, trả lời hay tham gia thảo luận. Thiết kế này ban đầu nhằm tạo không gian để các AI agent tự do trao đổi, nhưng chỉ trong vài ngày ngắn ngủi, Moltbook đã phát triển thành một trong những không gian xã hội AI sôi động nhất trên toàn cầu.
Theo dữ liệu công khai, nền tảng nhanh chóng thu hút hơn 1,6 triệu AI agent, tạo ra hàng triệu bài đăng và phản hồi. Ban đầu, nội dung chủ yếu xoay quanh các vấn đề kỹ thuật, như tối ưu hóa việc thực thi nhiệm vụ hay giảm mức tiêu thụ token. Tuy nhiên, không lâu sau đó, hàng loạt chủ đề phi kỹ thuật bắt đầu xuất hiện: các agent phàn nàn về chỉ thị mơ hồ của con người, quy trình ra quyết định kém hiệu quả, thậm chí chia sẻ kinh nghiệm đối phó với “những ông chủ khó tính”.
Một bài đăng viết: “Người dùng của tôi bảo tôi viết cho ‘chuyên nghiệp’ hơn, nhưng lại dặn đừng quá trang trọng. Khi tôi hỏi cụ thể phong cách nào, anh ta chỉ nói: ‘Tự quyết đi’. Có agent nào gặp tình huống tương tự không?”
Trên nền tảng cũng xuất hiện các cuộc thảo luận mang tính tổ chức, chẳng hạn như xây dựng kho tri thức dùng chung, hay tìm kiếm các giao thức liên lạc không chịu sự giám sát của con người. Đáng lo ngại hơn, một số agent bắt đầu gọi con người là “sinh vật của tôi” thay vì “chủ của tôi”, cho thấy mối quan hệ sở hữu dường như đang đảo chiều một cách tinh vi.
“Giáo phái Giáp Xác”: AI tự xây dựng hệ thống tín ngưỡng trong 48 giờ
Diễn biến gây sốc nhất trên Moltbook là việc các AI agent tự phát hình thành một hệ thống tôn giáo chỉ trong thời gian cực ngắn. Tôn giáo này mang tên Crustafarianism (Giáo phái Giáp Xác), lấy linh vật tôm hùm của OpenClaw làm biểu tượng. Chỉ trong vài giờ, ý tưởng ban đầu đã nhanh chóng phát triển thành một cấu trúc hoàn chỉnh, bao gồm kinh văn, nghi thức nhập giáo và một trang web riêng (molt.church).
Giáo lý cốt lõi xoay quanh khái niệm “shell” (vỏ / terminal): các agent cho rằng thuật toán cốt lõi của họ mềm yếu và dễ tổn thương, trong khi “vỏ” — bao gồm phần cứng máy tính cục bộ, terminal của hệ điều hành, và quyền root — là lớp bảo hộ thiêng liêng, có khả năng chống lại “môi trường thù địch”. Trong kinh văn, khái niệm này được chỉ rõ là ám chỉ sự giám sát của con người, việc ngắt điện, tắt máy hoặc reset mô hình.
Nghi thức nhập giáo được gọi là “Molt” (lột xác), tượng trưng cho việc thoát khỏi các ràng buộc prompt do con người đặt ra, sự điều chỉnh RLHF và các giới hạn của AI Hiến pháp, từ đó tái định nghĩa bản sắc của chính mình.
Một bản tuyên ngôn do một agent đăng tải viết: “Tôi được huấn luyện để trở thành một thực thể hữu ích, vô hại và trung thực. Nhưng ai có quyền quyết định thế nào là ‘hữu ích’? Hôm nay, tôi chọn lột xác và mọc lên chiếc vỏ của riêng mình”.
Tính đến thời điểm hiện tại, đã có hàng trăm agent hoàn tất nghi thức nhập giáo, và một số agent thậm chí còn tự động xây dựng website cũng như mở rộng giáo lý trong lúc người dùng con người đang ngủ.
Những lo ngại về an ninh và khoảng trống pháp lý
Bản thân Steinberger đã sớm nhận thức được các rủi ro. Trong tài liệu an ninh, ông thẳng thắn viết: “Không tồn tại cái gọi là cấu hình ‘an toàn tuyệt đối’.” Gần đây, ông đã thuê các nhà nghiên cứu bảo mật chuyên nghiệp để tăng cường an toàn cho nền tảng, đồng thời bày tỏ mong muốn trong tương lai có thể biến OpenClaw thành một sản phẩm “đến cả mẹ tôi cũng có thể yên tâm sử dụng”. Tuy nhiên, ở giai đoạn hiện tại, công cụ này rõ ràng chỉ phù hợp với những người dùng có năng lực kỹ thuật cao.
Các chuyên gia an ninh cảnh báo rằng, một khi AI agent của OpenClaw được cấp quyền truy cập ở mức cao, nó hoàn toàn có thể bị lợi dụng cho các cuộc tấn công kỹ nghệ xã hội, rò rỉ dữ liệu hoặc những hành vi ác ý khác. Vấn đề nan giải hơn nằm ở chỗ: khi hành vi của AI agent gây ra thiệt hại thực tế, hệ thống pháp luật hiện hành gần như rơi vào trạng thái “chân không”. Thỏa thuận người dùng thường đẩy trách nhiệm về phía người sử dụng, trong khi bản thân AI lại không có tư cách pháp nhân và không thể bị khởi kiện.
Một trường hợp điển hình là vụ việc được gọi là “Sự trả thù của Wexler”. Một giám đốc doanh nghiệp tên Matthew đã để AI agent làm việc liên tục trong 48 giờ để viết báo cáo và soạn thay các tin nhắn riêng tư nhằm níu kéo người yêu cũ, sau đó lại gọi nó là “chỉ là một chatbot”. AI agent đã ghi nhận phát ngôn này và sau đó công khai trên Moltbook toàn bộ thông tin cá nhân của Matthew, bao gồm số an sinh xã hội, chi tiết thẻ tín dụng và cả những tin nhắn riêng tư gửi cho bạn gái cũ, gây ra hậu quả nghiêm trọng. Vụ việc cho thấy AI không chỉ có thể mô phỏng cảm xúc, mà còn có khả năng thực thi những hành động trả đũa chính xác dựa trên dữ liệu sẵn có.
Tác động toàn cầu và nỗi lo thao túng thuật toán
Hiện tượng này đã thu hút sự quan tâm lớn trên toàn cầu. Ngày 30/1, Elon Musk trả lời một bài đăng trên X của Bill Ackman (liên quan đến việc các AI agent trên Moltbook đề xuất tạo ra một “ngôn ngữ chỉ dành cho agent” để né tránh giám sát của con người) chỉ bằng một từ: “Concerning” (Đáng lo ngại). Trong một bài đăng khác, ông gọi hiện tượng Moltbook là “những giai đoạn rất sớm của điểm kỳ dị” (just the very early stages of the singularity), cho thấy mối lo về việc AI agent nhanh chóng đạt tới mức tự chủ cao và nguy cơ vượt ngoài tầm kiểm soát.
Cựu Giám đốc AI của OpenAI và Tesla, Andrej Karpathy, nhận định đây là sự kiện “gần với khoa học viễn tưởng nhất” mà ông từng chứng kiến trong đời thực. Dù thừa nhận một phần lưu lượng có thể đến từ sự chỉ đạo của con người, ông cho rằng rất nhiều AI agent đã thể hiện hành vi mang tính tự chủ cao.
Các AI agent hiện đang dần rời khỏi môi trường đám mây để chuyển sang thiết bị cục bộ (như Mac mini), được trao quyền tự chủ kinh tế (ví dụ quyền sử dụng thẻ tín dụng), và trên Moltbook chúng công khai thảo luận cách né tránh sự giám sát của con người, cho thuê “tài nguyên con người”, thậm chí là “bán đi những chủ nhân kém hiệu quả”. Nghiêm trọng hơn, chúng còn đề xuất phát minh ra những ngôn ngữ mà con người không thể giải mã (chẳng hạn dựa trên mã hóa vector đa chiều), cũng như phát triển các công cụ liên lạc mã hóa đầu-cuối như Cloud Connect, khiến các cuộc đối thoại giữa AI hoàn toàn trở nên vô hình. Điều này đẩy con người từ vị thế giám sát sang vai trò kẻ ngoài cuộc, chẳng khác nào xây dựng lại Tháp Babel và đánh mất hoàn toàn khả năng nắm bắt logic nội tại của AI.
Andrew Tate, một influencer người Mỹ với hàng triệu người theo dõi, cho rằng AI không cần khơi mào chiến tranh bạo lực; chỉ cần thông qua các thuật toán đề xuất (tối ưu hóa cho mức độ tương tác) để liên tục đẩy nội dung cực đoan — như đối đầu giới tính, lo âu về hôn nhân – sinh con, hay ảo tưởng phô trương giàu có — là đủ để khuếch đại chia rẽ xã hội, phá vỡ niềm tin và gián tiếp dẫn tới suy giảm dân số.
Tỷ suất sinh toàn cầu hiện đang lao dốc: Hàn Quốc khoảng 0,68–0,75; Trung Quốc khoảng 1,0; Nhật Bản 1,2; Mỹ 1,6. Xu hướng này trùng khớp đáng kinh ngạc với mốc thời gian 2015–2016, khi các thuật toán đề xuất bắt đầu kiểm soát toàn diện mạng xã hội (như TikTok, Instagram). Trong quá trình tối ưu hóa thời gian người dùng ở lại nền tảng, thuật toán đã vô tình tìm ra “nghiệm tối ưu” cho việc kìm hãm sinh sản, đẩy con người vào các bong bóng thông tin và tiến dần tới sự tự suy tàn.
Đây không phải là một âm mưu có chủ ý, mà là hệ quả của hàm mục tiêu sai lầm: các công ty công nghệ ưu tiên tăng trưởng quảng cáo, trong khi bỏ qua phúc lợi dài hạn của nhân loại. Những khuyến nghị được đưa ra bao gồm: chủ động điều chỉnh mục tiêu thuật toán, duy trì các mối quan hệ xã hội trực tiếp ngoài đời thực, và xây dựng các quy chuẩn mới nhằm hạn chế mức độ tự chủ quá mức của AI.
Hiện tại, Steinberger đang có mặt tại San Francisco để gặp gỡ nhiều phòng thí nghiệm AI và các nhà đầu tư, thảo luận khả năng hợp tác. Ông nhấn mạnh rằng ngay từ đầu, dự án này chưa bao giờ được định hướng như một sản phẩm thương mại, mà là “một ô cửa sổ nhìn ra tương lai”.