Cuối tuần qua, Elon Musk bất ngờ đăng trên X rằng SpaceXAI sắp hoàn tất huấn luyện mô hình 2 nghìn tỷ tham số — lớn gấp 1.3 lần Grok 4.5. Trước đó chỉ vài ngày, Kimi K3 vừa đứng đầu bảng xếp hạng của Artificial Analysis với chi phí thấp hơn Grok 4.5. Dân tình bắt đầu xôn xao: liệu Musk có thực sự vượt mặt đối thủ Trung Quốc?
Lời hứa rẻ nhất là trên whitepaper. Khi mọi người nói “2T tham số”, tôi thường nhìn vào chi phí suy luận và thời gian hậu huấn luyện. Mô hình 2T của Musk nếu thực sự hoàn tất pre-training trong tuần tới, vẫn còn hàng tháng RLHF, SFT và kiểm tra an toàn trước khi ra mắt. Đây là kịch bản quen thuộc với những ai từng theo dõi lịch sử ra mắt của Tesla FSD hay Neuralink.
Bối cảnh: Musk đang ở thế phòng thủ. Grok 4.5 chỉ đạt 54 điểm “chỉ số thông minh” (so với 57 của Kimi K3 và ~70 của GPT-4o). Chi phí 0.31 USD mỗi tác vụ là lợi thế duy nhất — rẻ hơn Kimi K3 tới 3 lần. Nhưng Musk hiểu rằng chỉ “rẻ” không thôi chưa đủ để giữ chân người dùng X Premium+. Vì vậy, tuyên bố 2T tham số là đòn tâm lý nhằm kéo sự chú ý khỏi Kimi và ổn định niềm tin nhà đầu tư.
Tôi đã từng tham gia dự án Fetch.ai hồi testnet 2026, chứng kiến làn sóng AI agent trên blockchain hứa hẹn đủ thứ nhưng thực tế chẳng có gì ngoài token pump. Bài học rút ra: sự kết hợp giữa AI và crypto không nằm ở tham số lớn hay benchmark, mà ở khả năng vận hành phi tập trung với chi phí thấp. Musk không nói gì về kiến trúc: liệu là dense Transformer hay MoE? Làm sao giữ token efficiency? Nếu anh ta dùng MoE với nhiều expert, chi phí suy luận có thể tăng vọt, phá vỡ luận điểm cạnh tranh duy nhất.
Khía cạnh crypto: Nếu mô hình này thực sự được tung ra với API giá rẻ, các dự án DePin như Render Network hay Akash sẽ chịu áp lực — vì khách hàng sẽ đổ xô vào cloud tập trung thay vì mạng lưới phi tập trung. Ngược lại, các agent AI trên chuỗi (Autonolas, Fetch.ai) có thể được hưởng lợi nhờ chi phí inference thấp, thúc đẩy ứng dụng on-chain. Nhưng tôi nghi ngờ Musk sẽ cho phép Grok chạy trên hợp đồng thông minh: mô hình của anh ta là “vườn kín” quanh X.
Góc nhìn phản trực giác: Đám đông kỳ vọng “2T tham số sẽ đánh bại Kimi”, nhưng thực tế là khả năng xử lý ngữ cảnh dài và suy luận phức tạp của Grok 4.5 vẫn kém xa GPT-4o. Musk thậm chí không đề cập đến multi-modal — một điểm yếu chết người khi các đối thủ đều đã có vision, audio. Cứ cho là pre-training thành công, thì hậu huấn luyện tốn 3-6 tháng; trong thời gian đó, cả Kimi lẫn OpenAI đều sẽ phát hành bản cập nhật mới. Tin đồn về Grok 5.0 chỉ là mồi câu FOMO cho X Premium+.
Câu chuyện kết thúc ở đâu? Không phải bằng một kết luận, mà bằng câu hỏi: Nếu Musk thực sự muốn chứng minh năng lực, tại sao không publish whitepaper? Tại sao không mở API cho bên thứ ba test ngay hôm nay? Bởi vì lời hứa rẻ nhất luôn nằm trên whitepaper, còn sự thật thì nằm ở ví tiền của người dùng. Tôi sẽ không mua hype cho đến khi thấy được benchmark độc lập và chi phí suy luận thực tế. Còn bạn, bạn có dám đặt cược vào một mô hình chưa từng xuất hiện ngoài dòng tweet?