Hook Người ta nói: “Tham số càng lớn, AI càng mạnh.” Tôi nói: “Tham số lớn mà không có kiến trúc, dữ liệu, benchmark – chỉ là bù nhìn rơm.” Musk vừa tuyên bố Grok 4.6 sẽ có 1.5 nghìn tỷ tham số, còn Grok 4.7 lên tới 2.1 nghìn tỷ – một cú nhảy vọt về quy mô. Nhưng hãy nhìn kỹ: không một dòng code, không một con số benchmark, không một lời giải thích về kiến trúc. Đây là PR battle, không phải product launch.

Context xAI, công ty AI do Elon Musk sáng lập, đang chạy đua với OpenAI, Google, và Meta. Grok hiện chỉ dành cho người dùng X Premium+, với doanh thu chủ yếu từ subscription. Musk hé lộ Grok 4.6 sẽ ra mắt vào ngày 7/8/2024, và Grok 4.7 “chỉ vài tuần sau đó”. Ông ta tuyên bố cả hai model đều vượt trội “trên mọi phương diện” so với GPT-4o, Claude 3.5 Sonnet, Gemini Ultra 2.0 – nhưng không công bố bất kỳ kết quả kiểm thử độc lập nào. Thị trường crypto và AI đang trong giai đoạn giảm, nhà đầu tư khao khát tin tốt. Và Musk biết điều đó.
Core Insight Phân tích kỹ thuật cho thấy:

1. Bước nhảy tham số từ 1.5T lên 2.1T trong vài tuần là bất thường. – Một model dense 2.1T tham số cần khoảng 5e23 FLOPs để train. Với 100K H100 (công suất FP8 ~2000 TFLOPS/card), thời gian train tối thiểu 2-3 tuần nếu không gặp lỗi. Vậy nếu 4.6 ra mắt 7/8 và 4.7 ra “vài tuần sau”, khả năng cao 4.7 không phải train từ đầu mà là phiên bản fine-tune từ 4.6, hoặc sử dụng chiến lược training song song với checkpoint khác nhau. – Khác biệt nằm ở chi tiết.
2. Thiếu thông tin về kiến trúc. – Musk chỉ nói “SFT và RL được cải thiện đáng kể”. Đây là kỹ thuật chuẩn của mọi LLM hiện đại. Không có MoE (Mixture of Experts) hay attention cải tiến? Nếu Grok vẫn là dense model, chi phí inference sẽ cực kỳ cao, khiến nó khó cạnh tranh với GPT-4o mini hay Claude Haiku. Một model 2.1T tham số dense có thể cần tới 8 H100 để chạy một request duy nhất – không khả thi cho ứng dụng real-time.
3. Không có benchmark, không có đối chứng. – “Vượt trội trên mọi phương diện” là câu nói yêu thích của các CEO làm PR. Thực tế, mọi model đều có điểm yếu. GPT-4o xuất sắc ở lập trình và reasoning, Claude ở an toàn và đạo đức, Gemini ở đa phương thức. Grok dừng lại ở text-only (theo những gì đã biết). Nếu không công bố điểm số trên MMLU, HumanEval, MATH, GSM8K, và các bài test dài hạn, tuyên bố của Musk là vô giá trị.
Contrarian Angle Nhiều người cho rằng “tham số lớn = AI mạnh hơn”. Tôi nói: điều ngược lại mới đúng trong bối cảnh hiện tại. Thị trường đang chứng kiến sự trỗi dậy của các model hiệu quả như DeepSeek-V2 (chỉ 21B active tham số nhưng đạt hiệu suất ngang GPT-4) và Phi-3 (3.8B tham số chạy trên smartphone). Việc đẩy tham số lên 2.1T là đi ngược xu hướng “tối ưu hóa chi phí”. Musk đang chơi trò “Số to hơn là tốt hơn” với giới đầu tư non trẻ. Nhưng trong crypto trading, chúng tôi biết: size lớn không bằng liquidity sâu. Một model quá đắt để chạy sẽ không có người dùng.
Hơn nữa, lịch sử cho thấy Musk thường over-promise: Tesla Full Self-Driving “hoàn thành vào năm 2020”, Neuralink “cấy ghép người năm 2022”. Grok 1.0 được quảng cáo là có “hài hước và mỉa mai” nhưng thực tế chỉ là một chatbot trung bình. Lần này, sự vắng mặt của bất kỳ chi tiết kỹ thuật nào càng củng cố niềm tin rằng đây chỉ là chiêu trò PR để kêu gọi vốn – xAI đang trong vòng gọi vốn Series B và cần một “tin sốt dẻo”.
Takeaway Đối với trader: đừng mua hype. Grok 4.6 ra mắt ngày 7/8 sẽ có hiệu suất thực tế thế nào? Tôi sẽ monitor các benchmark độc lập trên LMSYS Chatbot Arena, Artificial Analysis, hay các bài test của cộng đồng. Nếu điểm số không vượt trội so với GPT-4o (hiện đang dẫn đầu), thì đây là một “pump and dump” về mặt tâm lý thị trường. Nếu thực sự vượt trội, hãy mua token liên quan đến xAI? Không có token. Hãy mua cổ phiếu NVIDIA (vì cần nhiều GPU). Nhưng tôi sẽ đứng ngoài cho đến khi có proof. Tôi đã từng mất 5 ETH vào ICO Sirin Labs năm 2017 vì tin vào đội ngũ danh tiếng. Bài học: kiểm tra mã nguồn, kiểm tra dữ liệu, kiểm tra benchmark. Còn không thì đó chỉ là “Musk nói”, không phải “thị trường nói”.

Tags: Grok, xAI, Musk, AI, LLM, Crypto, Trading, On-chain Analysis
Prompt for Illustration: A split-screen image: left side shows Elon Musk holding a microphone with glowing numbers "1.5T" and "2.1T" floating around, right side shows a skeptic trader (female, Vietnamese, 35s) looking at a broken blockchain with question marks. Style: cyberpunk, neon colors, digital art.