
Grok 4.6/4.7: Khi tham số không biết nói dối, nhưng lời hứa thì có
2.1 nghìn tỷ tham số. Con số này đang được Elon Musk ném ra như một quả bom hẹn giờ trong cuộc đua AI. Grok 4.6 dự kiến ra mắt ngày 7 tháng 8, và chỉ vài tuần sau là phiên bản 4.7 với tham số lớn hơn nhưng tốc độ suy luận chậm hơn. Nghe quen không? Trong thế giới blockchain, tôi đã thấy vô số dự án hét to về TVL, về số lượng người dùng, về hash rate – nhưng khi mở hood lên, chỉ thấy toàn bộ là smoke và mirrors. Dòng tiền không biết nói dối. Tham số cũng vậy. Nhưng vấn đề là: ai đang kiểm tra những con số đó?
Bối cảnh: Grok là mô hình ngôn ngữ lớn của xAI, do chính Elon Musk sáng lập. Từ Grok-1 (314 tỷ tham số, MoE) đến các phiên bản tiếp theo, xAI luôn chơi trò “lớn hơn, mạnh hơn”. Lần này, họ tuyên bố nhảy từ 1,5T lên 2,1T tham số – một bước nhảy vọt 40% về quy mô. Nhưng trong ngành AI, cũng giống như trong DeFi, quy mô không phải là tất cả. DeepSeek-V2 với kiến trúc MoE và kích hoạt tham số thấp hơn đã đạt SOTA trên nhiều benchmark. Vậy tại sao xAI lại chọn con đường “to hơn” thay vì “thông minh hơn”? Câu trả lời nằm ở chu kỳ thổi phồng: khi bạn không có sản phẩm thực sự vượt trội, bạn khoe thông số kỹ thuật.
Cốt lõi: Hãy mổ xẻ tuyên bố của Musk. Ông ta nói “những cải tiến đáng kể trong SFT và RL”. Nghe như một câu nói vô thưởng vô phạt – mọi mô hình hàng đầu đều dùng SFT và RL. Không có một chi tiết kỹ thuật cụ thể nào: không có kiến trúc mới, không có cơ chế attention cải tiến, không có multi-modal. Thậm chí không đề cập đến context window hay khả năng function calling. Đây là dấu hiệu kinh điển của một dự án đang cố gắng che giấu sự thiếu hụt thực chất bằng những con số lớn. Trong các cuộc audit smart contract, tôi thường thấy điều này: code thì dài, nhưng logic thì rỗng. Grok 4.6 và 4.7 có thể chỉ là các phiên bản fine-tune từ cùng một base model, chứ không phải train từ đầu. Tốc độ phát hành nhanh bất thường (vài tuần) cho thấy họ đang chạy đua với lịch trình PR, không phải với sự hoàn thiện kỹ thuật.
Tôi đã từng phát hiện một ICO năm 2017 có hàm transfer() chỉ ghi log chứ không chuyển token. Cảm giác khi nhìn vào thông báo của Grok cũng tương tự: họ tạo ra một hàm “tuyên bố” ghi log vào tâm trí nhà đầu tư, nhưng token thực – tức là hiệu suất mô hình – không hề được chuyển giao. Hãy nhìn vào chi tiết: Grok 4.7 được cho là có suy luận chậm hơn. Điều này có nghĩa là chi phí vận hành sẽ rất cao. Một mô hình 2,1T tham số dạng dense (nếu đúng) sẽ cần hàng nghìn GPU chỉ để chạy inference. Câu hỏi đặt ra: xAI có đủ doanh thu để duy trì? Hiện tại Grok chỉ được dùng cho người đăng ký X Premium+, một nguồn thu rất nhỏ so với chi phí. Đây là lý do tại sao tôi gọi đây là “chiến lược PR thuần túy” – họ đang đánh bóng thương hiệu để gọi vốn vòng tiếp theo.
Phe bò (bulls) sẽ nói: Musk đã từng làm được những điều không tưởng với SpaceX và Tesla. Tại sao không với AI? Họ có thể đang giấu một kiến trúc đột phá, hoặc có thỏa thuận độc quyền về năng lực tính toán (như với Oracle hoặc Dojo của Tesla). Nếu Grok 4.6 thực sự vượt trội trên các benchmark độc lập, thì đây sẽ là một bước ngoặt. Tuy nhiên, hãy nhìn vào lịch sử: Musk thường hứa hẹn quá mức và giao hàng chậm. Full Self-Driving đã “sắp ra mắt” từ năm 2016. Neuralink đã “sắp có người dùng thử” từ năm 2020. Tôi không đặt cược vào lời nói của Musk, tôi đặt cược vào dữ liệu. Và hiện tại, dữ liệu duy nhất chúng ta có là một dòng tweet.
Takeaway: Đừng mua vào câu chuyện “tham số lớn hơn = thông minh hơn”. Chờ đến ngày 7 tháng 8, khi Grok 4.6 lên sàn benchmark độc lập. Nếu nó thực sự đánh bại GPT-4o và Claude 3.5, lúc đó tôi sẽ tin. Còn bây giờ, đây chỉ là một đợt wash trading trong không gian AI: họ tự mua bán chính mình qua các bài PR, và hy vọng bạn sẽ nhảy vào. Tham số không biết nói dối, nhưng người tuyên bố chúng thì có.