
Elon Musk đã đặt mục tiêu đầu tháng 8 cho Grok 4.6 và tiết lộ kế hoạch cho một mô hình Grok 4.7 lớn hơn khi SpaceXAI tăng cường cạnh tranh với OpenAI, Anthropic và Moonshot AI của Trung Quốc.
Musk đã tiết lộ thời gian biểu trong một bài đăng ngày 28 tháng 7 trên X, nói rằng Grok 4.6 sẽ được phát hành “khoảng ngày 7 tháng 8”. Ông mô tả đây là một mô hình 1.5 nghìn tỷ tham số với tinh chỉnh có giám sát và học tăng cường mạnh mẽ hơn.
Tinh chỉnh có giám sát (Supervised fine-tuning) huấn luyện một mô hình dựa trên các ví dụ được chọn để cải thiện chất lượng phản hồi của nó. Học tăng cường (Reinforcement learning) sử dụng phản hồi và tín hiệu phần thưởng để tinh chỉnh cách mô hình xử lý các nhiệm vụ và tuân theo hướng dẫn.
Musk cũng cho biết Grok 4.7 sẽ ra mắt “vài tuần sau đó” dưới dạng một mô hình 2.1 nghìn tỷ tham số. Tuy nhiên, ông không cung cấp ngày ra mắt chính xác hoặc tiết lộ chi tiết về giá cả và tính khả dụng cho cả hai phiên bản.
“Phiên bản này sẽ tốt hơn 4.6 về mọi mặt, ngoại trừ việc phục vụ hơi chậm hơn một chút, mặc dù có hiệu quả token tốt hơn,” Musk nói về Grok 4.7.
Cả hai ngày vẫn là mục tiêu chứ không phải lịch phát hành đã được xác nhận. Lịch trình phát triển mô hình có thể thay đổi trong quá trình huấn luyện, thử nghiệm và triển khai.
SpaceXAI đã giới thiệu Grok 4.5 vào đầu tháng 7 như một mô hình được thiết kế cho lập trình, các tác vụ dựa trên tác nhân và công việc tri thức. Công ty hiện tính phí 2 đô la cho mỗi triệu token đầu vào và 6 đô la cho mỗi triệu token đầu ra.
Musk đã công bố hai mô hình tiếp theo để phản hồi một đánh giá từ CEO của Vercel, Guillermo Rauch, người đã mô tả Grok 4.5 là mô hình an ninh mạng hoạt động tốt nhất so với giá của nó trong các thử nghiệm mới nhất của Vercel.
Theo bài đăng của Rauch, Grok 4.5 rẻ hơn 10 lần so với GPT-5.6 Sol của OpenAI, rẻ hơn 5.7 lần so với Opus 5 của Anthropic và rẻ hơn 2.2 lần so với Kimi K3 của Moonshot, trong khi vẫn mang lại hiệu suất gần với Kimi.
Rauch vẫn xếp Sol là mô hình tiên tiến hàng đầu, vượt lên Opus 5. Những phát hiện của ông phản ánh các phương pháp thử nghiệm của Vercel và không thiết lập một bảng xếp hạng chung cho mọi khối lượng công việc AI.
SpaceXAI chưa cho biết liệu Grok 4.6 và Grok 4.7 có giữ nguyên mức giá của Grok 4.5 hay không. Tốc độ dịch vụ, mức sử dụng token và chi phí API sẽ quyết định liệu các mô hình mới hơn có duy trì lợi thế về hiệu suất-giá tương tự hay không.
Các nâng cấp theo kế hoạch của Grok diễn ra khi các nhà phát triển Trung Quốc rút ngắn khoảng cách với các công ty AI hàng đầu của Mỹ. Moonshot AI đã phát hành toàn bộ trọng số (full weights) cho Kimi K3 vào ngày 27 tháng 7, cho phép các nhà phát triển tải xuống, sửa đổi và vận hành mô hình trên cơ sở hạ tầng của riêng họ.
Kimi K3 có 2.8 nghìn tỷ tham số, khả năng xử lý hình ảnh gốc và cửa sổ ngữ cảnh một triệu token. Quy mô và cấu trúc trọng số mở của nó đã tạo thêm áp lực lên các công ty Mỹ, những công ty chủ yếu phân phối các mô hình tiên tiến nhất của họ thông qua các nền tảng đóng và API trả phí.
SpaceXAI, OpenAI và Anthropic cũng đang cạnh tranh về lập trình, an ninh mạng, suy luận và chi phí cần thiết để hoàn thành mỗi tác vụ. Kiến trúc lớn hơn của Grok 4.7 có thể cải thiện khả năng của nó, nhưng Musk thừa nhận rằng nó sẽ chậm hơn khi phục vụ so với Grok 4.6.
Số lượng tham số đơn thuần không quyết định chất lượng mô hình. Dữ liệu huấn luyện, kiến trúc, phương pháp hậu huấn luyện, hệ thống suy luận và hiệu quả token đều có thể ảnh hưởng đến hiệu suất.
OpenAI và Anthropic đã đồng ý cung cấp cho các quan chức Mỹ quyền truy cập sớm vào các mô hình tiên tiến chưa phát hành để thử nghiệm an toàn. Những thỏa thuận đó đã hình thành cơ sở cho một khuôn khổ đánh giá liên bang tự nguyện rộng lớn hơn, hiện bao gồm các nhà phát triển lớn khác, bao gồm SpaceXAI, Google DeepMind và Microsoft.
Tổng thống Donald Trump đã chính thức hóa khuôn khổ này thông qua một sắc lệnh hành pháp vào tháng Sáu. Các công ty tham gia có thể cung cấp các mô hình được đề cập cho chính phủ liên bang trong tối đa 30 ngày trước khi phát hành cho các đối tác đáng tin cậy. Sắc lệnh nêu rõ rằng các đánh giá này không tạo ra một hệ thống cấp phép bắt buộc hoặc tiền kiểm.
Tuy nhiên, ngành công nghiệp vẫn chia rẽ về cách Washington nên xử lý các mô hình có trọng số mở. Nvidia, Microsoft, Meta, OpenAI, Palantir và các tổ chức khác đã cảnh báo các nhà hoạch định chính sách Mỹ chống lại các hạn chế rộng rãi trong một bức thư mở ngày 24 tháng 7. Họ lập luận rằng các mô hình mở hỗ trợ cạnh tranh, giảm chi phí triển khai và cho phép các nhà phát triển chạy và sửa đổi hệ thống AI trên cơ sở hạ tầng của riêng họ.
Cuộc tranh luận đã trở nên gay gắt sau khi Moonshot AI phát hành Kimi K3 với 2.8 nghìn tỷ tham số. Các quan chức chính quyền Trump đã cáo buộc Moonshot sử dụng đầu ra từ mô hình Fable của Anthropic để huấn luyện Kimi K3 thông qua chưng cất quy mô lớn. Cố vấn công nghệ Nhà Trắng Michael Kratsios mô tả hành vi bị cáo buộc là một nỗ lực nhằm chiếm đoạt công nghệ độc quyền của Mỹ, trong khi Bộ trưởng Tài chính Scott Bessent cho biết chính quyền đang xem xét các lệnh trừng phạt và đưa Moonshot vào danh sách đen thương mại.
Moonshot chưa công khai chấp nhận những cáo buộc đó. Tuy nhiên, tranh chấp đã đặt Kimi K3 vào trung tâm của một cuộc chiến chính sách rộng lớn hơn về việc liệu Washington nên nhắm mục tiêu vào các rủi ro an ninh và sở hữu trí tuệ cụ thể hay hạn chế quyền truy cập vào các mô hình có trọng số mở của Trung Quốc rộng hơn. Grok 4.6 và Grok 4.7 sẽ tham gia vào thị trường đó khi các nhà phát triển Mỹ đối mặt với áp lực cải thiện hiệu suất trong khi đáp ứng các kỳ vọng an toàn liên bang mới nổi.