
Hình ảnh giúp hiểu rõ bài viết
xAI ngày 21/9/2026, theo giờ địa phương, công bố Grok 4.7 với khả năng tiếp nhận văn bản và hình ảnh, cửa sổ ngữ cảnh 500.000 token. Công ty cho biết mô hình mới đạt kết quả cao hơn Grok 4.6 trong nhiều bài đánh giá, đặc biệt ở các tác vụ lập trình.
Giá đầu vào từ 2 USD mỗi triệu token
Theo tài liệu của xAI, Grok 4.7 có mã mô hình grok-4.7, chỉ tạo đầu ra dạng văn bản. Người dùng có thể chọn bốn mức độ suy luận gồm Low, medium, high và xhigh, trong đó high là thiết lập mặc định.
Giá tiêu chuẩn được ấn định ở mức 2 USD cho mỗi triệu token đầu vào và 6 USD cho mỗi triệu token đầu ra. Biến thể Fast, có tốc độ xuất nội dung nhanh gấp đôi, có giá tương ứng 4 USD và 12 USD. Trên Cursor, mức giá Fast đối với phần ngữ cảnh vượt 256.000 token là 6 USD cho đầu vào và 18 USD cho đầu ra.
Mô hình hiện được cung cấp qua Cursor, Grok Build, Grok API, các công cụ hỗ trợ lập trình của bên thứ ba, bộ định tuyến mô hình và nền tảng đám mây.
xAI công bố điểm lập trình cải thiện
Trong bảng đánh giá do xAI đưa ra, Grok 4.7 đạt 46,3% trên CursorBench 4.0, 64% trên EEBench, 1.657 điểm ở AA Briefcase v1.1, 37,6% trên Terminal-Bench 4.0 và 19,6% ở Harvey Legal Agent. Các kết quả tương ứng của Grok 4.6 lần lượt là 40,4%, 53%, 1.546 điểm, 20,3% và 15,8%.
So với Fable 5.1, Grok 4.7 đạt kết quả thấp hơn ở CursorBench 4.0, AA Briefcase v1.1 và Terminal-Bench 4.0, nhưng cao hơn tại EEBench và Harvey Legal Agent.
Ở bài DeepSWE v1.1 với mức suy luận high, Grok 4.7 đạt 71%, vượt Grok 4.6 với 65,2% và Fable 5.1 với 70%, nhưng thấp hơn GPT-5.6 Sol ở mức 72,7%. Trong HealthBench Professional, Grok 4.7 đạt 56,7%, so với 60,5% của GPT-5.6 Sol và 62,1% của Fable 5.1.
Đánh giá độc lập cho thấy tốc độ còn thấp
Artificial Analysis chấm Grok 4.7 ở thiết lập xhigh đạt 46 điểm Intelligence Index, đứng thứ 21 trong số 212 mô hình. Tốc độ đầu ra được đo ở mức 39,2 token mỗi giây, thấp hơn mức trung vị 71 token mỗi giây của nhóm so sánh. Thời gian chờ token đầu tiên là 0,87 giây.
Tổ chức này ghi nhận mức giá 2 USD cho mỗi triệu token đầu vào, 6 USD cho đầu ra và mức giảm giá bộ nhớ đệm 75%. Chi phí có trọng số cho mỗi tác vụ Intelligence Index là 3,74 USD.
Theo VentureBeat, ở thiết lập xHigh, Grok 4.7 sử dụng khoảng 81.000 token đầu ra cho mỗi tác vụ, nhiều hơn 196% so với GPT-6 Astra. Chi phí khoảng 3,74 USD mỗi tác vụ cũng cao hơn mức 1,99 USD của GPT-5.6 Sol.
Kết quả Terminal-Bench chênh lệch giữa các đơn vị
Vals AI xếp Grok 4.7 thứ 10 trong 59 mô hình với Vals Index 60,22%, cao hơn Grok 4.6 ở mức 59,17% và Grok 4.5 ở mức 51,53%. Chi phí cho mỗi lượt kiểm tra là 11,92 USD.
Trong các bài đánh giá thành phần, mô hình đạt 89,38% ở MedScribe, đứng thứ 4 trong 96 mô hình; 28,28% ở Terminal-Bench 4.0, đứng thứ 4 trong 31 mô hình; và 86,17% ở Vibe Code Bench, đứng thứ 5 trong 97 mô hình. Kết quả tại ProofBench và SAGE tương đối yếu hơn.
Điểm Terminal-Bench 4.0 có khác biệt đáng kể tùy nguồn và thiết lập. xAI công bố mức 37,6%, trong khi Vals AI đo được 28,28%. VentureBeat nêu các mức 38% và 26% ở thiết lập xHigh, còn The Decoder ghi nhận Grok 4.7 đạt 26%, so với 60% của GPT-6 Astra và 55% của Claude Fable 5.1.
GitHub bắt đầu triển khai trên Copilot
GitHub đang từng bước đưa Grok 4.7 tới người dùng các gói Copilot Pro, Pro+, Max, Business và Enterprise. Mô hình được triển khai trên VS Code, Visual Studio, Copilot CLI, tác nhân đám mây của GitHub, JetBrains, Xcode và Eclipse.
Nhận xét
Đăng nhận xét