Grok 4 Fast

Grok 4 Fast est un LLM propriétaire de xAI, lancé le 28 août 2025. Il se distingue par un positionnement très économique et par une fenêtre de contexte de 2 millions de tokens, conçue pour absorber de très grands volumes de texte au sein d’une même requête.

Grok 4 Fast est un LLM propriétaire de xAI, lancé le 28 août 2025. Il se distingue par un positionnement très économique et par une fenêtre de contexte de 2 millions de tokens, conçue pour absorber de très grands volumes de texte au sein d’une même requête.

À sa sortie, le modèle figurait dans le top 3 % des LLM de sa génération sur GPQA. Son principal attrait réside toutefois dans son rapport entre coût, contexte et performances générales : sa tarification se situe 90 % sous la moyenne des modèles similaires et environ 27,5 fois sous celle des modèles frontière.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurxAI
Poids🔒 Propriétaire
Date de sortie28 août 2025
Multimodaloui
Fenêtre de contexte2 000 000 tokens (≈ 2,0 M)
Modalités (entrée → sortie)text,image → text

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
SimpleQA95,0 %2ᵉ / 45llm-statsAuto-déclaré
HMMT 202593,3 %12ᵉ / 33llm-statsAuto-déclaré
AIME 202592,0 %35ᵉ / 108llm-statsAuto-déclaré
GPQA85,7 %42ᵉ / 219llm-statsAuto-déclaré
LiveCodeBench80,0 %9ᵉ / 72llm-statsAuto-déclaré
BrowseComp44,9 %47ᵉ / 57llm-statsAuto-déclaré
Humanity's Last Exam20,0 %56ᵉ / 89llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Classements Arena (Elo)

Arena Text · 200 modèles classés

RangModèleElo
1ᵉClaude Fable 51507
2ᵉClaude Opus 4.61504
3ᵉClaude Opus 4.71503
120ᵉQwen3.5-27B1409
121ᵉGemini 2.5 Flash Preview1404
122ᵉGrok 4 Fast1404
123ᵉGPT-5.4 nano1404
124ᵉQwen3 235B A22B1403

Arena Code · 99 modèles classés

RangModèleElo
1ᵉKimi K31679
2ᵉClaude Fable 51631
3ᵉGPT-5.6 Sol1618
95ᵉgranite-4.1-8b1199
96ᵉMercury 21164
97ᵉGrok 4 Fast1150
98ᵉGrok Code Fast 11140
99ᵉdevstral-medium-25071092

Tarifs

FournisseurEntrée / 1MSortie / 1MCache lecture / 1M
xai0,2 $0,5 $n.d.

Prix en dollars US par million de tokens.

Sa tarification se situe 90 % en dessous de la moyenne des LLM similaires, et 27,5 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).

Notre analyse

Forces. Grok 4 Fast s’est placé, lors de sa sortie, dans le haut du panier de sa génération sur GPQA, un résultat notable parmi 132 LLM contemporains. Sa fenêtre de contexte de 2 millions de tokens constitue un autre point fort concret pour les traitements nécessitant de regrouper beaucoup de contenu. Son tarif d’entrée de 0.2 $ par million de tokens et de sortie de 0.5 $ par million le classe parmi les options très économiques. Ce niveau de prix, nettement inférieur à celui des LLM similaires et des modèles frontière, favorise les usages à fort volume.

Limites et points d’attention. Les résultats Arena nuancent fortement le classement obtenu sur GPQA. En Arena text, Grok 4 Fast se situe dans la seconde moitié du classement. En Arena Code, il apparaît presque en dernière position, ce qui en fait un choix peu compétitif au regard de cette évaluation du code. Ses poids ne sont pas ouverts, la licence propriétaire exclut donc un déploiement fondé sur leur modification directe. Grok 4 Fast convient surtout aux usages sensibles au coût et exigeant un contexte très étendu, plutôt qu’aux tâches où les performances en code constituent le critère prioritaire.


Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai) · Arena.ai (arena.ai).