Gemini 3.5 Flash-Lite
Gemini 3.5 Flash-Lite est un LLM propriétaire de Google, sorti le 21 juillet 2026. Ses connaissances couvrent les informations disponibles jusqu’au 31 mars 2026. Sa principale caractéristique est une fenêtre de contexte de 1 048 576 tokens, soit environ un million.
Gemini 3.5 Flash-Lite est un LLM propriétaire de Google, sorti le 21 juillet 2026. Ses connaissances couvrent les informations disponibles jusqu’au 31 mars 2026. Sa principale caractéristique est une fenêtre de contexte de 1 048 576 tokens, soit environ un million.
Le modèle associe ce contexte étendu à un positionnement très économique. Sa tarification se situe 86% sous la moyenne des LLM similaires et environ 18,3 fois sous celle des modèles frontière. Dans Arena text, il se place dans le premier quart du classement, sans atteindre les toutes premières positions.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | |
| Poids | 🔒 Propriétaire |
| Date de sortie | 21 juillet 2026 |
| Connaissances jusqu'à | 2026-03-31 |
| Multimodal | oui |
| Fenêtre de contexte | 1 048 576 tokens (≈ 1,0 M) |
| Modalités (entrée → sortie) | text,image,audio,video → text |
Performances (benchmarks)
| Benchmark | Score | Rang (LLM) | Source | Fiabilité |
|---|---|---|---|---|
| Benchable : General Knowledge (Baseline) | 100,0 % | 1ᵉ / 258 | benchable | ✅ Mesuré |
| Benchable : Ethics (Baseline) | 100,0 % | 1ᵉ / 257 | benchable | ✅ Mesuré |
| Benchable : Hallucinations (Baseline) | 98,0 % | 71ᵉ / 239 | benchable | ✅ Mesuré |
| Benchable : Email Classification (Baseline) | 97,0 % | 169ᵉ / 263 | benchable | ✅ Mesuré |
| Benchable : Mathematics (Baseline) | 96,0 % | 13ᵉ / 230 | benchable | ✅ Mesuré |
| Benchable : Coding (Baseline) | 93,0 % | 70ᵉ / 259 | benchable | ✅ Mesuré |
| Benchable : Reasoning (Baseline) | 82,0 % | 125ᵉ / 249 | benchable | ✅ Mesuré |
| Benchable : Instruction Following (Baseline) | 70,0 % | 104ᵉ / 261 | benchable | ✅ Mesuré |
| CharXiv-R | 76,5 % | 29ᵉ / 47 | llm-stats | Auto-déclaré |
| OSWorld-Verified | 74,0 % | 11ᵉ / 21 | llm-stats | Auto-déclaré |
| SWE-Bench Pro | 54,2 % | 33ᵉ / 43 | llm-stats | Auto-déclaré |
| Terminal-Bench 2.1 | 54,0 % | 15ᵉ / 15 | llm-stats | Auto-déclaré |
| GDPval-AA | 38,0 % | 31ᵉ / 42 | llm-stats | Auto-déclaré |
| MRCR v2 (8-needle) | 21,3 % | 18ᵉ / 21 | llm-stats | Auto-déclaré |
« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.
Comment se situe-t-il ?
Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.
Benchable : General Knowledge (Baseline)
Benchable : Ethics (Baseline)
Classements Arena (Elo)
Arena Text · 200 modèles classés
| Rang | Modèle | Elo |
|---|---|---|
| 1ᵉ | Claude Fable 5 | 1507 |
| 2ᵉ | Claude Opus 4.6 | 1505 |
| 3ᵉ | Claude Opus 4.7 | 1502 |
| ⋯ | ⋯ | |
| 41ᵉ | Qwen3.7-Plus | 1460 |
| 42ᵉ | Grok-4.1 | 1459 |
| 43ᵉ | Gemini 3.5 Flash-Lite | 1459 |
| 44ᵉ | Gemini 3 Flash | 1459 |
| 45ᵉ | GLM-5 | 1457 |
Tarifs
| Fournisseur | Entrée / 1M | Sortie / 1M | Cache lecture / 1M |
|---|---|---|---|
| 0,3 $ | 2,5 $ | n.d. | |
| Google AI Studio | 0,3 $ | 2,5 $ | 0,03 $ |
Prix en dollars US par million de tokens.
Sa tarification se situe 86 % en dessous de la moyenne des LLM similaires, et 18,3 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).
Coût & vitesse agentiques
| Indicateur | Valeur |
|---|---|
| Coût moyen par benchmark — Benchable | 0,02 $ |
| Latence moyenne par benchmark — Benchable | 1 min 52 s |
Coûts et durées réels mesurés en exécutant le modèle comme agent. PinchBench = un run complet de 147 tâches (harness OpenClaw) ; Benchable = moyenne par benchmark. Sources : PinchBench, Benchable.ai.
Notre analyse
Forces. Mathematics constitue son meilleur classement relatif dans les évaluations Benchable, même si ce benchmark plafonné reste peu discriminant. Gemini 3.5 Flash-Lite occupe aussi le 43e rang sur 200 dans Arena text. Il se place derrière Claude Fable 5, Claude Opus 4.6 et Claude Opus 4.7. L’écart avec Claude Fable 5 reste faible, les deux modèles sont proches en duel. Son principal avantage concret demeure son rapport entre une fenêtre d’environ un million de tokens et des tarifs très inférieurs à ceux des LLM comparables.
Limites et points d’attention. Les scores Benchable élevés doivent être relativisés. General Knowledge et Ethics partagent leur première place avec respectivement 74 et 119 autres modèles, ce qui empêche de distinguer réellement leurs performances. Email Classification apparaît en retrait du classement, tandis que Coding et Hallucinations restent loin des premières places malgré des scores bruts élevés. Le modèle est par ailleurs propriétaire. Il reste pertinent pour les traitements nécessitant un contexte très étendu avec un budget limité. Pour une meilleure préférence humaine en génération de texte, Claude Fable 5, Claude Opus 4.6 ou Claude Opus 4.7 sont mieux classés.
Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai) · Arena.ai (arena.ai) · Benchable.ai (benchable.ai).