Gemini 2.0 Flash
Gemini 2.0 Flash est un LLM propriétaire de Google, lancé le 21 janvier 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles plus récents et susceptible d’avoir été retirée du catalogue de l’éditeur.
Gemini 2.0 Flash est un LLM propriétaire de Google, lancé le 21 janvier 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles plus récents et susceptible d’avoir été retirée du catalogue de l’éditeur.
Son positionnement repose sur une fenêtre de contexte d’environ un million de tokens et un coût très économique. Ses connaissances s’arrêtent au 1er août 2024 et ses poids ne sont pas ouverts. À sa sortie, ses résultats scientifiques le plaçaient néanmoins dans le haut du panier des modèles de sa génération.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | |
| Poids | 🔒 Propriétaire |
| Date de sortie | 21 janvier 2025 |
| Connaissances jusqu'à | 2024-08-01 |
| Multimodal | oui |
| Fenêtre de contexte | 1 048 576 tokens (≈ 1,0 M) |
| Modalités (entrée → sortie) | text,image → text |
Indices de synthèse
| Indice | Valeur | Rang (LLM) |
|---|---|---|
| Intelligence Index | 12.3 | 121ᵉ / 137 |
| Math Index | 21.7 | 43ᵉ / 54 |
Indices Artificial Analysis. Le rang situe le modèle parmi tous les LLM du catalogue disposant de l'indice.
Performances (benchmarks)
| Benchmark | Score | Rang (LLM) | Source | Fiabilité |
|---|---|---|---|---|
| Natural2Code | 92,9 % | 1ᵉ / 8 | llm-stats | Auto-déclaré |
| MATH | 89,7 % | 5ᵉ / 70 | llm-stats | Auto-déclaré |
| FACTS Grounding | 83,6 % | 4ᵉ / 13 | llm-stats | Auto-déclaré |
| MMLU-Pro | 76,4 % | 64ᵉ / 125 | llm-stats | Auto-déclaré |
| AIME 2024 | 73,3 % | 36ᵉ / 52 | llm-stats | Auto-déclaré |
| EgoSchema | 71,5 % | 5ᵉ / 9 | llm-stats | Auto-déclaré |
| MMMU | 70,7 % | 27ᵉ / 61 | llm-stats | Auto-déclaré |
| MRCR | 69,2 % | 4ᵉ / 7 | llm-stats | Auto-déclaré |
| HiddenMath | 63,0 % | 1ᵉ / 13 | llm-stats | Auto-déclaré |
| GPQA | 62,1 % | 143ᵉ / 219 | llm-stats | Auto-déclaré |
| Bird-SQL (dev) | 56,9 % | 2ᵉ / 7 | llm-stats | Auto-déclaré |
| Vibe-Eval | 56,3 % | 4ᵉ / 8 | llm-stats | Auto-déclaré |
| CoVoST2 | 39,2 % | 2ᵉ / 4 | llm-stats | Auto-déclaré |
| LiveCodeBench | 35,1 % | 52ᵉ / 72 | llm-stats | Auto-déclaré |
« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.
Comment se situe-t-il ?
Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.
Intelligence Index
Math Index
Notre analyse
Forces. À sa sortie, Gemini 2.0 Flash figurait dans le top 11% des LLM de sa génération sur GPQA diamond, consacré aux questions scientifiques de niveau doctorat. Son résultat sur MATH level 5 était également solide, avec un classement dans le premier tiers des modèles évalués. Sa fenêtre de contexte de 1 048 576 tokens constitue un autre atout notable. Le modèle se distingue surtout par son prix, inférieur de 92% à la moyenne des LLM similaires et environ 36,7 fois moins élevé que celui des modèles frontière.
Limites et points d’attention. Les classements actuels situent Gemini 2.0 Flash près du bas du tableau sur l’Intelligence Index et dans la partie basse sur le Math Index. Les résultats en mathématiques avancées se dégradent fortement avec la difficulté : la performance reste limitée sur les olympiades de niveau lycée et devient presque nulle sur FrontierMath, consacré aux problèmes de recherche. Son score sur GPQA diamond se place désormais dans la seconde moitié du classement. Son ancienneté rend ses performances largement dépassées, tandis que sa disponibilité chez l’éditeur peut désormais être réduite. La coupure des connaissances en août 2024 limite aussi son actualité factuelle.
Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai) · Artificial Analysis (artificialanalysis.ai) · Epoch AI (epoch.ai), CC-BY-4.0.