Gemini 2.0 Flash

Gemini 2.0 Flash est un LLM propriétaire de Google, lancé le 21 janvier 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles plus récents et susceptible d’avoir été retirée du catalogue de l’éditeur.

Gemini 2.0 Flash est un LLM propriétaire de Google, lancé le 21 janvier 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles plus récents et susceptible d’avoir été retirée du catalogue de l’éditeur.

Son positionnement repose sur une fenêtre de contexte d’environ un million de tokens et un coût très économique. Ses connaissances s’arrêtent au 1er août 2024 et ses poids ne sont pas ouverts. À sa sortie, ses résultats scientifiques le plaçaient néanmoins dans le haut du panier des modèles de sa génération.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurGoogle
Poids🔒 Propriétaire
Date de sortie21 janvier 2025
Connaissances jusqu'à2024-08-01
Multimodaloui
Fenêtre de contexte1 048 576 tokens (≈ 1,0 M)
Modalités (entrée → sortie)text,image → text

Indices de synthèse

IndiceValeurRang (LLM)
Intelligence Index12.3121ᵉ / 137
Math Index21.743ᵉ / 54

Indices Artificial Analysis. Le rang situe le modèle parmi tous les LLM du catalogue disposant de l'indice.

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
Natural2Code92,9 %1ᵉ / 8llm-statsAuto-déclaré
MATH89,7 %5ᵉ / 70llm-statsAuto-déclaré
FACTS Grounding83,6 %4ᵉ / 13llm-statsAuto-déclaré
MMLU-Pro76,4 %64ᵉ / 125llm-statsAuto-déclaré
AIME 202473,3 %36ᵉ / 52llm-statsAuto-déclaré
EgoSchema71,5 %5ᵉ / 9llm-statsAuto-déclaré
MMMU70,7 %27ᵉ / 61llm-statsAuto-déclaré
MRCR69,2 %4ᵉ / 7llm-statsAuto-déclaré
HiddenMath63,0 %1ᵉ / 13llm-statsAuto-déclaré
GPQA62,1 %143ᵉ / 219llm-statsAuto-déclaré
Bird-SQL (dev)56,9 %2ᵉ / 7llm-statsAuto-déclaré
Vibe-Eval56,3 %4ᵉ / 8llm-statsAuto-déclaré
CoVoST239,2 %2ᵉ / 4llm-statsAuto-déclaré
LiveCodeBench35,1 %52ᵉ / 72llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Comment se situe-t-il ?

Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.

Intelligence Index

▶ Gemini 2.0 Flash12.3

Math Index

DeepSeek V3.292.0
Nova 2.0 Pro Preview89.0
▶ Gemini 2.0 Flash21.7

Notre analyse

Forces. À sa sortie, Gemini 2.0 Flash figurait dans le top 11% des LLM de sa génération sur GPQA diamond, consacré aux questions scientifiques de niveau doctorat. Son résultat sur MATH level 5 était également solide, avec un classement dans le premier tiers des modèles évalués. Sa fenêtre de contexte de 1 048 576 tokens constitue un autre atout notable. Le modèle se distingue surtout par son prix, inférieur de 92% à la moyenne des LLM similaires et environ 36,7 fois moins élevé que celui des modèles frontière.

Limites et points d’attention. Les classements actuels situent Gemini 2.0 Flash près du bas du tableau sur l’Intelligence Index et dans la partie basse sur le Math Index. Les résultats en mathématiques avancées se dégradent fortement avec la difficulté : la performance reste limitée sur les olympiades de niveau lycée et devient presque nulle sur FrontierMath, consacré aux problèmes de recherche. Son score sur GPQA diamond se place désormais dans la seconde moitié du classement. Son ancienneté rend ses performances largement dépassées, tandis que sa disponibilité chez l’éditeur peut désormais être réduite. La coupure des connaissances en août 2024 limite aussi son actualité factuelle.


Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai) · Artificial Analysis (artificialanalysis.ai) · Epoch AI (epoch.ai), CC-BY-4.0.