Gemini 1.5 Flash

Gemini 1.5 Flash est un LLM propriétaire de Google, lancé le 1 mai 2024 avec des poids non ouverts. Sa caractéristique la plus marquante reste sa fenêtre de contexte de 1 048 576 tokens, soit environ un million, associée à des connaissances arrêtées au 1er novembre 2023.

Gemini 1.5 Flash est un LLM propriétaire de Google, lancé le 1 mai 2024 avec des poids non ouverts. Sa caractéristique la plus marquante reste sa fenêtre de contexte de 1 048 576 tokens, soit environ un million, associée à des connaissances arrêtées au 1er novembre 2023.

Près de deux ans après sa sortie, il appartient déjà à une génération ancienne à l’échelle de l’IA. Son intérêt est donc surtout historique et comparatif : il illustre le niveau atteint par les modèles Google de sa période, avant d’être probablement dépassé par des générations plus récentes.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurGoogle
Poids🔒 Propriétaire
Date de sortie1 mai 2024
Connaissances jusqu'à2023-11-01
Multimodaloui
Fenêtre de contexte1 048 576 tokens (≈ 1,0 M)
Modalités (entrée → sortie)text,image → text

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
XSTest97,0 %2ᵉ / 3llm-statsAuto-déclaré
FLEURS90,4 %5ᵉ / 6llm-statsAuto-déclaré
HellaSwag86,5 %9ᵉ / 27llm-statsAuto-déclaré
GSM8k86,2 %33ᵉ / 47llm-statsAuto-déclaré
BIG-Bench Hard85,5 %6ᵉ / 20llm-statsAuto-déclaré
MGSM82,6 %17ᵉ / 30llm-statsAuto-déclaré
Natural2Code79,8 %5ᵉ / 8llm-statsAuto-déclaré
MMLU78,9 %66ᵉ / 98llm-statsAuto-déclaré
MATH77,9 %22ᵉ / 70llm-statsAuto-déclaré
Video-MME76,1 %11ᵉ / 17llm-statsAuto-déclaré
HumanEval74,3 %50ᵉ / 65llm-statsAuto-déclaré
WMT2374,1 %2ᵉ / 4llm-statsAuto-déclaré
MRCR71,9 %3ᵉ / 7llm-statsAuto-déclaré
MMLU-Pro67,3 %89ᵉ / 125llm-statsAuto-déclaré
MathVista65,8 %22ᵉ / 38llm-statsAuto-déclaré
MMMU62,3 %40ᵉ / 61llm-statsAuto-déclaré
GPQA51,0 %158ᵉ / 219llm-statsAuto-déclaré
Vibe-Eval48,9 %7ᵉ / 8llm-statsAuto-déclaré
HiddenMath47,2 %6ᵉ / 13llm-statsAuto-déclaré
AMC_2022_2334,8 %6ᵉ / 6llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Notre analyse

Forces. À sa sortie, Gemini 1.5 Flash figurait dans le top 7 % des 28 LLM de sa génération sur GPQA diamond, consacré aux questions scientifiques de niveau doctorat. Ce positionnement le plaçait alors dans le haut du panier sur ce test exigeant. Son résultat de 62 % sur MATH level 5 montre aussi une capacité notable, pour sa période, à traiter des problèmes mathématiques complexes. Sa fenêtre d’environ un million de tokens constituait par ailleurs un trait distinctif majeur. Ces constats reposent sur trois sources de données concordantes.

Limites et points d’attention. Les évaluations plus difficiles révèlent des faiblesses nettes. Gemini 1.5 Flash n’obtient que 16 % sur OTIS Mock AIME 2024-2025, qui mesure des problèmes d’olympiades de mathématiques de niveau lycée. Il atteint 0 % sur les versions publique et privée de FrontierMath, consacrées aux mathématiques de recherche très difficiles, avec un classement proche du bas du tableau sur la version privée. Son rang actuel sur GPQA diamond est également nettement moins favorable que son positionnement initial. Désormais ancien, le modèle est probablement largement dépassé et peut ne plus figurer parmi les offres maintenues par l’éditeur.


Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai) · Epoch AI (epoch.ai), CC-BY-4.0.