Gemini 1.5 Pro

Gemini 1.5 Pro est un LLM propriétaire de Google, lancé le 1 mai 2024 aux États-Unis. Âgé d’environ deux ans, il appartient déjà à une génération ancienne à l’échelle de l’IA, où le renouvellement des modèles est particulièrement rapide.

Gemini 1.5 Pro est un LLM propriétaire de Google, lancé le 1 mai 2024 aux États-Unis. Âgé d’environ deux ans, il appartient déjà à une génération ancienne à l’échelle de l’IA, où le renouvellement des modèles est particulièrement rapide.

Sa caractéristique majeure reste sa fenêtre de contexte de 2 097 152 tokens, soit environ 2,1 millions. Ses connaissances s’arrêtent au 1er novembre 2023. Les résultats concordants de trois sources permettent surtout d’évaluer sa place historique parmi les modèles de sa période, plutôt que sa compétitivité actuelle.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurGoogle
Poids🔒 Propriétaire
Date de sortie1 mai 2024
Connaissances jusqu'à2023-11-01
Multimodaloui
Fenêtre de contexte2 097 152 tokens (≈ 2,1 M)
Modalités (entrée → sortie)text,image → text

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
XSTest98,8 %1ᵉ / 3llm-statsAuto-déclaré
FLEURS93,3 %3ᵉ / 6llm-statsAuto-déclaré
HellaSwag93,3 %3ᵉ / 27llm-statsAuto-déclaré
GSM8k90,8 %25ᵉ / 47llm-statsAuto-déclaré
BIG-Bench Hard89,2 %2ᵉ / 20llm-statsAuto-déclaré
MGSM87,5 %11ᵉ / 30llm-statsAuto-déclaré
MATH86,5 %10ᵉ / 70llm-statsAuto-déclaré
MMLU85,9 %33ᵉ / 98llm-statsAuto-déclaré
Natural2Code85,4 %2ᵉ / 8llm-statsAuto-déclaré
HumanEval84,1 %38ᵉ / 65llm-statsAuto-déclaré
MRCR82,6 %2ᵉ / 7llm-statsAuto-déclaré
Video-MME78,6 %9ᵉ / 17llm-statsAuto-déclaré
MMLU-Pro75,8 %67ᵉ / 125llm-statsAuto-déclaré
WMT2375,1 %1ᵉ / 4llm-statsAuto-déclaré
DROP74,9 %19ᵉ / 29llm-statsAuto-déclaré
MathVista68,1 %17ᵉ / 38llm-statsAuto-déclaré
MMMU65,9 %36ᵉ / 61llm-statsAuto-déclaré
GPQA59,1 %147ᵉ / 219llm-statsAuto-déclaré
Vibe-Eval53,9 %5ᵉ / 8llm-statsAuto-déclaré
HiddenMath52,0 %5ᵉ / 13llm-statsAuto-déclaré
AMC_2022_2346,4 %5ᵉ / 6llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Entraînement & empreinte

IndicateurValeur
Jeu de donnéesUnspecified unreleased
MatérielGoogle TPU v4
PaysUnited States of America

Notre analyse

Forces. À sa sortie, Gemini 1.5 Pro figurait dans le top 4% des LLM de sa génération sur GPQA diamond, un benchmark de questions scientifiques de niveau doctorat. Ce positionnement le plaçait alors dans le haut du panier pour le raisonnement scientifique. Son résultat sur MATH level 5 demeure son meilleur signal parmi les évaluations fournies, avec une place dans la première moitié du classement. Sa fenêtre de contexte d’environ 2,1 millions de tokens constituait également une caractéristique distinctive, en autorisant une quantité de contexte particulièrement élevée.

Limites et points d’attention. Les classements élargis montrent le recul du modèle face à des générations plus récentes. Sur GPQA diamond, il se situe désormais dans la seconde moitié du tableau. Son résultat à OTIS Mock AIME 2024-2025, consacré aux olympiades de mathématiques de niveau lycée, est plus faible encore et le place nettement derrière les meilleurs modèles évalués. Après environ deux ans, ses performances sont probablement largement dépassées par les modèles haut de gamme actuels, et un modèle de cet âge est souvent retiré du catalogue de son éditeur. Sa licence propriétaire signifie enfin que ses poids ne sont pas ouverts.


Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai) · Epoch AI (epoch.ai), CC-BY-4.0.