Llama 3.2 90B Instruct

Publié par Meta le 25 septembre 2024, Llama 3.2 90B Instruct est un LLM open-weights de 90 milliards de paramètres, sous licence Llama 3.2 avec usage commercial autorisé. Sa fenêtre de contexte atteint 131 072 tokens et ses connaissances s’arrêtent au 31 décembre 2023.

Publié par Meta le 25 septembre 2024, Llama 3.2 90B Instruct est un LLM open-weights de 90 milliards de paramètres, sous licence Llama 3.2 avec usage commercial autorisé. Sa fenêtre de contexte atteint 131 072 tokens et ses connaissances s’arrêtent au 31 décembre 2023.

Près de deux ans après sa sortie, il appartient déjà à une génération ancienne à l’échelle de l’IA. À son lancement, son résultat sur GPQA le plaçait dans le top 44 % des 34 LLM contemporains étudiés, soit une position honorable sans figurer parmi les références dominantes de sa période.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurMeta
Poids🟢 Poids ouverts · usage commercial autorisé
LicenceLlama 3.2
Date de sortie25 septembre 2024
Multimodaloui
Paramètres90 milliards
Fenêtre de contexte128 000 tokens
Modalités (entrée → sortie)text,image → text

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
AI2D92,3 %10ᵉ / 32llm-statsAuto-déclaré
DocVQA90,1 %19ᵉ / 26llm-statsAuto-déclaré
MGSM86,9 %13ᵉ / 30llm-statsAuto-déclaré
MMLU86,0 %31ᵉ / 98llm-statsAuto-déclaré
ChartQA85,5 %13ᵉ / 24llm-statsAuto-déclaré
VQAv278,1 %3ᵉ / 3llm-statsAuto-déclaré
TextVQA73,5 %11ᵉ / 15llm-statsAuto-déclaré
MATH68,0 %43ᵉ / 70llm-statsAuto-déclaré
MMMU60,3 %42ᵉ / 61llm-statsAuto-déclaré
MathVista57,3 %28ᵉ / 38llm-statsAuto-déclaré
GPQA46,7 %172ᵉ / 219llm-statsAuto-déclaré
MMMU-Pro45,2 %59ᵉ / 64llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Notre analyse

Forces. Llama 3.2 90B Instruct associe un grand volume de paramètres à une fenêtre de contexte de 131 072 tokens, deux caractéristiques marquantes lors de sa sortie. Son classement dans le top 44 % sur GPQA, benchmark consacré aux questions scientifiques complexes, le situait dans la moitié supérieure des LLM de sa génération, sans atteindre le groupe de tête. Sa licence open-weights autorise l’usage commercial, un positionnement qui distingue ce modèle des offres dont les poids ne sont pas ouverts. Les informations disponibles reposent sur deux sources concordantes.

Limites et points d’attention. Son ancienneté constitue désormais sa principale faiblesse. Après près de deux ans, ses performances sont probablement dépassées par celles de modèles plus récents, et les modèles de cette période sont souvent retirés des catalogues de leur éditeur. Son niveau sur GPQA était déjà intermédiaire à sa sortie plutôt que dominant. La limite de connaissances au 31 décembre 2023 réduit aussi la pertinence des réponses portant sur des événements ou évolutions ultérieurs. Enfin, ses 90 milliards de paramètres en font un modèle particulièrement volumineux, tandis que sa licence reste encadrée par les conditions propres à Llama 3.2.


Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai).