Granite 3.3 8B Base

Sorti le 16 avril 2025, Granite 3.3 8B Base est déjà ancien à l’échelle de l’IA. Ce LLM dense de 8 milliards de paramètres signé IBM appartient désormais à une génération probablement dépassée, souvent retirée des catalogues au profit de modèles plus récents.

Sorti le 16 avril 2025, Granite 3.3 8B Base est déjà ancien à l’échelle de l’IA. Ce LLM dense de 8 milliards de paramètres signé IBM appartient désormais à une génération probablement dépassée, souvent retirée des catalogues au profit de modèles plus récents.

Son positionnement reste néanmoins distinctif : une fenêtre de contexte de 128K tokens, douze langues prises en charge et un mode Fill-in-the-Middle adapté à la complétion de contenu entre un préfixe et un suffixe, notamment dans le code. Ses poids ouverts sous licence Apache 2.0 autorisent les usages commerciaux.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurIBM
Poids🟢 Poids ouverts · usage commercial autorisé
LicenceApache 2.0
Date de sortie16 avril 2025
Connaissances jusqu'à2024-04-01
Multimodaloui
Paramètres8 milliards

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
HumanEval89,7 %12ᵉ / 65llm-statsAuto-déclaré
AttaQ88,5 %1ᵉ / 3llm-statsAuto-déclaré
HumanEval+86,1 %3ᵉ / 10llm-statsAuto-déclaré
AIME 202481,2 %24ᵉ / 52llm-statsAuto-déclaré
HellaSwag80,1 %18ᵉ / 27llm-statsAuto-déclaré
TriviaQA78,2 %7ᵉ / 18llm-statsAuto-déclaré
IFEval74,8 %58ᵉ / 65llm-statsAuto-déclaré
Winogrande74,4 %14ᵉ / 22llm-statsAuto-déclaré
BIG-Bench Hard69,1 %12ᵉ / 20llm-statsAuto-déclaré
MATH-50069,0 %30ᵉ / 31llm-statsAuto-déclaré
MMLU63,9 %93ᵉ / 98llm-statsAuto-déclaré
AlpacaEval 2.062,7 %1ᵉ / 4llm-statsAuto-déclaré
GSM8k59,0 %46ᵉ / 47llm-statsAuto-déclaré
Arena Hard57,6 %14ᵉ / 26llm-statsAuto-déclaré
TruthfulQA52,1 %16ᵉ / 18llm-statsAuto-déclaré
ARC-C50,8 %33ᵉ / 34llm-statsAuto-déclaré
AGIEval49,3 %8ᵉ / 10llm-statsAuto-déclaré
DROP36,1 %28ᵉ / 29llm-statsAuto-déclaré
PopQA26,2 %1ᵉ / 3llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Notre analyse

Forces. À sa sortie, Granite 3.3 8B Base figurait dans le top 95% des 65 LLM de sa génération sur MMLU, qui évalue les connaissances et le raisonnement dans plusieurs domaines. Son architecture transformer decoder-only associe GQA, RoPE, MLP SwiGLU, RMSNorm et des embeddings d’entrée et de sortie partagés. Sa fenêtre de 128K tokens convient aux tâches sur de longs contenus. Le modèle couvre le résumé, la classification, l’extraction, la question-réponse et les traitements text-to-text. Le Fill-in-the-Middle ajoute une capacité de génération conditionnée simultanément par un début et une fin de séquence. La prise en charge inclut notamment le français, l’anglais, l’allemand, l’espagnol, l’arabe, le japonais, le coréen et le chinois.

Limites et points d’attention. Près d’un an après sa sortie, ses performances sont largement dépassées par celles des générations plus récentes, une ancienneté très importante dans ce secteur. Les modèles de cette période sont aussi fréquemment retirés du catalogue de leur éditeur. Sa limite de connaissances fixée au 1er avril 2024 exclut les événements et évolutions ultérieurs. Enfin, son classement MMLU le situe dans sa période de lancement, sans constituer un indicateur de compétitivité face aux modèles actuels.


Sources des données : LLM-Stats (llm-stats.com).