Granite 3.3 8B Instruct
Granite 3.3 8B Instruct est un modèle de langage open-weights publié par IBM le 16 avril 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont probablement dépassées par celles des modèles plus récents.
Granite 3.3 8B Instruct est un modèle de langage open-weights publié par IBM le 16 avril 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont probablement dépassées par celles des modèles plus récents.
Ses 8 milliards de paramètres et sa fenêtre de contexte de 128 000 tokens visent un équilibre entre format contenu et traitement de longs contenus. Affiné pour le raisonnement et le suivi d’instructions, il couvre notamment la synthèse, l’extraction, le question-réponse, le RAG, le code, le function-calling et le dialogue multilingue.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | IBM |
| Poids | 🟢 Poids ouverts · usage commercial autorisé |
| Licence | Apache 2.0 |
| Date de sortie | 16 avril 2025 |
| Connaissances jusqu'à | 2024-04-01 |
| Multimodal | oui |
| Paramètres | 8 milliards |
| Fenêtre de contexte | 128 000 tokens |
| Modalités (entrée → sortie) | text → text |
Performances (benchmarks)
| Benchmark | Score | Rang (LLM) | Source | Fiabilité |
|---|---|---|---|---|
| HumanEval | 89,7 % | 12ᵉ / 65 | llm-stats | Auto-déclaré |
| AttaQ | 88,5 % | 1ᵉ / 3 | llm-stats | Auto-déclaré |
| HumanEval+ | 86,1 % | 3ᵉ / 10 | llm-stats | Auto-déclaré |
| AIME 2024 | 81,2 % | 24ᵉ / 52 | llm-stats | Auto-déclaré |
| GSM8k | 80,9 % | 37ᵉ / 47 | llm-stats | Auto-déclaré |
| IFEval | 74,8 % | 58ᵉ / 65 | llm-stats | Auto-déclaré |
| BIG-Bench Hard | 69,1 % | 12ᵉ / 20 | llm-stats | Auto-déclaré |
| MATH-500 | 69,0 % | 30ᵉ / 31 | llm-stats | Auto-déclaré |
| TruthfulQA | 66,9 % | 3ᵉ / 18 | llm-stats | Auto-déclaré |
| MMLU | 65,5 % | 89ᵉ / 98 | llm-stats | Auto-déclaré |
| AlpacaEval 2.0 | 62,7 % | 1ᵉ / 4 | llm-stats | Auto-déclaré |
| DROP | 59,4 % | 24ᵉ / 29 | llm-stats | Auto-déclaré |
| Arena Hard | 57,6 % | 14ᵉ / 26 | llm-stats | Auto-déclaré |
| PopQA | 26,2 % | 1ᵉ / 3 | llm-stats | Auto-déclaré |
« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.
Notre analyse
Forces. À sa sortie, Granite 3.3 8B Instruct se classait dans le top 91% sur MMLU parmi 65 LLM de sa génération. Sa fenêtre de 128 000 tokens constitue son principal atout technique pour les tâches à long contexte. Le modèle structure aussi ses réponses avec les balises <think> et <response>. Il prend en charge douze langues, dont le français, l’anglais, l’allemand, l’espagnol, l’arabe, le japonais, le coréen et le chinois. Sa licence Apache 2.0 autorise l’usage commercial et l’exploitation de ses poids ouverts.
Limites et points d’attention. Son classement MMLU à sa sortie ne le plaçait pas parmi l’élite de sa génération. Environ un an après sa publication, ses performances sont probablement largement dépassées par celles des modèles contemporains, et les modèles de cette ancienneté sont souvent retirés des catalogues des éditeurs. Ses connaissances s’arrêtent au 1er avril 2024, ce qui limite sa pertinence sur les événements et évolutions ultérieurs. Enfin, l’évaluation disponible repose sur une seule source de données concordante.
Sources des données : LLM-Stats (llm-stats.com).