Qwen2.5-Coder 7B Instruct

Qwen2.5-Coder 7B Instruct est un LLM open-weights publié par Qwen en septembre 2024. Conçu comme une déclinaison Coder au format Instruct, il associe 7 milliards de paramètres à une fenêtre de contexte particulièrement étendue. Sa licence Apache 2.0 autorise les usages commerciaux.

Qwen2.5-Coder 7B Instruct est un LLM open-weights publié par Qwen en septembre 2024. Conçu comme une déclinaison Coder au format Instruct, il associe 7 milliards de paramètres à une fenêtre de contexte particulièrement étendue. Sa licence Apache 2.0 autorise les usages commerciaux.

Âgé d’environ deux ans, le modèle appartient déjà à une génération ancienne à l’échelle de l’IA. Il doit donc être comparé aux modèles disponibles lors de sa sortie, plutôt qu’aux systèmes actuels. Ses connaissances s’arrêtent au 30 juin 2024, une limite importante pour les sujets techniques ayant évolué depuis.

Caractéristiques

CaractéristiqueValeur
TypeGrand modèle de langage (LLM)
ÉditeurAlibaba Cloud / Qwen Team
Poids🟢 Poids ouverts · usage commercial autorisé
LicenceApache 2.0
Date de sortie19 septembre 2024
Multimodalnon
Paramètres7 milliards
Fenêtre de contexte131 072 tokens
Modalités (entrée → sortie)text → text

Performances (benchmarks)

BenchmarkScoreRang (LLM)SourceFiabilité
HumanEval88,4 %20ᵉ / 65llm-statsAuto-déclaré
GSM8k83,9 %35ᵉ / 47llm-statsAuto-déclaré
MBPP83,5 %9ᵉ / 33llm-statsAuto-déclaré
HellaSwag76,8 %21ᵉ / 27llm-statsAuto-déclaré
Winogrande72,9 %15ᵉ / 22llm-statsAuto-déclaré
MMLU67,6 %87ᵉ / 98llm-statsAuto-déclaré
MMLU-Redux66,6 %46ᵉ / 48llm-statsAuto-déclaré
ARC-C60,9 %30ᵉ / 34llm-statsAuto-déclaré
Aider55,6 %3ᵉ / 4llm-statsAuto-déclaré
TruthfulQA50,6 %17ᵉ / 18llm-statsAuto-déclaré
MATH46,6 %60ᵉ / 70llm-statsAuto-déclaré
MMLU-Pro40,1 %123ᵉ / 125llm-statsAuto-déclaré
TheoremQA34,0 %5ᵉ / 6llm-statsAuto-déclaré
LiveCodeBench18,2 %65ᵉ / 72llm-statsAuto-déclaré

« Auto-déclaré » : score communiqué par l'éditeur, non rejoué indépendamment. « Mesuré » : évalué par un tiers (Epoch AI, LiveBench). Le rang est calculé parmi les LLM évalués sur le même benchmark.

Notre analyse

Forces. Qwen2.5-Coder 7B Instruct combine un format de 7 milliards de paramètres avec une fenêtre de contexte de 131 072 tokens, caractéristique utile pour traiter de longs contenus dans une même requête. Son statut open-weights et sa licence Apache 2.0 rendent possible un usage commercial. À sa sortie, son résultat sur MATH le plaçait dans le top 78 % des 36 LLM de sa génération. Ce classement ne le situait pas parmi les meilleurs en raisonnement mathématique, mais fournit un repère concret sur son niveau dans le paysage de 2024.

Limites et points d'attention. Son ancienneté est désormais très importante pour un LLM. Ses performances sont probablement largement dépassées par celles de modèles plus récents, et les modèles de cette période sont souvent retirés du catalogue de leur éditeur. La limite de connaissances fixée au 30 juin 2024 exclut les évolutions ultérieures. Son positionnement relativement bas sur MATH dès sa sortie invite aussi à ne pas le considérer comme une référence de sa génération pour le raisonnement mathématique.


Sources des données : LLM-Stats (llm-stats.com) · OpenRouter (openrouter.ai).