Meta: Muse Spark 1.2 Meta: Muse Spark 1.2 est un LLM de Meta sorti le 5 août 2026. Il se caractérise par une fenêtre de contexte de 1 048 576 tokens, soit environ un million, et par un positionnement tarifaire très économique.
Qwen3.8 Max Qwen3.8 Max est un LLM propriétaire de Qwen, originaire de Chine et sorti le 2 août 2026. Il combine 2400 milliards de paramètres avec une fenêtre de contexte de 1 000 000 tokens, adaptée au traitement de très grands volumes de texte.
DeepSeek-V4-Flash-0731 DeepSeek-V4-Flash-0731 est un LLM de 304 milliards de paramètres publié par DeepSeek le 31 juillet 2026. Ses poids sont ouverts sous licence MIT et l’usage commercial est autorisé. Il associe une fenêtre de contexte d’environ un million de tokens à un positionnement tarifaire très…
Thinking Machines: Inkling Small Thinking Machines: Inkling Small est un LLM multimodal à poids ouverts, lancé le 30 juillet 2026. Sa fenêtre de contexte de 524 288 tokens et son positionnement très économique le destinent au traitement de volumes importants de texte, d’images et d’audio.
Claude Opus 5 Claude Opus 5 est un LLM propriétaire d’Anthropic, sorti le 24 juillet 2026. Positionné sur le segment premium, il se distingue par une fenêtre de contexte de 1 million de tokens et par des résultats de premier plan en mathématiques, en sciences et dans plusieurs arènes spécialisées.
ling-3.0-flash ling-3.0-flash est un LLM d’InclusionAI sorti le 23 juillet 2026. Son principal signe distinctif est son positionnement très économique : le tarif minimal annoncé est gratuit en entrée comme en sortie, soit 100% sous la moyenne des LLM similaires.
Gemini 3.6 Flash Gemini 3.6 Flash est un LLM propriétaire de Google, sorti le 21 juillet 2026. Il se distingue par une fenêtre de contexte de 1 048 576 tokens, soit environ un million, et par des connaissances arrêtées au 31 mars 2026.
Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite est un LLM propriétaire de Google, sorti le 21 juillet 2026. Ses connaissances couvrent les informations disponibles jusqu’au 31 mars 2026. Sa principale caractéristique est une fenêtre de contexte de 1 048 576 tokens, soit environ un million.
Meituan: LongCat 2.0 Sorti le 20 juillet 2026, Meituan: LongCat 2.0 est un LLM à poids ouverts qui mise sur une fenêtre de contexte d’environ 1,0 million de tokens, le code et les workflows agentiques. Son tarif se situe 86% sous la moyenne des LLM similaires.
Thinking Machines: Inkling Thinking Machines: Inkling est un LLM multimodal à poids ouverts, publié le 17 juillet 2026 par Thinking Machines. Sa fenêtre de contexte atteint 1 048 576 tokens. Son tarif très économique se situe 52% sous la moyenne des LLM similaires.
Grok 4.5 Grok 4.5 est un LLM propriétaire de xAI, sorti le 16 juillet 2026. Il se distingue par une fenêtre de contexte de 500 000 tokens et des connaissances arrêtées au 1er février 2026.
Kimi K3 Kimi K3 est un LLM agentique multimodal lancé le 16 juillet 2026 par le chinois Moonshot AI. Ses poids sont ouverts et l’usage commercial est autorisé sous Kimi K3 License. Son architecture Mixture-of-Experts compte 2 800 milliards de paramètres, dont 104 milliards activés, avec 16…
Kwaipilot: KAT-Coder-Air V2.5 Kwaipilot: KAT-Coder-Air V2.5 est un LLM de kwaipilot, sorti le 10 juillet 2026. Il se distingue par une fenêtre de contexte de 256 000 tokens et par un positionnement tarifaire très économique.
Kwaipilot: KAT-Coder-Pro V2.5 Kwaipilot: KAT-Coder-Pro V2.5 est un LLM orienté code, édité par kwaipilot et sorti le 10 juillet 2026. Il se caractérise par une fenêtre de contexte de 256 000 tokens et par un positionnement tarifaire très économique.
GPT-5.6 Luna GPT-5.6 Luna est un LLM propriétaire d’OpenAI, sorti le 9 juillet 2026. Il se caractérise par une fenêtre de contexte de 1 050 000 tokens, des résultats particulièrement élevés en mathématiques et un positionnement tarifaire très économique. Ses connaissances s’arrêtent au 16 février 2026.
OpenAI: GPT-5.6 Luna Pro OpenAI: GPT-5.6 Luna Pro est un LLM propriétaire lancé le 9 juillet 2026. Sa fenêtre de contexte de 1 050 000 tokens constitue son principal trait distinctif et autorise le traitement de très grands volumes de texte en entrée. Ses connaissances s'arrêtent au 16 février 2026.
GPT-5.6 Sol GPT-5.6 Sol est un LLM propriétaire d’OpenAI, lancé le 9 juillet 2026. Ce modèle premium se distingue par une fenêtre de contexte de 1 050 000 tokens et par son positionnement de premier plan en programmation, en mathématiques et dans les tâches agentiques.
OpenAI: GPT-5.6 Sol Pro OpenAI: GPT-5.6 Sol Pro est un LLM propriétaire lancé par OpenAI le 9 juillet 2026. Son positionnement premium repose surtout sur une fenêtre de contexte de 1 050 000 tokens, adaptée aux traitements qui nécessitent de conserver un volume particulièrement important d’informations dans une…
GPT-5.6 Terra GPT-5.6 Terra est un LLM propriétaire d’OpenAI sorti le 9 juillet 2026. À son lancement, il figurait dans le top 11 % des LLM de sa génération sur GPQA diamond. Sa fenêtre de contexte de 1 050 000 tokens constitue l’un de ses principaux traits distinctifs.
OpenAI: GPT-5.6 Terra Pro OpenAI: GPT-5.6 Terra Pro est un LLM propriétaire lancé par OpenAI le 9 juillet 2026. Sa principale caractéristique est une fenêtre de contexte de 1 050 000 tokens, soit environ 1,1 million. Ses connaissances s’arrêtent au 16 février 2026.
Muse Spark 1.1 Sorti le 9 juillet 2026, Muse Spark 1.1 est un LLM propriétaire de Meta. Il se distingue par une fenêtre de contexte d’environ 1,0 million de tokens et par un positionnement tarifaire très économique.
AionLabs: Aion-3.0 AionLabs: Aion-3.0 est un LLM d’Aion Labs sorti le 7 juillet 2026. Sa fenêtre de contexte de 131 072 tokens le destine au traitement de volumes de texte étendus.
AionLabs: Aion-3.0-Mini AionLabs: Aion-3.0-Mini est un LLM d’Aion Labs sorti le 7 juillet 2026. Sa fenêtre de contexte de 131 072 tokens le destine au traitement de longues séquences, avec un positionnement centré sur l’économie d’usage.
Hy3 Hy3 est un LLM instruct à poids ouverts lancé par Tencent le 6 juillet 2026. Distribué sous licence Apache 2.0, il autorise l’usage commercial. À sa sortie, ses résultats sur GPQA le plaçaient dans le top 10% des LLM de sa génération.
Claude Sonnet 5 Claude Sonnet 5 est un LLM propriétaire d’Anthropic, lancé le 30 juin 2026. Il associe une fenêtre de contexte de 1 000 000 tokens à un positionnement économique, avec des tarifs dans la moyenne des modèles similaires et nettement inférieurs à ceux des modèles frontière.
Seed 2.1 Pro Seed 2.1 Pro est un LLM propriétaire de ByteDance, sorti le 24 juin 2026. Ses poids ne sont pas ouverts, ce qui le positionne comme un modèle contrôlé par son éditeur plutôt que comme une base librement modifiable.
Seed 2.1 Turbo Seed 2.1 Turbo est un LLM propriétaire de ByteDance, sorti le 24 juin 2026. Ses poids ne sont pas ouverts, ce qui le place dans la catégorie des modèles contrôlés par leur éditeur.
Sakana: Fugu Ultra Sorti le 24 juin 2026, Sakana: Fugu Ultra est un LLM de Sakana AI au positionnement premium. Il se distingue surtout par une fenêtre de contexte de 1 million de tokens, adaptée au traitement de très longs contenus dans une même requête.
Nex AGI: Nex-N2-Mini Nex AGI: Nex-N2-Mini est un LLM à poids ouverts lancé par Nex AGI le 24 juin 2026. Post-entraîné à partir de Qwen3.5-35B-A3B-Base, il adopte un cadre agentique qui relie compréhension des exigences, planification, production de code, évaluation, débogage et itération.
gemini-3.1-flash-image gemini-3.1-flash-image est un LLM de Google évalué sur six domaines, du raisonnement au code, en passant par les connaissances générales, la classification d’e-mails et l’éthique. Son profil est contrasté : ses meilleurs classements concernent Reasoning et Coding, tandis que General…
GLM-5.2 GLM-5.2 est un LLM open-weights de Zhipu AI, publié le 16 juin 2026 sous licence MIT avec usage commercial autorisé. Ses 753 milliards de paramètres, dont 40 milliards actifs, s’accompagnent d’une fenêtre de contexte de 1 048 576 tokens, adaptée aux tâches à long horizon.
Kimi K2.7 Code Kimi K2.7 Code est un LLM agentique de Moonshot AI, spécialisé dans le code et les tâches longues d’ingénierie logicielle. Construit sur Kimi K2.6, il repose sur une architecture Mixture-of-Experts de 1000 milliards de paramètres, dont 32 milliards actifs, avec attention MLA, activation…
DiffusionGemma 26B-A4B DiffusionGemma 26B-A4B est un LLM open-weights de Google, publié le 10 juin 2026 sous licence Apache 2.0, avec usage commercial autorisé. Ses 25 milliards de paramètres reposent sur une architecture Mixture-of-Experts issue de Gemma 4 26B A4B.
Claude Fable 5 Claude Fable 5 est un LLM propriétaire d’Anthropic, lancé le 9 juin 2026 et positionné sur le segment premium. Ses poids ne sont pas ouverts. Il se caractérise par une fenêtre de contexte de 1 000 000 tokens, adaptée au traitement de volumes importants de texte dans une même requête.
North Mini Code 1.0 North Mini Code 1.0 est un LLM de Cohere spécialisé dans la génération de code, l’ingénierie logicielle agentique et les tâches de terminal. Publié le 9 juin 2026 sous licence Apache 2.0, il possède des poids ouverts et autorise les usages commerciaux.
Nex AGI: Nex-N2-Pro Nex AGI: Nex-N2-Pro est un LLM à poids ouverts publié le 8 juin 2026. Cette variante de Nex-N2 est post-entraînée sur la série Qwen3.5 et repose sur Qwen3.5-397B-A17B. Elle mobilise 17 milliards de paramètres actifs et accepte un contexte de 262 144 tokens.
Nemotron 3 Ultra (550B A55B) Nemotron 3 Ultra (550B A55B) est un LLM open-weights de NVIDIA, sorti le 4 juin 2026 sous licence OpenMDW v1.1, avec usage commercial autorisé. Ses 550 milliards de paramètres, dont 55 milliards actifs, reposent sur une architecture hybride Mamba2-Transformer LatentMoE avec Multi-Token…
MAI-Code-1-Flash MAI-Code-1-Flash est un LLM propriétaire de Microsoft, sorti le 2 juin 2026. Développé aux États-Unis, il se distingue par un positionnement dans le haut du classement de sa génération sur GPQA.
MAI-Thinking-1 MAI-Thinking-1 est un LLM propriétaire de Microsoft, sorti le 2 juin 2026. Avec 1000 milliards de paramètres, il se distingue d’abord par une taille particulièrement importante et par des poids non ouverts.
MiniMax M3 MiniMax M3 est un LLM multimodal natif lancé par MiniMax le 1 juin 2026. Entraîné conjointement sur le texte, l’image et la vidéo, il combine environ 428 milliards de paramètres au total avec 23 milliards de paramètres actifs. MiniMax Sparse Attention porte sa fenêtre de contexte à 1 048…
Qwen3.7-Plus Qwen3.7-Plus est un LLM propriétaire de Qwen, sorti le 31 mai 2026. Il se distingue par une fenêtre de contexte de 1 000 000 tokens, adaptée au traitement de volumes de texte particulièrement importants, et par des poids non ouverts.
Claude Opus 4.8 Claude Opus 4.8 est un LLM propriétaire d’Anthropic, lancé le 28 mai 2026. Positionné sur le segment premium, il se distingue par une fenêtre de contexte de 1 000 000 tokens et par des résultats de premier plan en raisonnement, en programmation et dans les tâches agentiques.
StepFun: Step 3.7 Flash Sorti le 28 mai 2026, StepFun: Step 3.7 Flash est un LLM vision-langage à poids ouverts. Son architecture à mélange d’experts clairsemée totalise 198 milliards de paramètres, dont environ 11 milliards sont activés par token. Elle associe un backbone langage de 196 milliards de paramètres…
Gemma 4 12B Publié par Google le 23 mai 2026, Gemma 4 12B est un LLM multimodal dense de 12 milliards de paramètres. Son architecture unifiée traite le texte, les images et l’audio dans un transformer decoder-only unique, puis produit du texte. L’analyse vidéo repose sur des séquences d’images.
Command A+ Command A+ est un LLM de Cohere sorti le 20 mai 2026. Ses poids sont ouverts sous licence Apache 2.0, avec un usage commercial autorisé. Son architecture Transformer à mélange clairsemé d’experts active 25 milliards de paramètres sur un total de 218 milliards. Elle compte 128 experts,…
xAI: Grok Build 0.1 Sorti le 20 mai 2026, xAI: Grok Build 0.1 est un LLM de xAI doté d’une fenêtre de contexte de 256 000 tokens. À sa sortie, il figurait dans le top 83 % du LiveBench: Global average parmi les six LLM de sa génération.
Gemini 3.5 Flash Gemini 3.5 Flash est un LLM propriétaire de Google, sorti le 19 mai 2026. Il associe une fenêtre de contexte d’environ un million de tokens à un positionnement économique, avec des tarifs inférieurs de 25% à la moyenne des modèles similaires.
Qwen3.7 Max Qwen3.7 Max est un LLM propriétaire de Qwen, éditeur chinois, sorti le 19 mai 2026. Sa fenêtre de contexte de 1 000 000 tokens constitue l’un de ses principaux signes distinctifs, avec une capacité adaptée au traitement de très grands volumes de texte.
Perceptron: Perceptron Mk1 Perceptron Mk1 est un LLM de l’éditeur Perceptron, lancé le 12 mai 2026. Il se distingue surtout par son suivi des instructions, son meilleur résultat relatif dans la série de benchmarks Benchable, et par une fenêtre de contexte de 32 768 tokens.
AI co-mathematician AI co-mathematician est un LLM de Google, sorti le 8 mai 2026 et positionné sur les mathématiques de recherche. Il se distingue par des résultats de premier plan sur deux versions privées de FrontierMath Tier 4, consacrées à des problèmes très difficiles.
inclusionAI: Ring-2.6-1T Publié par InclusionAI le 8 mai 2026, inclusionAI: Ring-2.6-1T est un LLM caractérisé par une fenêtre de contexte de 262 144 tokens et un positionnement très économique. Il associe ainsi une grande capacité de contexte à des coûts d’exploitation réduits.
Grok 4.3 Grok 4.3 est un LLM propriétaire de xAI, lancé le 6 mai 2026. Il se distingue par une fenêtre de contexte de 1 000 000 tokens, adaptée au traitement de volumes de texte particulièrement importants, tout en conservant un positionnement tarifaire très économique.
GPT-5.5 Instant GPT-5.5 Instant est un LLM propriétaire d’OpenAI, lancé le 5 mai 2026 avec des connaissances arrêtées au 31 août 2025. Son principal trait distinctif est une fenêtre de contexte de 1 050 000 tokens, adaptée au traitement de volumes de texte particulièrement importants.
OpenAI: GPT Chat Latest OpenAI: GPT Chat Latest est un LLM propriétaire lancé le 5 mai 2026. Positionné sur le segment premium, il se caractérise par une fenêtre de contexte de 400 000 tokens, adaptée au traitement de volumes de texte importants.
IBM: Granite 4.1 8B Sorti le 30 avril 2026, IBM: Granite 4.1 8B est un LLM à poids ouverts de 8 milliards de paramètres. Il associe une fenêtre de contexte de 131 072 tokens à un positionnement très économique, avec une tarification 98 % inférieure à la moyenne des LLM similaires et environ 110 fois moins…
Mistral Medium 3.5 Publié par Mistral AI le 29 avril 2026, Mistral Medium 3.5 est un LLM dense de 128 milliards de paramètres, positionné comme une option économique. Sa fenêtre de contexte de 262 144 tokens vise le traitement de longs contenus, tandis que son tarif se situe 25% sous la moyenne des modèles…
MiMo-V2.5-Pro MiMo-V2.5-Pro est un LLM open-weights de Xiaomi, publié le 27 avril 2026 sous licence MIT avec usage commercial autorisé. Son architecture Mixture-of-Experts réunit 1023 milliards de paramètres, dont 42 milliards actifs, et une fenêtre de contexte de 1 048 576 tokens.
Qwen: Qwen3.6 Flash Qwen: Qwen3.6 Flash est un LLM d’Alibaba Cloud et de la Qwen Team, sorti le 27 avril 2026. Il combine une fenêtre de contexte de 1 000 000 tokens avec un positionnement très économique, à 91% sous la moyenne tarifaire des LLM similaires et environ 29.3 fois moins cher que les modèles…
Qwen: Qwen3.6 Max Preview Qwen: Qwen3.6 Max Preview est un LLM d’Alibaba Cloud et de la Qwen Team, sorti le 27 avril 2026. Sa fenêtre de contexte de 262 144 tokens constitue l’un de ses principaux traits distinctifs pour le traitement de longs contenus.
DeepSeek V4 Flash DeepSeek V4 Flash est un LLM chinois de DeepSeek, sorti le 24 avril 2026. Il associe 284 milliards de paramètres à 13 milliards de paramètres actifs et se distingue par une fenêtre de contexte de 1 048 576 tokens, adaptée aux très longs volumes de texte.
DeepSeek V4 Pro DeepSeek V4 Pro est un LLM chinois de très grande taille, lancé par DeepSeek le 24 avril 2026. Il compte 1 600 milliards de paramètres, dont 49 milliards actifs, et dispose d’une fenêtre de contexte de 1 048 576 tokens.
DeepSeek-V4-Flash-Max DeepSeek-V4-Flash-Max est un LLM open-weights de DeepSeek, publié le 23 avril 2026 sous licence MIT, avec usage commercial autorisé. Son positionnement associe une fenêtre de contexte d’environ un million de tokens à une tarification très économique.
DeepSeek-V4-Pro-Max DeepSeek-V4-Pro-Max est le mode de raisonnement maximal de DeepSeek-V4-Pro, un LLM open-weights de DeepSeek publié le 23 avril 2026 sous licence MIT. Son positionnement associe une très grande capacité, avec 1 600 milliards de paramètres dont 49 milliards activés, à une tarification très…
GPT-5.5 GPT-5.5 est un LLM propriétaire d’OpenAI, lancé le 23 avril 2026 et positionné sur le segment premium. À sa sortie, il se classait dans le top 4 % des LLM de sa génération sur GPQA diamond, avec des résultats particulièrement élevés en raisonnement, en connaissances générales et en…
GPT-5.5 Pro GPT-5.5 Pro est un LLM propriétaire d’OpenAI, lancé le 23 avril 2026 et positionné sur le segment premium. Il se distingue par une fenêtre de contexte de 1 050 000 tokens, soit environ 1,1 million, et par des connaissances arrêtées au 1er décembre 2025.
inclusionAI: Ling-2.6-1T Publié par InclusionAI le 23 avril 2026, inclusionAI: Ling-2.6-1T est un LLM très économique doté d’une fenêtre de contexte de 262 144 tokens. Sa tarification se situe 96% sous la moyenne des LLM similaires, avec un coût environ 73.3 fois inférieur à celui des modèles frontière.
MiMo-V2.5 MiMo-V2.5 est un LLM omnimodal de Xiaomi, publié le 22 avril 2026 sous licence MIT. Ses poids ouverts autorisent l’usage commercial. Son architecture Sparse MoE compte 311 milliards de paramètres, dont 15 milliards actifs, et accepte jusqu’à 1 048 576 tokens de contexte.
Tencent: Hy3 preview Publié par Tencent le 22 avril 2026, Tencent: Hy3 preview est un LLM à poids ouverts de type Mixture-of-Experts. Il compte 295 milliards de paramètres, dont 21 milliards sont activés, ainsi qu’une couche MTP de 3.8 milliards de paramètres. Sa fenêtre de contexte atteint 262 144 tokens.
inclusionAI: Ling-2.6-flash Sorti le 21 avril 2026, inclusionAI: Ling-2.6-flash est un LLM d’InclusionAI axé sur l’économie d’usage. Il combine 7 milliards de paramètres actifs à une fenêtre de contexte particulièrement étendue de 262 144 tokens.
Qwen3.6-27B Publié par Qwen le 21 avril 2026, Qwen3.6-27B est un LLM causal open-weights de 28 milliards de paramètres, distribué sous licence Apache 2.0 avec usage commercial autorisé. Il associe une fenêtre de contexte native de 262 144 tokens à un positionnement tarifaire très économique.
Kimi K2.6 Kimi K2.6 est un LLM chinois lancé par Moonshot AI le 20 avril 2026. Son architecture Mixture-of-Experts compte 1000 milliards de paramètres, dont 32 milliards actifs, avec une fenêtre de contexte de 262 144 tokens. Multimodal natif et agentique, il associe l’attention MLA, l’activation…
Qwen 3.6 Max Qwen 3.6 Max est un LLM publié par Qwen le 20 avril 2026. À sa sortie, il figurait dans le top 12 % des 49 LLM de sa génération sur GPQA diamond, consacré aux questions scientifiques de niveau doctorat.
Grok 4.3 Beta Grok 4.3 Beta est un LLM de xAI sorti le 17 avril 2026. À sa sortie, il se classait dans le top 19% des LLM de sa génération sur GPQA diamond, un test de questions scientifiques de niveau doctorat.
Claude Opus 4.7 Claude Opus 4.7 est un LLM propriétaire d’Anthropic, éditeur américain, sorti le 16 avril 2026. Positionné sur le segment premium, il se distingue par une fenêtre de contexte de 1 000 000 tokens et par des résultats élevés en raisonnement, en programmation et dans les tâches agentiques.
Qwen3.6-35B-A3B Publié par Qwen le 16 avril 2026, Qwen3.6-35B-A3B est un modèle de langage causal avec encodeur vision. Son architecture Mixture of Experts réunit Gated DeltaNet et Gated Attention, avec 35 milliards de paramètres au total, dont 3 milliards activés.
Muse Spark Muse Spark est un LLM propriétaire de Meta, lancé le 8 avril 2026 aux États-Unis. Ses poids ne sont pas ouverts. Son profil associe de solides résultats en raisonnement scientifique et mathématique à une bonne restitution de connaissances factuelles.
Claude Mythos Preview Claude Mythos Preview est un grand modèle de langage développé par Anthropic. Il s’agit d’un modèle propriétaire, dont les poids ne sont pas ouverts.
GLM-5.1 GLM-5.1 est un LLM de Zhipu AI lancé le 7 avril 2026, orienté vers l’ingénierie agentique et le codage. Il compte 754 milliards de paramètres, dont 40 milliards actifs, et accepte jusqu’à 202 752 tokens de contexte.
Gemma 4 26B-A4B Gemma 4 26B-A4B est un LLM open-weights de Google, publié le 2 avril 2026 sous licence Apache 2.0, avec usage commercial autorisé. Son architecture Mixture-of-Experts compte 25,2 milliards de paramètres, dont 3,8 milliards actifs, répartis entre 128 experts spécialisés et un expert…
Gemma 4 31B Gemma 4 31B est un LLM open-weights de Google, sorti le 2 avril 2026 sous licence Apache 2.0, avec usage commercial autorisé. Ses 31 milliards de paramètres et sa fenêtre de contexte de 262 144 tokens le positionnent comme un modèle dense à contexte long, proposé à un tarif minimal…
Gemma 4 E2B Gemma 4 E2B est un LLM multimodal de Google, publié le 2 avril 2026 sous licence Apache 2.0. Ses poids ouverts autorisent les usages commerciaux. Il accepte du texte, des images et de l’audio, puis génère du texte.
Gemma 4 E4B Gemma 4 E4B est un LLM open-weights de Google, publié le 2 avril 2026 sous licence Apache 2.0, avec usage commercial autorisé. Ce modèle dense de la famille Gemma 4 compte 4,5 milliards de paramètres effectifs, ou 8 milliards en incluant les embeddings.
GLM-5V-Turbo GLM-5V-Turbo est un LLM propriétaire de Zhipu AI, sorti le 2 avril 2026. Il associe une fenêtre de contexte particulièrement étendue de 202 752 tokens à un positionnement très économique, avec des poids non ouverts.
qwen3.6-plus-04-02 qwen3.6-plus-04-02 est un LLM d’Alibaba Cloud et de la Qwen Team, sorti le 2 avril 2026. Son profil Benchable est très contrasté : il atteint le plafond sur Hallucinations et Email Classification, et obtient un résultat solide en suivi d’instructions.
Arcee AI: Trinity Large Thinking Arcee AI: Trinity Large Thinking est un LLM à poids ouverts sorti le 1 avril 2026. Cette variante de Trinity-Large cible le raisonnement, la planification en plusieurs étapes, les workflows agentiques et les trajectoires d’appels d’outils.
Grok 4.20 Grok 4.20 est un LLM de xAI sorti le 31 mars 2026 aux États-Unis. Il se distingue par 500 milliards de paramètres et une fenêtre de contexte de 2 millions de tokens, adaptée au traitement de volumes de texte particulièrement longs.
Qwen3.6 Plus Qwen3.6 Plus est un LLM propriétaire de l’éditeur chinois Qwen, lancé le 31 mars 2026. Sa principale caractéristique est une fenêtre de contexte de 1 000 000 tokens, adaptée au traitement de très grands volumes de texte ou de code au sein d’une même requête.
Kwaipilot: KAT-Coder-Pro V2 Kwaipilot: KAT-Coder-Pro V2 est un LLM publié par Kwaipilot le 27 mars 2026. Sa fenêtre de contexte de 256 000 tokens constitue l’une de ses principales caractéristiques et autorise le maintien d’un volume conséquent d’informations dans une même requête.
MiMo-V2-Omni MiMo-V2-Omni est un LLM propriétaire de Xiaomi, lancé le 18 mars 2026. Son positionnement associe traitement du texte et de la vision, avec des résultats mesurés dans les deux catégories de l’Arena.
MiMo-V2-Pro MiMo-V2-Pro est un LLM propriétaire de Xiaomi, lancé le 18 mars 2026. Ses 1000 milliards de paramètres le placent parmi les modèles de très grande taille, tandis que ses poids restent fermés.
MiniMax M2.7 MiniMax M2.7 est un LLM open-weights de MiniMax, publié le 18 mars 2026 sous licence MIT, avec usage commercial autorisé. Ses 10 milliards de paramètres actifs s’accompagnent d’une fenêtre de contexte de 204 800 tokens, adaptée au traitement de longs documents et de tâches en plusieurs…
GPT-5.4 mini GPT-5.4 mini est un LLM propriétaire d’OpenAI, lancé le 17 mars 2026. Son positionnement associe une fenêtre de contexte très étendue de 400 000 tokens à un tarif très économique, inférieur de 62% à la moyenne des modèles similaires.
GPT-5.4 nano GPT-5.4 nano est un LLM propriétaire d’OpenAI, lancé le 17 mars 2026. Son positionnement très économique constitue son principal trait distinctif, avec une tarification inférieure de 90% à la moyenne des LLM similaires.
Mistral Small 4 Sorti le 16 mars 2026 par Mistral AI, Mistral Small 4 est un LLM open-weights de 119 milliards de paramètres sous licence Apache 2.0, utilisable commercialement. Son positionnement très économique contraste avec une fenêtre de contexte étendue à 262 144 tokens.
Z.ai: GLM 5 Turbo Z.ai: GLM 5 Turbo est un LLM de Zhipu AI sorti le 15 mars 2026. Il se distingue par une fenêtre de contexte de 262 144 tokens, adaptée au traitement d’entrées volumineuses et de longues séquences de contenu.
Grok-4.20 Beta Grok-4.20 Beta est un LLM propriétaire de xAI, sorti le 12 mars 2026. Ses poids ne sont pas ouverts. Son principal signe distinctif est une fenêtre de contexte de 2 000 000 tokens, une capacité destinée au traitement d’entrées particulièrement volumineuses.
Nemotron 3 Super (120B A12B) Publié par NVIDIA le 11 mars 2026, Nemotron 3 Super (120B A12B) est un LLM à poids ouverts sous licence commerciale. Il réunit 120 milliards de paramètres, dont 12 milliards actifs, dans une architecture hybride LatentMoE associant Mamba-2, MoE, Attention et Multi-Token Prediction.
Sarvam-105B Publié le 6 mars 2026 par Sarvam AI, Sarvam-105B est un LLM open-weights de 105 milliards de paramètres, distribué sous licence Apache 2.0 avec usage commercial autorisé. Son architecture Mixture-of-Experts n’active que 10,3 milliards de paramètres à la fois, avec un routage top-8 parmi…
Sarvam-30B Publié le 6 mars 2026 par Sarvam AI, Sarvam-30B est un LLM open-weights de 30 milliards de paramètres. Son architecture Mixture-of-Experts privilégie le débit et l’efficacité mémoire, avec 2,4 milliards de paramètres actifs hors embeddings.
OpenAI: GPT-5.4 Pro Publié par OpenAI le 5 mars 2026, GPT-5.4 Pro est un LLM premium qui se distingue par ses résultats en sciences, en mathématiques de recherche et en résolution de problèmes d’échecs. À sa sortie, il figurait dans le top 1 % des LLM de sa génération sur GPQA diamond.
GPT-5.4 GPT-5.4 est un LLM propriétaire d’OpenAI, lancé le 5 mars 2026 par l’éditeur américain. Sa caractéristique la plus marquante est sa fenêtre de contexte de 1 050 000 tokens, soit environ 1,1 million, adaptée au traitement de très grands volumes de texte.
GPT-5.3 Chat GPT-5.3 Chat est un LLM propriétaire d’OpenAI, sorti le 4 mars 2026. Il combine une fenêtre de contexte de 128 000 tokens, des connaissances arrêtées au 31 août 2025 et des résultats élevés dans plusieurs évaluations généralistes, notamment en connaissances, raisonnement et programmation.
Gemini 3.1 Flash-Lite Gemini 3.1 Flash-Lite est un LLM propriétaire de Google, lancé le 3 mars 2026. Son positionnement associe une fenêtre de contexte d’environ un million de tokens à un tarif très économique, inférieur de 87% à la moyenne des LLM similaires et environ 22 fois moindre que celui des modèles…
Qwen3.5-0.8B Publié par Qwen le 2 mars 2026, Qwen3.5-0.8B est un modèle de langage causal compact de 800 millions de paramètres, associé à un encodeur vision. Son architecture hybride combine Gated DeltaNet, Gated Attention et FFN, avec un contexte natif de 262 144 tokens.
Qwen3.5-2B Qwen3.5-2B est un modèle de langage multimodal de Qwen, publié le 2 mars 2026 sous licence Apache 2.0. Ses poids ouverts autorisent l’usage commercial, le prototypage, la spécialisation par fine-tuning et les travaux de recherche ou de développement.
Qwen3.5-4B Qwen3.5-4B est un LLM multimodal de 4 milliards de paramètres publié par Qwen le 2 mars 2026. Son architecture hybride associe Gated Delta Networks, attention gated, FFN et encodeur visuel, avec une fusion précoce des tokens multimodaux.
Qwen3.5-9B Publié par Qwen le 2 mars 2026, Qwen3.5-9B est un modèle de langage causal de 9 milliards de paramètres, complété par un encodeur vision. Il prend en charge 201 langues et dialectes, ainsi que des usages de raisonnement, de codage, d’agents et de compréhension visuelle.
gemini-3.1-flash-image-preview gemini-3.1-flash-image-preview est un LLM de Google. Son profil Benchable couvre le raisonnement, le code, les connaissances générales, l’éthique, la classification d’e-mails et les hallucinations.
ByteDance Seed: Seed-2.0-Mini ByteDance Seed: Seed-2.0-Mini est un LLM lancé par ByteDance Seed le 26 février 2026. Il se distingue par une fenêtre de contexte de 262 144 tokens et par un positionnement très économique, avec des tarifs inférieurs de 95% à la moyenne des LLM similaires.
LiquidAI: LFM2-24B-A2B Publié par Liquid le 25 février 2026, LiquidAI: LFM2-24B-A2B est un LLM instruct généraliste de la famille LFM2. Son architecture hybride MoE associe des couches convolutionnelles et attentionnelles, avec 24 milliards de paramètres au total, dont 2,3 milliards actifs.
Google: Gemini 3.1 Pro Preview Custom Tools Google: Gemini 3.1 Pro Preview Custom Tools est un LLM de Google sorti le 25 février 2026. Il se caractérise par une fenêtre de contexte de 1 048 756 tokens, soit environ 1,0 million, ainsi que par un positionnement économique.
Qwen: Qwen3.5-Flash Qwen: Qwen3.5-Flash est un LLM d’Alibaba Cloud et de la Qwen Team, lancé le 25 février 2026. Sa fenêtre de contexte atteint 1 000 000 tokens, un format adapté au traitement de volumes de texte particulièrement importants.
Mercury 2 Mercury 2 est un LLM propriétaire lancé par Inception le 24 février 2026. Il se distingue par un positionnement très économique et une fenêtre de contexte de 128 000 tokens, adaptée au traitement de contenus longs.
Qwen3.5-122B-A10B Publié par Qwen le 24 février 2026, Qwen3.5-122B-A10B est un LLM multimodal chinois à poids ouverts sous licence Apache 2.0, utilisable commercialement. Son architecture hybride associe Gated DeltaNet, Gated Attention et Mixture-of-Experts, avec 122 milliards de paramètres, dont 10…
Qwen3.5-27B Publié par Qwen le 24 février 2026, Qwen3.5-27B est un LLM open-weights de 27 milliards de paramètres sous licence Apache 2.0, avec usage commercial autorisé. Son principal positionnement associe une fenêtre de contexte native de 262 144 tokens, un encodeur de vision et un tarif très…
Qwen3.5-35B-A3B Publié par Qwen le 24 février 2026, Qwen3.5-35B-A3B est un modèle de langage causal open-weights sous licence Apache 2.0, utilisable commercialement. Son architecture hybride associe Gated Delta Networks, attention gated et Mixture-of-Experts sparse, avec 35 milliards de paramètres au…
AionLabs: Aion-2.0 Aion-2.0 est un LLM d’Aion Labs sorti le 23 février 2026. Il associe une fenêtre de contexte de 131 072 tokens à des résultats élevés sur plusieurs évaluations généralistes, mathématiques et de classification.
Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview est un LLM de Google sorti le 19 février 2026. Sa fenêtre de contexte de 1 048 576 tokens constitue l’un de ses traits marquants, avec un positionnement solide en intelligence générale et en programmation.
Claude Sonnet 4.6 Claude Sonnet 4.6 est un LLM propriétaire d’Anthropic, lancé le 17 février 2026. Il se distingue par une fenêtre de contexte de 1 000 000 tokens, adaptée au traitement de volumes importants de code ou de documents, ainsi que par un positionnement solide sur les tâches agentiques et la…
Qwen3.5-397B-A17B Publié par Qwen le 16 février 2026, Qwen3.5-397B-A17B est un modèle de langage causal open-weights sous licence Apache 2.0, avec usage commercial autorisé. Son architecture Mixture-of-Experts réunit 397 milliards de paramètres, dont 17 milliards sont activés, et combine Gated Delta…
Qwen 3.5 Plus Publié le 16 février 2026, Qwen 3.5 Plus est un grand modèle de langage développé par Qwen. À sa sortie, il se situe dans le haut du panier de sa génération pour les questions scientifiques complexes.
Seed 2.0 Lite Seed 2.0 Lite est un LLM propriétaire de ByteDance, lancé le 14 février 2026. Il se distingue par un positionnement très économique, avec une tarification inférieure de 87% à la moyenne des LLM similaires et environ 22 fois moins élevée que celle des modèles frontière.
Seed 2.0 Pro Seed 2.0 Pro est un LLM propriétaire de ByteDance, lancé le 14 février 2026. Il associe une fenêtre de contexte de 256 000 tokens à un positionnement tarifaire très économique, avec des prix inférieurs de 75 % à la moyenne des LLM similaires.
MiniMax M2.5 MiniMax M2.5 est un LLM à poids ouverts publié par MiniMax le 12 février 2026 sous licence MIT, avec usage commercial autorisé. Il combine 230 milliards de paramètres, dont 10 milliards actifs, et une fenêtre de contexte de 1 000 000 tokens.
GLM-5 GLM-5 est un LLM à poids ouverts de Zhipu AI, sorti le 11 février 2026 sous licence MIT, avec usage commercial autorisé. Ses 744 milliards de paramètres, dont 40 milliards actifs, ciblent l’ingénierie de systèmes complexes et les tâches agentiques à horizon long. Sa fenêtre de 202 800…
MiniCPM-SALA MiniCPM-SALA est un LLM de 9 milliards de paramètres publié par OpenBMB le 11 février 2026. Son architecture hybride répartit ses couches entre InfLLM-V2 pour l’attention sparse, à hauteur de 25 %, et Lightning Attention pour l’attention linéaire, à hauteur de 75 %.
Claude Opus 4.6 Claude Opus 4.6 est un LLM propriétaire lancé par Anthropic le 5 février 2026. Positionné sur le segment premium, il se distingue par une fenêtre de contexte de 1 000 000 tokens, adaptée au traitement de volumes de texte particulièrement importants.
GPT-5.3 Codex GPT-5.3 Codex est un LLM propriétaire d’OpenAI, lancé le 5 février 2026. Il associe une fenêtre de contexte de 400 000 tokens à un positionnement tarifaire économique, avec des résultats particulièrement solides en connaissances générales, en programmation et en raisonnement.
LongCat-Flash-Lite Publié par Meituan le 5 février 2026, LongCat-Flash-Lite est un LLM open weights sous licence MIT, utilisable commercialement. Son architecture Mixture-of-Experts non-thinking compte 68,5 milliards de paramètres, dont environ 3 milliards sont activés lors de l’inférence.
qwen3-coder-next-2025-02-03 Publié le 4 février 2026 par Alibaba Cloud et la Qwen Team, qwen3-coder-next-2025-02-03 est un LLM chinois à poids ouverts spécialisé dans les agents de programmation et le développement local. Son architecture hybride de 48 couches associe Gated DeltaNet, attention à portes et mélange…
Step-3.5-Flash Publié par StepFun le 2 février 2026, Step-3.5-Flash est un LLM open-weights sous licence Apache 2.0, utilisable commercialement. Son positionnement associe une fenêtre de contexte de 262 144 tokens à un tarif très économique, inférieur de 95% à la moyenne des modèles similaires.
Kimi K2.5 Développé en Chine par Moonshot AI et sorti le 27 janvier 2026, Kimi K2.5 est un LLM multimodal et agentique à poids ouverts sous licence MIT, avec usage commercial autorisé. Son architecture Mixture-of-Experts compte 1000 milliards de paramètres, dont 32 milliards actifs, et accepte un…
Upstage: Solar Pro 3 Sorti le 27 janvier 2026, Upstage: Solar Pro 3 est un LLM d’Upstage centré sur un positionnement très économique. Sa fenêtre de contexte atteint 128 000 tokens, tandis que ses tarifs débutent à 0,15 $ par million de tokens en entrée et 0,6 $ en sortie.
Qwen3 Max Qwen3 Max est un LLM propriétaire de Qwen, lancé le 25 janvier 2026. Développé en Chine, il associe 1000 milliards de paramètres à une fenêtre de contexte de 262 144 tokens et à des connaissances arrêtées au 30 juin 2025.
MiniMax: MiniMax M2-her MiniMax M2-her est un LLM publié par MiniMax le 23 janvier 2026. Il se caractérise par une fenêtre de contexte de 65 536 tokens et par un positionnement tarifaire très économique, destiné aux traitements où le coût constitue un critère central.
ERNIE 5.0 ERNIE 5.0 est un LLM propriétaire de Baidu, sorti le 22 janvier 2026. Ses poids ne sont pas ouverts, ce qui le place dans la catégorie des modèles contrôlés par leur éditeur.
Writer: Palmyra X5 Sorti le 21 janvier 2026, Writer: Palmyra X5 est un LLM de Writer qui associe une fenêtre de contexte de 1 040 000 tokens à un positionnement tarifaire très économique. Cette capacité le distingue pour le traitement de volumes de texte particulièrement importants.
GLM-4.7-Flash GLM-4.7-Flash est un LLM open-weights de Zhipu AI, publié le 19 janvier 2026 sous licence MIT avec usage commercial autorisé. Son architecture MoE réunit 30 milliards de paramètres, dont 3 milliards actifs, et prend en charge une fenêtre de contexte de 202 752 tokens.
Step3-VL-10B Step3-VL-10B est un LLM de 10 milliards de paramètres publié par StepFun le 15 janvier 2026. Cette date de sortie récente le place parmi les modèles apparus au début de l’année 2026.
GPT-5.2 Codex GPT-5.2 Codex est un LLM propriétaire d’OpenAI, publié le 14 janvier 2026. Ses poids ne sont pas ouverts. Sa fenêtre de contexte de 400 000 tokens et son positionnement tarifaire économique constituent ses principaux traits distinctifs.
LongCat-Flash-Thinking-2601 Publié par Meituan le 14 janvier 2026, LongCat-Flash-Thinking-2601 est un modèle de raisonnement à poids ouverts sous licence MIT, utilisable commercialement. Son architecture Mixture-of-Experts réunit 560 milliards de paramètres au total, dont 27 milliards sont activés lors du traitement.
K-EXAONE-236B-A23B K-EXAONE-236B-A23B est un grand modèle de langage propriétaire de LG AI Research, sorti le 31 décembre 2025. Avec 236 milliards de paramètres, il se place dans la catégorie des modèles de très grande taille et figurait, à son lancement, dans le haut du classement de sa génération sur…
MiniMax M2.1 MiniMax M2.1 est un LLM de 230 milliards de paramètres publié par l’éditeur chinois MiniMax le 23 décembre 2025. Sa fenêtre de contexte de 1 000 000 tokens et son positionnement très économique le destinent aux tâches longues et complexes, notamment le codage, la planification et…
Seed 1.6 Seed 1.6 est un LLM chinois de ByteDance Seed, sorti le 23 décembre 2025. Sa fenêtre de contexte de 262 144 tokens constitue l’un de ses principaux marqueurs et autorise des requêtes comportant un volume important de texte.
ByteDance Seed: Seed 1.6 Flash Seed 1.6 Flash est un LLM lancé par ByteDance Seed le 23 décembre 2025. Il se distingue par une fenêtre de contexte de 262 144 tokens, adaptée aux requêtes contenant de grands volumes de texte.
GLM-4.7 GLM-4.7 est un LLM de Zhipu AI sorti le 22 décembre 2025. Ce modèle chinois de 358 milliards de paramètres, dont 32 milliards actifs, se distingue par une fenêtre de contexte de 204 800 tokens, une licence MIT autorisant l’usage commercial et un positionnement très économique.
Gemini 3 Flash Gemini 3 Flash est un LLM propriétaire de Google, lancé le 17 décembre 2025. Il se distingue par une fenêtre de contexte d’environ un million de tokens et par un positionnement très économique, avec des tarifs inférieurs de 75% à la moyenne des modèles similaires.
MiMo-V2-Flash MiMo-V2-Flash est un LLM open-weights de Xiaomi, publié le 16 décembre 2025 sous licence MIT, avec usage commercial autorisé. Son architecture Mixture-of-Experts réunit 309 milliards de paramètres, dont 15 milliards sont actifs, et prend en charge une fenêtre de contexte de 262 144 tokens.
Nemotron 3 Nano (30B A3B) Nemotron 3 Nano (30B A3B) est un LLM open-weights de NVIDIA, sorti le 15 décembre 2025. Ce modèle de base de 32 milliards de paramètres associe Mamba2, Transformer et Mixture of Experts. Il traite et produit du texte dans une vingtaine de langues, dont le français.
GPT-5.2 Pro Publié le 11 décembre 2025 par OpenAI, GPT-5.2 Pro est un LLM propriétaire haut de gamme, dont les poids ne sont pas ouverts. Son positionnement repose sur une fenêtre de contexte de 400 000 tokens et sur des résultats élevés dans des évaluations particulièrement exigeantes.
GPT-5.2 GPT-5.2 est un LLM propriétaire d’OpenAI, lancé le 11 décembre 2025 aux États-Unis. Il se caractérise par de solides résultats en mathématiques et par une fenêtre de contexte de 400 000 tokens. Ses connaissances s’arrêtent au 25 août 2025.
OpenAI: GPT-5.2 Chat Sorti le 10 décembre 2025, OpenAI: GPT-5.2 Chat est un LLM propriétaire d’OpenAI au positionnement économique. Sa fenêtre de contexte atteint 128 000 tokens. Son tarif s’établit à 1,75 $ par million de tokens en entrée et à 14 $ en sortie.
Devstral 2 Devstral 2 est un LLM édité par Mistral AI. Son positionnement peut être apprécié à partir d’Arena Code, une évaluation comparative centrée sur le code.
Mistral: Devstral 2 2512 Publié par Mistral AI le 9 décembre 2025, Mistral: Devstral 2 2512 est un LLM agentique spécialisé dans le génie logiciel. Ce modèle 123B, fourni en FP8 et affiné pour suivre des instructions, vise les assistants de code et les agents capables d’intervenir sur des projets logiciels.
Z.ai: GLM 4.6V Publié le 8 décembre 2025 par Zhipu AI, Z.ai: GLM 4.6V est un LLM multimodal de 106 milliards de paramètres destiné aux environnements cloud et aux clusters haute performance. Sa fenêtre de contexte atteint 131 072 tokens, soit le format 128k annoncé pour cette version.
Relace: Relace Search Relace: Relace Search est un LLM publié par relace le 8 décembre 2025. Il se distingue par une fenêtre de contexte de 256 000 tokens et par un positionnement tarifaire très économique, adapté aux traitements qui exigent de longues entrées à coût contenu.
Ministral 3 (14B Reasoning 2512) Ministral 3 (14B Reasoning 2512) est un modèle open-weights de Mistral AI, publié le 4 décembre 2025 sous licence Apache 2.0, avec usage commercial autorisé. Cette version post-entraînée pour le raisonnement cible notamment les mathématiques, le code et les disciplines STEM.
Ministral 3 (14B Base 2512) Publié par Mistral AI le 4 décembre 2025, Ministral 3 (14B Base 2512) est un modèle multimodal de 14 milliards de paramètres conçu comme une base de pré-entraînement. Il associe un modèle de langage de 13,5 milliards de paramètres à un encodeur vision de 0,4 milliard, afin de traiter du…
MiniStral 3 (14B Instruct 2512) MiniStral 3 (14B Instruct 2512) est un LLM multimodal de Mistral AI, publié le 4 décembre 2025 sous licence Apache 2.0. Ses poids ouverts autorisent l’usage commercial. Cette version post-entraînée pour les instructions associe un modèle de langage de 13,5 milliards de paramètres à un…
Ministral 3 (3B Base 2512) Ministral 3 (3B Base 2512) est un LLM open-weights de Mistral AI, publié le 4 décembre 2025 sous licence Apache 2.0, avec usage commercial autorisé. Cette version de base pré-entraînée vise le post-entraînement personnalisé plutôt qu’un usage direct comme assistant.
Ministral 3 (3B Instruct 2512) Ministral 3 (3B Instruct 2512) est un LLM multimodal compact de Mistral AI, sorti le 4 décembre 2025. Cette version post-entraînée pour les instructions combine un modèle de langage de 3,4 milliards de paramètres et un encodeur vision de 0,4 milliard, avec une fenêtre de contexte de 131…
Ministral 3 (8B Base 2512) Ministral 3 (8B Base 2512) est un LLM multimodal à poids ouverts publié par Mistral AI le 4 décembre 2025. Cette version de base pré-entraînée associe un modèle de langage de 8,4 milliards de paramètres à un encodeur vision de 0,4 milliard, afin de traiter du texte et des images.
Ministral 3 (8B Instruct 2512) Ministral 3 (8B Instruct 2512) est un modèle open weights de Mistral AI, publié le 4 décembre 2025 sous licence Apache 2.0. Son positionnement associe exécution locale ou edge, usage commercial autorisé et tarification très économique.
Min istral 3 (3B Reasoning 2512) Min istral 3 (3B Reasoning 2512) est un LLM compact de Mistral AI, sorti le 4 décembre 2025. Cette version post-entraînée pour le raisonnement combine un modèle de langage de 3,4 milliards de paramètres et un encodeur visuel de 0,4 milliard, afin de traiter conjointement le texte et les…
Ministral 3 (8B Reasoning 2512) Ministral 3 (8B Reasoning 2512) est un LLM multimodal de Mistral AI, post-entraîné pour le raisonnement et publié le 4 décembre 2025. Son architecture associe un modèle de langage de 8,4 milliards de paramètres à un encodeur vision de 0,4 milliard, avec une fenêtre de contexte de 262 100…
Mistral Large 3 (675B Instruct 2512 Eagle) Publié par Mistral AI le 4 décembre 2025, Mistral Large 3 (675B Instruct 2512 Eagle) est le spéculateur Eagle associé à Mistral Large 3 Instruct. Il vise à accélérer la génération selon la tâche, autour d’un système multimodal Mixture-of-Experts combinant un modèle de langage de 673…
Mistral Large 3 (675B Base) Publié le 4 décembre 2025 par Mistral AI, Mistral Large 3 (675B Base) est un LLM open-weights de 675 milliards de paramètres, distribué sous licence Apache 2.0 avec usage commercial autorisé. Il s’agit d’un modèle pré-entraîné de base, conçu pour servir de fondation à des…
Mistral Large 3 (675B Instruct 2512 NVFP4) Publié par Mistral AI le 4 décembre 2025, Mistral Large 3 (675B Instruct 2512 NVFP4) est un LLM multimodal open-weights de 675 milliards de paramètres. Son architecture Mixture-of-Experts granulaire associe un modèle de langage MoE à un encodeur visuel de 2,5 milliards de paramètres.
Mistral Large 3 (675B Instruct 2512) Publié par Mistral AI le 4 décembre 2025, Mistral Large 3 (675B Instruct 2512) est un LLM multimodal à poids ouverts sous licence Apache 2.0, utilisable commercialement. Son positionnement associe une architecture Mixture-of-Experts de grande taille, une longue fenêtre de contexte et des…
OpenAI: GPT-5.1-Codex-Max OpenAI: GPT-5.1-Codex-Max est un LLM propriétaire américain, sorti le 4 décembre 2025. Il se caractérise par une fenêtre de contexte de 400 000 tokens et par un positionnement favorable sur le code.
Nova 2 Lite Nova 2 Lite est un LLM propriétaire d’Amazon, lancé le 2 décembre 2025. Il se distingue par une fenêtre de contexte de 1 000 000 tokens et par un positionnement tarifaire très économique, destiné aux traitements de grands volumes de texte à coût contenu.
Nova 2 Omni Nova 2 Omni est un LLM propriétaire d’Amazon, lancé le 2 décembre 2025. Ses poids ne sont pas ouverts, ce qui le place dans la catégorie des modèles contrôlés par leur éditeur plutôt que dans celle des modèles librement accessibles.
Nova 2 Pro Nova 2 Pro est un LLM propriétaire lancé par Amazon le 2 décembre 2025. Ses poids ne sont pas ouverts, ce qui le distingue des modèles pouvant être téléchargés et modifiés directement.
Nova 2 Sonic Nova 2 Sonic est un LLM propriétaire d’Amazon, lancé le 2 décembre 2025. Son principal trait distinctif est une fenêtre de contexte de 1 000 000 tokens, associée à un positionnement tarifaire très économique.
nova-2-lite-v1 nova-2-lite-v1 est un LLM propriétaire d’Amazon, sorti le 2 décembre 2025. Son profil Benchable présente des scores bruts élevés sur plusieurs tests, mais les classements relatifs donnent une image plus nuancée de ses performances.
DeepSeek-V3.2 (Thinking) DeepSeek-V3.2 (Thinking) est un LLM de DeepSeek sorti le 1 décembre 2025. Ses 685 milliards de paramètres et sa fenêtre de contexte de 131 072 tokens le positionnent comme un modèle de grande taille, conçu notamment pour le raisonnement sur des séquences longues.
DeepSeek-V3.2 Publié par DeepSeek le 1 décembre 2025, DeepSeek-V3.2 est un LLM open-weights sous licence MIT, utilisable commercialement. Il réunit 685 milliards de paramètres, dont 37 milliards actifs, et une fenêtre de contexte de 163 840 tokens. Son mécanisme DeepSeek Sparse Attention réduit la…
DeepSeek-V3.2-Speciale Publié par DeepSeek le 1 décembre 2025, DeepSeek-V3.2-Speciale est un LLM open-weights de 685 milliards de paramètres, distribué sous licence MIT avec usage commercial autorisé. Cette variante de DeepSeek-V3.2 se concentre exclusivement sur les tâches de raisonnement profond.
Arcee AI: Trinity Mini Sorti le 1er décembre 2025, Arcee AI: Trinity Mini est un LLM d’Arcee AI orienté vers le raisonnement. Son architecture MoE réunit 26B paramètres, mais n’en active que 3B lors du traitement, afin de concentrer le calcul sur une partie du modèle.
Claude Opus 4.5 Claude Opus 4.5 est un LLM propriétaire américain d’Anthropic, lancé le 24 novembre 2025 et positionné sur le segment premium. Sa fenêtre de contexte de 200 000 tokens constitue l’un de ses principaux attributs, avec des connaissances arrêtées au 31 mars 2025.
GPT-5.1 Codex GPT-5.1 Codex est un LLM propriétaire d’OpenAI, sorti le 19 novembre 2025 et spécialisé dans le code. À son lancement, il se situait dans le top 20% des LLM de sa génération sur SWE-Bench Verified, ce qui le plaçait dans le haut du panier pour les tâches de développement logiciel.
Grok 4.1 Fast Grok 4.1 Fast est un LLM américain publié par xAI le 19 novembre 2025. Son positionnement associe une fenêtre de contexte particulièrement étendue à un tarif très économique, plutôt qu’une place dominante dans les classements de performance.
Gemini 3 Pro Gemini 3 Pro est un LLM propriétaire de Google, lancé le 18 novembre 2025. À sa sortie, il se classait dans le top 1 % des modèles de sa génération sur GPQA diamond, avec un positionnement particulièrement solide en sciences, en mathématiques difficiles et en exactitude factuelle.
gemini-3-pro-preview-11-2025-high gemini-3-pro-preview-11-2025-high est un grand modèle de langage (LLM) édité par Google. Sa désignation complète identifie une variante précise de la gamme Gemini.
Grok-4.1 Grok-4.1 est un LLM propriétaire de xAI, éditeur américain, sorti le 17 novembre 2025. Ses poids ne sont pas ouverts. Le modèle se distingue surtout par une fenêtre de contexte de 256 000 tokens et par un positionnement nettement plus favorable en texte qu’en programmation.
Deep Cogito: Cogito v2.1 671B Sorti le 13 novembre 2025, Deep Cogito: Cogito v2.1 671B est un LLM de Deep Cogito doté d’une fenêtre de contexte de 128 000 tokens. Il associe ce contexte étendu à un positionnement tarifaire très économique.
OpenAI: GPT-5.1 Chat OpenAI: GPT-5.1 Chat est un LLM propriétaire lancé par OpenAI le 13 novembre 2025. Sa fenêtre de contexte de 128 000 tokens le positionne pour le traitement de volumes de texte importants, tandis que ses résultats Benchable couvrent les connaissances générales, le raisonnement, le code,…
GPT-5.1 GPT-5.1 est un LLM propriétaire d’OpenAI, lancé le 13 novembre 2025 aux États-Unis. Sa fenêtre de contexte de 400 000 tokens constitue son trait le plus distinctif, tandis que ses connaissances s’arrêtent au 30 septembre 2024. À sa sortie, il appartenait au top 4% des 52 LLM de sa…
GPT-5.1 Codex Mini GPT-5.1 Codex Mini est un LLM propriétaire d’OpenAI, sorti le 12 novembre 2025. Il se distingue par une fenêtre de contexte de 400 000 tokens et par un positionnement très économique, avec une tarification inférieure de 87% à la moyenne des LLM similaires.
GPT-5.1 Instant GPT-5.1 Instant est un LLM propriétaire d’OpenAI, sorti le 12 novembre 2025. Il se distingue par un positionnement très économique, tout en affichant à sa sortie un niveau élevé sur GPQA par rapport aux autres LLM de sa génération.
Kimi K2 Publié le 6 novembre 2025 par l’entreprise chinoise Moonshot AI, Kimi K2 est un LLM de 1000 milliards de paramètres, dont 32 milliards sont actifs. Ce rapport entre taille totale et paramètres mobilisés constitue l’un de ses principaux traits techniques.
Kimi K2 Thinking Turbo Kimi K2 Thinking Turbo est un LLM de Moonshot AI, sorti le 6 novembre 2025. Il se distingue surtout par ses résultats en sciences de niveau doctorat et en olympiades de mathématiques de niveau lycée, deux domaines où il se place dans le haut des classements mesurés.
nova-premier-v1 nova-premier-v1 est un LLM propriétaire d’Amazon. Son profil Benchable est très contrasté, avec des résultats élevés sur Hallucinations et Email Classification, mais des performances nettement plus faibles dans plusieurs autres catégories.
Perplexity: Sonar Pro Search Perplexity: Sonar Pro Search est un LLM propriétaire lancé par Perplexity le 30 octobre 2025. Sa fenêtre de contexte de 200 000 tokens constitue son principal trait distinctif et autorise le traitement de volumes d’entrée importants.
Mistral: Voxtral Small 24B 2507 Mistral: Voxtral Small 24B 2507 est un LLM à poids ouverts publié par Mistral AI le 30 octobre 2025. Cette évolution de Mistral Small 3 ajoute l’entrée audio aux capacités de compréhension textuelle, avec une fenêtre de contexte de 32 000 tokens.
OpenAI: gpt-oss-safeguard-20b Sorti le 29 octobre 2025, OpenAI: gpt-oss-safeguard-20b est un LLM à poids ouverts spécialisé dans le raisonnement de sécurité. Construit sur gpt-oss, il compte 21 milliards de paramètres, dont 3.6 milliards actifs, et vise les GPU dotés de 16GB de VRAM.
nemotron-nano-12b-v2-vl Publié par NVIDIA le 28 octobre 2025 avec des poids ouverts, nemotron-nano-12b-v2-vl est un LLM multimodal de type Transformer. Il associe l’encodeur visuel CRadioV2-H à NVIDIA-Nemotron-Nano-12B-v2. Il traite du texte, jusqu’à quatre images ou des vidéos, puis génère du texte dans une…
MiniMax M2 MiniMax M2 est un LLM de MiniMax, éditeur chinois, sorti le 27 octobre 2025. Son architecture MoE réunit 230 milliards de paramètres, dont 10 milliards sont activés, avec une fenêtre de contexte de 1 000 000 tokens. Ce format vise à combiner grande capacité et activation plus compacte.
granite-4.0-h-micro Sorti le 20 octobre 2025, granite-4.0-h-micro est un LLM à poids ouverts développé par IBM. Ce modèle d’instructions de 3 milliards de paramètres se distingue par une fenêtre de contexte de 131 000 tokens. Il a été affiné à partir de Granite-4.0-H-Micro-Base avec des jeux d’instructions…
Claude Haiku 4.5 Claude Haiku 4.5 est un LLM propriétaire d’Anthropic, éditeur américain, sorti le 15 octobre 2025. Son positionnement associe une fenêtre de contexte de 200 000 tokens à une tarification très économique. Ses connaissances s’arrêtent au 1er février 2025.
NVIDIA: Llama 3.3 Nemotron Super 49B V1.5 Publié par NVIDIA le 10 octobre 2025, Llama 3.3 Nemotron Super 49B V1.5 est un LLM dense de type Transformer decoder-only, dérivé de Meta Llama 3.3 70B Instruct. Son architecture a été personnalisée par Neural Architecture Search, avec notamment du skip attention et des réseaux FFN…
OpenAI: GPT-5 Pro OpenAI: GPT-5 Pro est un LLM propriétaire lancé par OpenAI le 6 octobre 2025. Son positionnement premium associe une fenêtre de contexte de 400 000 tokens à des connaissances arrêtées au 30 septembre 2024.
GLM-4.6 Sorti le 30 septembre 2025, GLM-4.6 est un LLM de 357 milliards de paramètres développé en Chine par Zhipu AI. Ses poids ouverts sous licence MIT autorisent l’usage commercial. Le modèle associe une fenêtre de contexte de 202 752 tokens à un positionnement tarifaire très économique.
DeepSeek-V3.2-Exp DeepSeek-V3.2-Exp est un LLM expérimental de DeepSeek, publié le 29 septembre 2025 sous licence MIT avec des poids ouverts et un usage commercial autorisé. Fort de 685 milliards de paramètres, il accepte une fenêtre de contexte de 163 840 tokens et intègre des connaissances arrêtées au…
Claude Sonnet 4.5 Claude Sonnet 4.5 est un LLM propriétaire d’Anthropic, éditeur américain, sorti le 29 septembre 2025. Son positionnement intermédiaire associe de solides résultats en mathématiques et en code à des performances générales plus proches du milieu de tableau.
Gemini 2.5 Flash Lite Preview Gemini 2.5 Flash Lite Preview est un LLM de Google sorti le 25 septembre 2025. Son positionnement associe une fenêtre de contexte d’environ 1,0 million de tokens à une tarification très économique, pensée pour réduire fortement le coût de traitement de grands volumes de texte.
Qwen3-Max-Instruct Publié le 24 septembre 2025 par Qwen, Qwen3-Max-Instruct est un grand modèle de langage qui se distingue surtout en mathématiques et dans le traitement de questions factuelles vérifiables. À sa sortie, ses résultats scientifiques le plaçaient dans le haut du panier des LLM de sa…
Qwen: Qwen3 Coder Plus Qwen: Qwen3 Coder Plus est un LLM d’Alibaba Cloud / Qwen Team, sorti le 23 septembre 2025. Il se distingue surtout par une fenêtre de contexte de 1 000 000 tokens. Ses connaissances sont arrêtées au 30 juin 2025.
LongCat-Flash-Thinking Publié par Meituan le 22 septembre 2025, LongCat-Flash-Thinking est un LLM de raisonnement open weights sous licence MIT, utilisable commercialement. À sa sortie, ses résultats sur GPQA le plaçaient dans le haut du panier des modèles de sa génération.
Qwen3 VL 235B A22B Instruct Publié par Qwen le 22 septembre 2025, Qwen3 VL 235B A22B Instruct est un modèle vision-langage Instruct de 236 milliards de paramètres, dont 22 milliards actifs. Sa fenêtre de contexte atteint 262 144 tokens et ses connaissances couvrent les informations disponibles jusqu’au 31 mars 2025.
Qwen3 VL 235B A22B Thinking Publié par Qwen le 22 septembre 2025, Qwen3 VL 235B A22B Thinking est un modèle vision-langage de 236 milliards de paramètres, orienté raisonnement et distribué sous licence Apache 2.0. Il traite le texte, les images et les vidéos, avec une fenêtre de contexte de 262 144 tokens.
Qwen3 VL 30B A3B Instruct Qwen3 VL 30B A3B Instruct est un modèle vision-langage de Qwen, publié le 22 septembre 2025 sous licence Apache 2.0. Son architecture MoE traite des conversations associant texte et image, avec des fonctions orientées vers les agents visuels, la génération de code visuel et la perception…
Qwen3 VL 30B A3B Thinking Publié par Qwen le 22 septembre 2025, Qwen3 VL 30B A3B Thinking est un modèle vision-langage open-weights de 31 milliards de paramètres. Cette édition Thinking associe une architecture MoE à un raisonnement renforcé, avec une fenêtre de contexte de 262 144 tokens.
Qwen3 VL 32B Instruct Publié par Qwen le 22 septembre 2025, Qwen3 VL 32B Instruct est un modèle vision-langage de 33 milliards de paramètres, doté d’une fenêtre de contexte de 262 144 tokens. Ses poids sont distribués sous licence Apache 2.0, avec un usage commercial autorisé.
Qwen3 VL 32B Thinking Publié par Qwen le 22 septembre 2025, Qwen3 VL 32B Thinking est un modèle vision-langage de 33 milliards de paramètres, orienté vers le raisonnement multimodal. Il traite notamment les images, les vidéos, le texte, les interfaces informatiques et la perception spatiale.
Qwen3 VL 4B Instruct Qwen3 VL 4B Instruct est un modèle vision-langage de Qwen, sorti le 22 septembre 2025. Ses 4 milliards de paramètres, sa licence Apache 2.0 autorisant l’usage commercial et son positionnement très économique en font un modèle multimodal orienté vers un déploiement accessible.
Qwen3 VL 4B Thinking Publié par Qwen le 22 septembre 2025, Qwen3 VL 4B Thinking est un modèle vision-langage de 4 milliards de paramètres, conçu pour raisonner sur du texte, des images et des vidéos. Son édition Thinking met l’accent sur le raisonnement multimodal, la compréhension vidéo à long contexte, la…
Qwen3 VL 8B Instruct Publié par Qwen le 22 septembre 2025, Qwen3 VL 8B Instruct est un modèle vision-langage de 9 milliards de paramètres, proposé sous licence Apache 2.0 avec des poids ouverts et un usage commercial autorisé. Sa fenêtre de contexte de 262 144 tokens cible notamment les longues vidéos et les…
Qwen3 VL 8B Thinking Publié par Qwen le 22 septembre 2025, Qwen3 VL 8B Thinking est un modèle vision-langage de 9 milliards de paramètres, doté d’une fenêtre de contexte de 262 144 tokens. Ses poids sont distribués sous licence Apache 2.0, avec usage commercial autorisé.
DeepSeek V3.1 Terminus DeepSeek V3.1 Terminus est un LLM à poids ouverts publié par DeepSeek le 22 septembre 2025. Il combine 37 milliards de paramètres actifs, une fenêtre de contexte de 163 840 tokens et des connaissances arrêtées au 31 mars 2025.
Qwen: Qwen3 Coder Flash Qwen: Qwen3 Coder Flash est un LLM d’Alibaba Cloud et de la Qwen Team, sorti le 17 septembre 2025. Orienté vers le code, il se distingue surtout par une fenêtre de contexte de 1 000 000 tokens. Ses connaissances couvrent les informations disponibles jusqu’au 30 juin 2025.
GPT-5 Codex GPT-5 Codex est un LLM propriétaire d’OpenAI, sorti le 15 septembre 2025 et positionné sur la programmation. À son lancement, il figurait dans le top 5% des modèles de sa génération sur SWE-Bench Verified, ce qui le plaçait parmi les références contemporaines pour les tâches de…
Qwen3-Next-80B-A3B-Instruct Publié par Qwen le 10 septembre 2025, Qwen3-Next-80B-A3B-Instruct est un LLM causal conçu exclusivement pour suivre des instructions, sans génération de blocs de raisonnement visibles. Son architecture Qwen3-Next associe attention hybride, Mixture-of-Experts fortement parcimonieux et…
Qwen3-Next-80B-A3B-Thinking Publié par Qwen le 10 septembre 2025, Qwen3-Next-80B-A3B-Thinking est un LLM open-weights sous licence Apache 2.0, utilisable commercialement. Ses 80 milliards de paramètres reposent sur une architecture Mixture-of-Experts fortement parcimonieuse, avec 3 milliards de paramètres activés.
qwen3-next-80b-a3b-instruct-2509 qwen3-next-80b-a3b-instruct-2509 est un LLM édité par Alibaba Cloud et la Qwen Team. Son profil d’évaluation couvre les connaissances générales, l’éthique, les hallucinations, la classification d’e-mails, les mathématiques et le code.
qwen3-next-80b-a3b-thinking-2509 qwen3-next-80b-a3b-thinking-2509 est un LLM développé par Alibaba Cloud et la Qwen Team. Son profil Benchable est généraliste, avec des résultats élevés en connaissances générales, classification d’e-mails, raisonnement, programmation, éthique et hallucinations.
qwen-plus-2025-01-25 qwen-plus-2025-01-25 est un LLM d’Alibaba Cloud et de la Qwen Team, sorti le 8 septembre 2025. Il se distingue par une fenêtre de contexte de 1 000 000 tokens, adaptée aux volumes de texte particulièrement importants.
Kimi K2 0905 Kimi K2 0905 est un LLM propriétaire de Moonshot AI, lancé le 5 septembre 2025. Son architecture Mixture-of-Experts réunit 1000 milliards de paramètres, dont 32 milliards activés, avec une fenêtre de contexte de 262 144 tokens et des connaissances arrêtées au 31 décembre 2024.
Kimi K2-Instruct-0905 Kimi K2-Instruct-0905 est un LLM de Moonshot AI sorti le 5 septembre 2025. Son échelle constitue son trait distinctif principal, avec 1000 milliards de paramètres.
Mistral Large 3 Mistral Large 3 est un LLM open-weights publié par Mistral AI le 1 septembre 2025. Ses 675 milliards de paramètres le placent parmi les modèles de très grande taille, tandis que sa fenêtre de contexte atteint 128 000 tokens.
LongCat-Flash-Chat Publié par Meituan en août 2025, LongCat-Flash-Chat est un LLM conversationnel non-thinking à poids ouverts, sous licence MIT avec usage commercial autorisé. Son architecture Mixture-of-Experts réunit 560 milliards de paramètres, mais n’en active dynamiquement qu’environ 18,6 à 31,3…
Grok 4 Fast Grok 4 Fast est un LLM propriétaire de xAI, lancé le 28 août 2025. Il se distingue par un positionnement très économique et par une fenêtre de contexte de 2 millions de tokens, conçue pour absorber de très grands volumes de texte au sein d’une même requête.
Grok Code Fast 1 Grok Code Fast 1 est un LLM propriétaire de xAI, sorti le 28 août 2025 et positionné sur le code. Il associe une fenêtre de contexte de 256 000 tokens à une tarification très économique, pensée pour traiter de gros volumes à faible coût.
Qwen: Qwen3 30B A3B Thinking 2507 Qwen: Qwen3 30B A3B Thinking 2507 est un LLM à poids ouverts d’Alibaba Cloud et de la Qwen Team, sorti le 28 août 2025. Son architecture Qwen3-MoE compte 30,5 milliards de paramètres, dont 3,3 milliards activés, avec 8 experts mobilisés parmi 128.
Grok Code Fast Grok Code Fast est un grand modèle de langage développé par xAI. Son nom l’inscrit dans la gamme Grok de l’éditeur.
Nous: Hermes 4 405B Nous: Hermes 4 405B est un LLM à poids ouverts publié par Nous Research le 26 août 2025. Fondé sur Llama-3.1-405B, ce modèle de raisonnement hybride propose une fenêtre de contexte de 131 072 tokens et des connaissances arrêtées au 31 août 2024.
Nous: Hermes 4 70B Publié le 26 août 2025 par Nous Research, Nous: Hermes 4 70B est un LLM à poids ouverts basé sur Llama-3.1-70B. Ce modèle hybride peut produire une réponse directe ou activer un raisonnement explicite dans des segments <think>.
deepseek-chat-v3.1 deepseek-chat-v3.1 est un LLM édité par DeepSeek. Son profil Benchable couvre six domaines, des questions d’éthique au code. Il se caractérise par des scores bruts élevés et réguliers dans l’ensemble de ces évaluations.
Nemotron Nano 9B v2 Publié par NVIDIA le 18 août 2025, Nemotron Nano 9B v2 est un LLM open-weights de 9 milliards de paramètres, utilisable commercialement. Son architecture hybride Nemotron-Hybrid combine principalement des couches Mamba-2 et MLP avec quatre couches d’attention, dans un format relativement…
Mistral: Mistral Medium 3.1 Publié par Mistral AI le 13 août 2025, Mistral: Mistral Medium 3.1 est un LLM généraliste au positionnement très économique. Sa fenêtre de contexte atteint 131 072 tokens et ses connaissances couvrent les informations jusqu'au 30 juin 2025.
GLM-4.5V GLM-4.5V est un modèle vision-langage open weights de Zhipu AI, publié le 11 août 2025 sous licence MIT avec usage commercial autorisé. Il traite le texte, les images, la vidéo et les documents, et peut piloter des interfaces graphiques en localisant des éléments par boîtes englobantes…
AI21: Jamba Large 1.7 AI21: Jamba Large 1.7 est un LLM à poids ouverts publié par AI21 Labs le 8 août 2025. Il se distingue par une fenêtre de contexte de 256 000 tokens. Ses connaissances s'arrêtent au 31 août 2024.
GPT-5.3 Instant GPT-5.3 Instant est un grand modèle de langage édité par OpenAI. Son nom associe la famille GPT à un positionnement « Instant », directement intégré à son appellation.
GPT-5 GPT-5 est un LLM propriétaire d’OpenAI, sorti le 7 août 2025. Il se caractérise par une fenêtre de contexte de 400 000 tokens et des connaissances arrêtées au 30 septembre 2024.
gpt-5-chat-2025-08-07 gpt-5-chat-2025-08-07 est un LLM propriétaire d’OpenAI, sorti le 7 août 2025. Sa fenêtre de contexte de 128 000 tokens offre une capacité étendue, avec des connaissances arrêtées au 30 septembre 2024.
GPT-5 mini GPT-5 mini est un LLM propriétaire d’OpenAI, lancé le 7 août 2025 aux États-Unis. Il se distingue par une fenêtre de contexte de 400 000 tokens, adaptée aux entrées très longues, et par des connaissances arrêtées au 30 mai 2024.
GPT-5 nano GPT-5 nano est un LLM propriétaire lancé par l’éditeur américain OpenAI le 7 août 2025. Son positionnement associe une fenêtre de contexte de 400 000 tokens à une tarification très économique. Ses connaissances s’arrêtent au 30 mai 2024.
GPT OSS 120B GPT OSS 120B est un LLM open-weight publié par OpenAI le 5 août 2025 sous licence Apache 2.0, avec usage commercial autorisé. Ses 117 milliards de paramètres, dont environ 5 milliards actifs, reposent sur une architecture MoE quantifiée en MXFP4, conçue pour fonctionner sur un seul GPU…
GPT OSS 20B GPT OSS 20B est un LLM open-weight d’OpenAI, publié le 5 août 2025 sous licence Apache 2.0, avec usage commercial autorisé. Ses 21 milliards de paramètres, dont 3,6 milliards actifs, ciblent les déploiements locaux, spécialisés ou à plus faible latence.
Claude Opus 4.1 Claude Opus 4.1 est un LLM propriétaire lancé par l’éditeur américain Anthropic le 5 août 2025. Cette offre premium dispose d’une fenêtre de contexte de 200 000 tokens et de connaissances arrêtées au 31 janvier 2025.
Gemini 2.5 Deep Think Gemini 2.5 Deep Think est un LLM de Google, sorti le 1 août 2025 aux États-Unis. Son évaluation disponible met l’accent sur FrontierMath, un benchmark consacré à des problèmes de mathématiques de recherche particulièrement difficiles.
Mistral: Codestral 2508 Sorti le 1 août 2025, Mistral: Codestral 2508 est un LLM de Mistral AI. Il se distingue par une fenêtre de contexte de 256 000 tokens, adaptée au traitement de longues séquences. Ses connaissances s’arrêtent au 31 mars 2025.
Qwen: Qwen3 Coder 30B A3B Instruct Qwen: Qwen3 Coder 30B A3B Instruct est un LLM à poids ouverts d’Alibaba Cloud et de la Qwen Team, sorti le 31 juillet 2025. Orienté vers le développement logiciel, il cible le codage agentique, l’usage agentique du navigateur et la compréhension de dépôts de code.
Qwen: Qwen3 30B A3B Instruct 2507 Publié le 29 juillet 2025 par Alibaba Cloud et la Qwen Team, Qwen3 30B A3B Instruct 2507 est un LLM à poids ouverts. Cette architecture Qwen3-MoE compte 30.5 milliards de paramètres, dont 3.3 milliards activés, avec 128 experts et 8 experts mobilisés. Elle fonctionne uniquement en mode…
GLM-4.5 Publié le 28 juillet 2025 par le chinois Zhipu AI, GLM-4.5 est un LLM fondation de 355 milliards de paramètres, dont 32 milliards actifs. Conçu pour les agents intelligents, il réunit raisonnement, codage et appel d’outils, avec un mode thinking pour les tâches complexes et un mode…
GLM-4.5-Air GLM-4.5-Air est un LLM à poids ouverts lancé par Zhipu AI le 28 juillet 2025. Cette déclinaison compacte de la série GLM-4.5 compte 106 milliards de paramètres, dont 12 milliards actifs, et propose une fenêtre de contexte de 131 072 tokens.
Qwen3 235B A22B Qwen3 235B A22B est un LLM open-weights de Qwen, publié le 25 juillet 2025 sous licence Apache 2.0, avec usage commercial autorisé. Cette architecture mixture-of-experts réunit 235 milliards de paramètres, dont 22 milliards activés, répartis entre 128 experts et 94 couches.
Qwen3-235B-A22B-Thinking-2507 Publié par Qwen le 25 juillet 2025, Qwen3-235B-A22B-Thinking-2507 est un LLM open-weights sous licence Apache 2.0, utilisable commercialement. Son positionnement combine raisonnement approfondi, contexte natif de 262 144 tokens et tarification très économique, inférieure de 92% à la…
qwen3-235b-a22b-04-28 qwen3-235b-a22b-04-28 est un LLM développé par Alibaba Cloud et la Qwen Team. Son profil se distingue surtout en programmation, domaine dans lequel il obtient son résultat le plus compétitif. Le raisonnement constitue également un point fort.
qwen3-235b-a22b-07-25 qwen3-235b-a22b-07-25 est un LLM d’Alibaba Cloud, développé par la Qwen Team. Son profil d’évaluation se distingue surtout par de solides résultats en mathématiques et par des scores maximaux sur plusieurs tests de connaissances, d’éthique et de classification thématique.
Qwen3-235B-A22B-Instruct-2507 Publié par Qwen le 22 juillet 2025, Qwen3-235B-A22B-Instruct-2507 est un LLM causal open-weights sous licence Apache 2.0, avec usage commercial autorisé. Son architecture Qwen3-MoE réunit 235 milliards de paramètres, dont 22 milliards sont activés. Il fonctionne exclusivement en mode…
qwen3-coder-480b-a35b-07-25 qwen3-coder-480b-a35b-07-25 est un LLM édité par Alibaba Cloud et la Qwen Team. Son évaluation couvre la classification de textes, le code, le raisonnement, les mathématiques et le suivi d’instructions.
Devstral Small 1.1 Publié par Mistral AI le 11 juillet 2025, Devstral Small 1.1 est un LLM agentique de 24 milliards de paramètres spécialisé dans le génie logiciel. Affiné à partir de Mistral-Small-3.1, il est conçu pour explorer des bases de code, utiliser des outils et coordonner des modifications dans…
Kimi K2 Base Publié par Moonshot AI le 11 juillet 2025, Kimi K2 Base est le modèle de fondation de la famille Kimi K2. Il cible le fine-tuning et la création de solutions personnalisées, avec un accès open-weights sous licence MIT autorisant l’usage commercial.
Kimi K2 Instruct Publié par Moonshot AI le 11 juillet 2025, Kimi K2 Instruct est un LLM open weights sous licence MIT, utilisable commercialement. Cette variante post-entraînée de Kimi K2 repose sur une architecture Mixture-of-Experts totalisant 1000 milliards de paramètres, dont 32 milliards sont activés.
Devstral Medium Devstral Medium est un LLM propriétaire de Mistral AI, publié le 10 juillet 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, où le renouvellement des modèles est particulièrement rapide.
Grok-4 Heavy Grok-4 Heavy est un LLM propriétaire de xAI, lancé le 10 juillet 2025 aux États-Unis. À sa sortie, il se distinguait sur GPQA en intégrant le top 1 % des 116 modèles de sa génération, soit ceux publiés au cours des 18 mois précédents.
Grok-4 Grok-4 est un LLM propriétaire de xAI, lancé le 9 juillet 2025 aux États-Unis. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA et se situe désormais derrière les modèles frontière plus récents.
Tencent: Hunyuan A13B Instruct Tencent: Hunyuan A13B Instruct est un LLM à poids ouverts publié par Tencent le 8 juillet 2025. À près d’un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, où les modèles évoluent rapidement et disparaissent souvent des catalogues.
Baidu: ERNIE 4.5 VL 424B A47B Sorti le 30 juin 2025, Baidu: ERNIE 4.5 VL 424B A47B est déjà ancien à l’échelle de l’IA. Ce modèle multimodal à poids ouverts traite le texte et l’image, avec une architecture MoE de 424 milliards de paramètres au total et 47 milliards activés par token.
Gemma 3n E2B Gemma 3n E2B est un LLM propriétaire de Google, lancé le 26 juin 2025. Doté de 8 milliards de paramètres, il appartient désormais à une génération ancienne : près d’un an représente une durée très longue dans un secteur où les modèles se renouvellent rapidement.
Gemma 3n E2B Instructed Gemma 3n E2B Instructed est un LLM de Google sorti le 26 juin 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA et doit surtout être replacé dans le contexte des modèles disponibles lors de son lancement.
Gemma 3n E4B Gemma 3n E4B est un LLM propriétaire de Google, publié le 26 juin 2025. Avec environ un an d’ancienneté, il appartient déjà à une génération ancienne à l’échelle de l’IA, où les modèles évoluent rapidement et peuvent disparaître du catalogue de leur éditeur.
Gemma 3n E4B Instructed Gemma 3n E4B Instructed est un LLM propriétaire de Google, lancé le 26 juin 2025. Avec environ un an d’ancienneté, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles plus récents et souvent retirée des catalogues.
ERNIE 4.5 ERNIE 4.5 est un LLM propriétaire de Baidu, lancé le 25 juin 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, où le renouvellement rapide des catalogues tend à reléguer les modèles précédents.
Mistral Small 3.2 24B Instruct Sorti le 20 juin 2025, Mistral Small 3.2 24B Instruct est déjà ancien à l’échelle de l’IA. Près d’un an représente un cycle très long dans ce secteur : le modèle est désormais largement dépassé et souvent retiré du catalogue de son éditeur, Mistral AI.
Gemini 2.5 Flash-Lite Gemini 2.5 Flash-Lite est un LLM de Google sorti le 17 juin 2025. Âgé d’environ un an, il est déjà très ancien à l’échelle de l’IA et probablement dépassé par des modèles plus récents, voire retiré du catalogue de l’éditeur.
MiniMax M1 Publié par MiniMax le 17 juin 2025, MiniMax M1 est un LLM de raisonnement à poids ouverts. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont aujourd’hui largement dépassées.
Magistral Medium Magistral Medium est un LLM de 24 milliards de paramètres publié par Mistral AI le 10 juin 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont probablement dépassées et dont les modèles sont souvent retirés des catalogues.
Magistral Small 2506 Magistral Small 2506 est un LLM de raisonnement de Mistral AI, publié le 10 juin 2025. Ancien d’environ un an, un intervalle très long à l’échelle de l’IA, il appartient désormais à une génération probablement dépassée. À sa sortie, il se classait néanmoins dans le top 29 % des LLM de sa…
Magistral Small 1.1 Magistral Small 1.1 est un LLM de Mistral AI, sorti le 10 juin 2025. Son ancienneté d’environ un an est déjà très importante à l’échelle de l’IA : il appartient à une génération désormais probablement dépassée, dont les modèles sont souvent retirés des catalogues.
Gemini 2.5 Pro Preview 06-05 Gemini 2.5 Pro Preview 06-05 est un LLM propriétaire de Google, publié le 5 juin 2025. Près d’un an plus tard, cette version est déjà ancienne à l’échelle de l’IA et ses résultats doivent être replacés dans le contexte de sa génération. À sa sortie, elle se classait dans le top 3% sur…
Gemini 2.5 Pro Preview Gemini 2.5 Pro Preview est un LLM de Google sorti le 5 juin 2025. Âgé d’environ un an, il est déjà ancien à l’échelle de l’IA et doit être replacé parmi les modèles de sa période.
gemini-2.5-pro-preview-03-25 gemini-2.5-pro-preview-03-25 est un grand modèle de langage de Google. Son profil Benchable se distingue surtout en programmation et en mathématiques, où ses positions relatives sont meilleures que dans les autres épreuves évaluées.
DeepSeek-R1 Sorti le 28 mai 2025, DeepSeek-R1 est déjà ancien à l’échelle de l’IA et désormais probablement dépassé. Ce LLM de raisonnement de DeepSeek repose sur une architecture MoE de 671 milliards de paramètres, dont 37 milliards actifs, avec une fenêtre de contexte de 163 840 tokens. Sa licence…
DeepSeek-R1-0528 DeepSeek-R1-0528 est un LLM open weights de DeepSeek, publié le 28 mai 2025 sous licence MIT, avec usage commercial autorisé. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA et doit être comparé aux modèles de sa période plutôt qu’aux références…
Claude Opus 4 Claude Opus 4 est un LLM propriétaire lancé par Anthropic le 22 mai 2025. Âgé d’environ un an, il est déjà très ancien à l’échelle de l’IA. Ses performances sont désormais largement dépassées, et les versions de cet âge sont souvent retirées du catalogue de leur éditeur.
Claude Sonnet 4 Claude Sonnet 4 est un LLM propriétaire d’Anthropic, sorti le 22 mai 2025. Avec près d’un an d’ancienneté, il appartient déjà à une génération très ancienne à l’échelle de l’IA. Ses performances sont aujourd’hui probablement dépassées et ce type de modèle est souvent retiré du catalogue…
Gemini 2.5 Pro Publié par Google le 20 mai 2025, Gemini 2.5 Pro est un LLM propriétaire dont les poids ne sont pas ouverts. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA et doit être comparé aux modèles de sa période plutôt qu’aux références actuelles.
Gemini 2.5 Flash Gemini 2.5 Flash est un LLM propriétaire de Google, lancé le 20 mai 2025. Désormais ancien à l’échelle de l’IA, il représentait à sa sortie une option performante de sa génération, notamment grâce à une fenêtre de contexte d’environ un million de tokens.
Gemini Diffusion Gemini Diffusion est un LLM propriétaire de Google, lancé le 20 mai 2025. Environ un an après sa sortie, il appartient déjà à une génération ancienne à l’échelle de l’IA, où les modèles évoluent et sont remplacés rapidement.
Gemma 3n E2B Instructed LiteRT (Preview) Gemma 3n E2B Instructed LiteRT (Preview) est un LLM de Google à poids ouverts, publié le 20 mai 2025 sous licence Gemma. Ses 2 milliards de paramètres le placent dans une catégorie de modèles relativement compacts, avec un usage commercial autorisé.
Gemma 3n E4B Instructed LiteRT Preview Gemma 3n E4B Instructed LiteRT Preview est un LLM de Google publié le 20 mai 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont probablement dépassées par celles de modèles plus récents.
MedGemma 4B IT MedGemma 4B IT est un LLM de Google comptant 4 milliards de paramètres. Sorti le 20 mai 2025, il appartient déjà à une génération ancienne à l’échelle de l’IA, où une année suffit à rendre de nombreux modèles moins compétitifs.
Mistral: Mistral Medium 3 Publié le 7 mai 2025 par Mistral AI, Mistral Medium 3 est déjà ancien à l’échelle de l’IA. Environ un an sépare ce LLM des références actuelles, un délai très long dans ce secteur. Les modèles de cette période sont généralement dépassés et souvent retirés du catalogue de leur éditeur.
Arcee AI: Coder Large Sorti le 5 mai 2025, Arcee AI: Coder Large est un LLM d’Arcee AI orienté vers le code. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles plus récents et susceptible de ne plus figurer au catalogue de l’éditeur.
Arcee AI: Virtuoso Large Sorti le 5 mai 2025, Arcee AI: Virtuoso Large est un LLM d’Arcee AI au positionnement très économique. Sa fenêtre de contexte de 131 072 tokens autorise le traitement de volumes de texte importants, tandis que ses connaissances s’arrêtent au 31 mars 2025.
IBM Granite 4.0 Tiny Preview Sorti le 2 mai 2025, IBM Granite 4.0 Tiny Preview est déjà ancien à l’échelle de l’IA. Ce LLM instruct de 7 milliards de paramètres occupait néanmoins une position élevée à son lancement, dans le top 98% des modèles de sa génération sur MMLU.
Phi 4 Mini Sorti le 30 avril 2025, Phi 4 Mini est déjà ancien à l’échelle de l’IA : près d’un an suffit à le séparer nettement des modèles actuels. Microsoft l’a positionné comme un LLM léger de 4 milliards de paramètres, adapté aux environnements contraints en mémoire ou en calcul et aux…
phi-4-mini-instruct phi-4-mini-instruct est un grand modèle de langage édité par Microsoft. Son nom l’inscrit dans la gamme Phi et signale une déclinaison « mini » orientée vers le suivi d’instructions.
Phi 4 Reasoning Sorti le 30 avril 2025, Phi 4 Reasoning est déjà un modèle ancien à l’échelle de l’IA. Microsoft l’a conçu comme une déclinaison de Phi-4 spécialisée dans le raisonnement mathématique, avec une architecture Transformer dense decoder-only de 14 milliards de paramètres.
Phi 4 Reasoning Plus Sorti le 30 avril 2025, Phi 4 Reasoning Plus est un LLM de Microsoft aujourd’hui ancien à l’échelle de l’IA. Ce modèle open-weights sous licence MIT autorise l’usage commercial, mais sa génération est désormais largement dépassée par les modèles plus récents.
Meta: Llama Guard 4 12B Meta: Llama Guard 4 12B est un LLM à poids ouverts publié par Meta le 30 avril 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les modèles sont probablement dépassés et souvent retirés des catalogues.
Qwen3 30B A3B Qwen3 30B A3B est un LLM open-weight publié par Qwen le 29 avril 2025 sous licence Apache 2.0, avec usage commercial autorisé. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA et doit être comparé aux modèles de sa période plutôt qu’aux références…
Qwen3 32B Publié par Qwen le 29 avril 2025, Qwen3 32B appartient déjà à une génération ancienne à l’échelle de l’IA. Près d’un an après sa sortie, ses performances sont probablement dépassées, mais son prix très économique et sa licence Apache 2.0 ouverte à l’usage commercial préservent son…
qwen3-30b-a3b-04-28 qwen3-30b-a3b-04-28 est un LLM édité par Alibaba Cloud et la Qwen Team. Son profil Benchable couvre les connaissances générales, l’éthique, la classification d’e-mails, les hallucinations, le raisonnement et le code.
qwen3-32b-04-28 qwen3-32b-04-28 est un LLM d’Alibaba Cloud / Qwen Team. Son profil Benchable est généraliste, avec des évaluations en General Knowledge, Reasoning, Ethics, Email Classification, Mathematics et Coding.
qwen3-14b-04-28 qwen3-14b-04-28 est un LLM édité par Alibaba Cloud et la Qwen Team. Son profil Benchable couvre le raisonnement, les connaissances générales, le code, l’éthique, la classification d’e-mails et le suivi d’instructions.
qwen3-8b-04-28 qwen3-8b-04-28 est un LLM d’Alibaba Cloud et de la Qwen Team. Son profil Benchable est contrasté : il obtient des scores élevés sur Ethics, Email Classification et General Knowledge, trois épreuves toutefois plafonnées qui départagent peu les modèles.
Granite 3.3 8B Base Sorti le 16 avril 2025, Granite 3.3 8B Base est déjà ancien à l’échelle de l’IA. Ce LLM dense de 8 milliards de paramètres signé IBM appartient désormais à une génération probablement dépassée, souvent retirée des catalogues au profit de modèles plus récents.
Granite 3.3 8B Instruct Granite 3.3 8B Instruct est un modèle de langage open-weights publié par IBM le 16 avril 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont probablement dépassées par celles des modèles plus récents.
o4-mini Publié par OpenAI le 16 avril 2025, o4-mini est un LLM propriétaire dont les poids ne sont pas ouverts. Près d’un an après sa sortie, il est déjà très ancien à l’échelle de l’IA et probablement dépassé par les modèles plus récents.
o3 Sorti le 16 avril 2025, o3 est un LLM propriétaire d’OpenAI. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA. Il se caractérisait à sa sortie par de solides résultats en mathématiques et en sciences, ainsi que par une fenêtre de contexte de 200 000…
GPT-4.1 GPT-4.1 est un LLM propriétaire d’OpenAI, sorti le 14 avril 2025. Près d’un an représente une ancienneté très élevée dans l’IA : le modèle appartient déjà à une génération probablement dépassée, dont les références sont souvent retirées des catalogues.
GPT-4.1 mini GPT-4.1 mini est un LLM propriétaire d’OpenAI, sorti le 14 avril 2025. Près d’un an représente une ancienneté très longue à l’échelle de l’IA : le modèle doit surtout être comparé aux références de sa période, aujourd’hui probablement dépassées et souvent retirées des catalogues.
GPT-4.1 nano GPT-4.1 nano est un LLM propriétaire d’OpenAI, sorti le 14 avril 2025. À environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA. Ses performances se comprennent donc par rapport à son époque : à sa sortie, il figurait dans le top 32% des LLM de sa génération sur…
QWQ-Plus QWQ-Plus est un LLM de Qwen sorti le 8 avril 2025. Âgé de près d’un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, où les modèles évoluent rapidement et peuvent disparaître des catalogues.
Llama 3.1 Nemotron Ultra 253B v1 Publié par NVIDIA le 7 avril 2025, Llama 3.1 Nemotron Ultra 253B v1 est déjà ancien à l’échelle de l’IA. Issu de Llama 3.1 405B Instruct, ce LLM dense de 253 milliards de paramètres a été remanié par recherche d’architecture afin d’intégrer des blocs non standard.
Llama 4 Maverick Publié par Meta le 5 avril 2025, Llama 4 Maverick est déjà ancien à l’échelle de l’IA. Environ un an après sa sortie, ses performances sont largement dépassées et le modèle est souvent absent du catalogue de l’éditeur.
Llama 4 Scout Sorti le 5 avril 2025, Llama 4 Scout est un LLM de Meta qui accuse déjà une ancienneté importante à l’échelle de l’IA. Ses 109 milliards de paramètres et sa fenêtre de contexte de 10 millions de tokens le distinguent, mais ses performances sont désormais probablement dépassées par celles…
deepseek-chat-v3 deepseek-chat-v3 est un LLM édité par DeepSeek. Son évaluation Benchable couvre les hallucinations, l’éthique, les connaissances générales, la classification d’e-mails, les mathématiques et le code. Les scores bruts sont élevés dans l’ensemble de ces domaines.
Qwen2.5-Omni-7B Sorti le 27 mars 2025, Qwen2.5-Omni-7B est désormais ancien à l’échelle de l’IA et largement dépassé par les modèles récents. Qwen l’a conçu comme un modèle multimodal de bout en bout, capable de traiter du texte, des images, de l’audio et de la vidéo.
GPT-4o GPT-4o est un LLM propriétaire d’OpenAI, sorti le 27 mars 2025. Avec environ un an d’ancienneté, il appartient déjà à une génération ancienne à l’échelle de l’IA, aujourd’hui largement dépassée. À son lancement, il se situait néanmoins dans le haut du panier des LLM de sa génération.
DeepSeek-V3 0324 DeepSeek-V3 0324 est un LLM publié par DeepSeek le 25 mars 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA et ses performances sont désormais largement dépassées. À sa sortie, il se classait néanmoins dans le top 20 % des modèles de sa…
deepseek-chat-v3-0324 deepseek-chat-v3-0324 est un LLM édité par DeepSeek. Son profil couvre des tâches variées, de la connaissance générale aux mathématiques et au code, ainsi que la classification d’e-mails, l’éthique et les hallucinations.
DeepSeek-V3 Sorti le 24 mars 2025, DeepSeek-V3 est déjà ancien à l’échelle de l’IA et probablement dépassé par des modèles plus récents. Ce LLM chinois de DeepSeek se distingue surtout par son architecture Mixture-of-Experts de 671 milliards de paramètres, dont 37 milliards sont activés par token,…
Llama 3.1 Nemotron Nano 8B V1 Sorti le 18 mars 2025, Llama 3.1 Nemotron Nano 8B V1 est désormais ancien à l’échelle de l’IA. Ce LLM de NVIDIA compte 8 milliards de paramètres et dérive de Meta Llama 3.1 8B Instruct, avec une architecture Transformer dense à décodeur seul.
Llama-3.3 Nemotron Super 49B v1 Sorti le 18 mars 2025, Llama-3.3 Nemotron Super 49B v1 est un LLM de NVIDIA comptant 50 milliards de paramètres. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA et doit être comparé aux modèles disponibles lors de son lancement plutôt qu’aux systèmes…
Mistral Small 3.1 Mistral Small 3.1 est un LLM publié par Mistral AI le 17 mars 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne, une durée particulièrement longue dans un secteur où les performances progressent rapidement.
Mistral Small 3.1 24B Base Sorti le 17 mars 2025, Mistral Small 3.1 24B Base est un LLM open-weights de Mistral AI. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles plus récents et souvent retirée des catalogues des éditeurs.
Mistral Small 3.1 24B Instruct Mistral Small 3.1 24B Instruct est un LLM de Mistral AI sorti le 17 mars 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA. Cette version affinée par instructions compte 24 milliards de paramètres et possède des poids ouverts sous licence Apache…
Gemma 3 12B Gemma 3 12B est un LLM open-weights de Google, publié le 12 mars 2025 sous licence Gemma, avec usage commercial autorisé. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA et ses performances sont probablement dépassées par celles de modèles plus…
Gemma 3 1B Gemma 3 1B est un LLM open-weights de Google, publié le 12 mars 2025 sous licence Gemma, avec un usage commercial autorisé. Son format d’un milliard de paramètres le positionne comme une déclinaison compacte, associée à une fenêtre de contexte de 32 000 tokens.
Gemma 3 27B Gemma 3 27B est un LLM open-weights de Google, publié le 12 mars 2025 sous licence Gemma, avec usage commercial autorisé. Son ancienneté d’environ un an est déjà très importante à l’échelle de l’IA : ses performances doivent être replacées face aux modèles de sa période, plutôt qu’aux…
Gemma 3 4B Gemma 3 4B est un LLM de Google publié le 12 mars 2025. Avec 4 milliards de paramètres, il associe un format relativement compact à une fenêtre de contexte de 131 072 tokens. Près d’un an après sa sortie, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement…
gpt-4o-mini-search-preview-2025-03-11 gpt-4o-mini-search-preview-2025-03-11 est un LLM propriétaire d’OpenAI, sorti le 12 mars 2025. Près d’un an représente une ancienneté très importante dans l’IA générative : ses performances sont probablement dépassées et les références de cette période sont souvent retirées du catalogue…
gpt-4o-search-preview-2025-03-11 Publié par OpenAI le 12 mars 2025, gpt-4o-search-preview-2025-03-11 est un LLM propriétaire au positionnement économique. Âgé d’environ un an, il appartient déjà à une génération très ancienne à l’échelle de l’IA, probablement dépassée par les modèles actuels et souvent retirée des…
Reka Flash 3 Reka Flash 3 est un LLM de raisonnement généraliste de 21 milliards de paramètres, publié par Reka AI le 12 mars 2025 avec des poids ouverts. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA et ses performances sont probablement dépassées par celles…
Sonar Pro Sonar Pro est un LLM propriétaire lancé par Perplexity le 7 mars 2025. Sa fenêtre de contexte de 200 000 tokens et son positionnement économique constituent ses principaux traits distinctifs, avec un coût inférieur à celui des modèles comparables.
QwQ-32B QwQ-32B est un LLM causal de 32 milliards de paramètres publié par Qwen le 5 mars 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles plus récents et souvent retirée des catalogues.
Qwen2.5 VL 32B Instruct Sorti le 28 février 2025, Qwen2.5 VL 32B Instruct est déjà ancien à l’échelle de l’IA, où une année suffit à séparer plusieurs générations. Ce modèle vision-langage de Qwen compte 34 milliards de paramètres et associe traitement du texte, des images, des graphiques, des mises en page et…
GPT-4.5 Sorti le 27 février 2025, GPT-4.5 est un LLM propriétaire américain développé par OpenAI. À près d’un an, il appartient déjà à une génération ancienne à l’échelle de l’IA. Ses performances sont aujourd’hui largement dépassées et le modèle est souvent retiré du catalogue de l’éditeur.
Claude 3.7 Sonnet Claude 3.7 Sonnet est un LLM propriétaire lancé par Anthropic le 24 février 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles haut de gamme plus récents.
Grok-3 Lancé le 17 février 2025 par l’américain xAI, Grok-3 est un LLM propriétaire de 3000 milliards de paramètres, doté d’une fenêtre de contexte de 131 072 tokens et de connaissances arrêtées au 17 novembre 2024. Environ un an après sa sortie, il est déjà ancien à l’échelle de l’IA et…
Grok-3 Mini Grok-3 Mini est un LLM propriétaire de xAI, lancé le 17 février 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, aujourd’hui largement dépassée par les modèles plus récents. Ses connaissances s’arrêtent au 17 novembre 2024.
Gemini 2.0 Flash-Lite Gemini 2.0 Flash-Lite est un LLM propriétaire de Google, lancé le 5 février 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les modèles sont probablement dépassés et souvent retirés des catalogues des éditeurs.
Gemini 2.0 Pro Exp Avec environ un an d’ancienneté, Gemini 2.0 Pro Exp est déjà très ancien à l’échelle de l’IA. Ce LLM de Google, lancé le 5 février 2025, appartient à une génération rapidement dépassée par le rythme de renouvellement des modèles.
AionLabs: Aion-1.0 AionLabs: Aion-1.0 est un grand modèle de langage publié par Aion Labs le 4 février 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, où les renouvellements de modèles sont particulièrement rapides.
AionLabs: Aion-1.0-Mini Publié par Aion Labs le 4 février 2025, AionLabs: Aion-1.0-Mini est déjà ancien à l’échelle de l’IA. Environ un an après sa sortie, il appartient à une génération probablement dépassée par les modèles récents et souvent retirée des catalogues.
Phi-4-multimodal-instruct Sorti le 1er février 2025, Phi-4-multimodal-instruct est un modèle de fondation multimodal léger de Microsoft. Ses 6 milliards de paramètres traitent conjointement le texte, l’image et l’audio, avec une sortie exclusivement textuelle et une fenêtre de contexte de 131 072 tokens.
Qwen: Qwen-Turbo Publié par Qwen le 1er février 2025, Qwen-Turbo est déjà un modèle ancien à l’échelle de l’IA. Environ un an après sa sortie, il appartient à une génération probablement dépassée, dont les modèles sont souvent retirés des catalogues au profit de versions plus récentes.
Qwen3-Coder 480B A35B Instruct Qwen3-Coder 480B A35B Instruct est un LLM open-weights de Qwen, publié sous licence Apache 2.0 le 31 janvier 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles plus récents.
Mistral Small 3 24B Base Sorti le 30 janvier 2025, Mistral Small 3 24B Base est un modèle de langage de base de Mistral AI. Son ancienneté d’environ un an est déjà très longue à l’échelle de l’IA : il doit être comparé aux modèles de sa génération, ses performances étant probablement dépassées aujourd’hui.
Mistral Small 3 24B Instruct Publié par Mistral AI le 30 janvier 2025, Mistral Small 3 24B Instruct est déjà ancien à l’échelle de l’IA. Ce modèle de 24 milliards de paramètres, affiné pour suivre des instructions, correspond désormais davantage à une génération passée qu’aux offres les plus récentes.
o3-mini Publié par OpenAI le 30 janvier 2025, o3-mini est un LLM propriétaire à poids non ouverts. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA et ses performances doivent être replacées dans le contexte de sa sortie.
Sonar Sonar est un LLM propriétaire lancé par Perplexity le 29 janvier 2025. Son ancienneté d’environ un an est déjà très longue à l’échelle de l’IA : les modèles de cette période sont souvent dépassés ou retirés des catalogues au rythme des nouvelles générations.
Qwen2.5 VL 72B Instruct Publié par Qwen le 26 janvier 2025, Qwen2.5 VL 72B Instruct est un modèle vision-langage de 72 milliards de paramètres, ajusté pour suivre des instructions et produire du texte à partir d’images et de texte. Âgé d’environ un an, il appartient déjà à une génération probablement dépassée,…
Qwen2.5 VL 7B Instruct Publié par Qwen le 26 janvier 2025, Qwen2.5 VL 7B Instruct est déjà ancien à l’échelle de l’IA : environ un an suffit à le placer derrière plusieurs générations plus récentes. Ce modèle vision-langage, ajusté pour suivre des instructions en anglais, transforme des contenus visuels et…
Mistral Small 3 Publié par Mistral AI le 25 janvier 2025, Mistral Small 3 est un LLM désormais ancien à l’échelle de l’IA. Après environ un an, il appartient à une génération déjà largement dépassée par le rythme de renouvellement du secteur.
qwen2.5-max Publié le 25 janvier 2025, qwen2.5-max est un LLM de Qwen désormais ancien à l’échelle de l’IA. Environ un an après sa sortie, il appartient déjà à une génération dont les performances sont largement dépassées, et les modèles de cet âge ont souvent quitté le catalogue de leur éditeur.
Gemini 2.0 Flash Gemini 2.0 Flash est un LLM propriétaire de Google, lancé le 21 janvier 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles plus récents et susceptible d’avoir été retirée du catalogue de l’éditeur.
Gemini 2.0 Flash Experimental Gemini 2.0 Flash Experimental est déjà un modèle ancien à l’échelle de l’IA. Google a lancé ce LLM expérimental le 21 janvier 2025, il y a environ un an. Il appartient à une génération aujourd’hui largement dépassée et souvent retirée du catalogue de l’éditeur.
DeepSeek R1 Distill Llama 70B DeepSeek R1 Distill Llama 70B est un LLM dense de 71 milliards de paramètres, publié par DeepSeek le 20 janvier 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée et souvent retirée des catalogues actuels.
DeepSeek R1 Distill Llama 8B Publié par DeepSeek le 20 janvier 2025, DeepSeek R1 Distill Llama 8B est déjà ancien à l’échelle de l’IA. Ses performances doivent donc être replacées face aux modèles de sa période, alors qu’il est probablement dépassé et que les modèles de cet âge sont souvent retirés des catalogues.
DeepSeek R1 Distill Qwen 1.5B DeepSeek R1 Distill Qwen 1.5B est un petit LLM dense de DeepSeek, sorti le 20 janvier 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles plus récents et souvent retirée des catalogues.
DeepSeek R1 Distill Qwen 14B DeepSeek R1 Distill Qwen 14B est un LLM dense de 15 milliards de paramètres publié par DeepSeek le 20 janvier 2025. Basé sur Qwen2.5-14B, il a été affiné avec des échantillons produits par DeepSeek-R1 afin de transférer des schémas de raisonnement vers un modèle plus petit.
DeepSeek R1 Distill Qwen 32B DeepSeek R1 Distill Qwen 32B est un LLM dense de DeepSeek, sorti le 20 janvier 2025. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles plus récents et souvent retirée des catalogues.
DeepSeek R1 Distill Qwen 7B Sorti en janvier 2025, DeepSeek R1 Distill Qwen 7B est déjà ancien à l’échelle de l’IA. Ce LLM dense de DeepSeek condense des schémas de raisonnement issus de DeepSeek-R1 dans un modèle de 8 milliards de paramètres, construit à partir de Qwen2.5-Math-7B.
DeepSeek R1 Zero Sorti le 20 janvier 2025, DeepSeek R1 Zero est déjà ancien à l’échelle de l’IA. Ce LLM de DeepSeek se distinguait alors par un entraînement de raisonnement fondé sur l’apprentissage par renforcement à grande échelle, appliqué directement à DeepSeek-V3-Base sans fine-tuning supervisé…
Kimi-k1.5 Kimi-k1.5 est un LLM propriétaire lancé le 20 janvier 2025 par l’entreprise chinoise Moonshot AI. À sa sortie, il se plaçait dans le top 10% sur MMLU parmi 50 modèles de sa génération, un résultat qui le situait alors dans le haut du panier.
MiniMax: MiniMax-01 Publié par MiniMax le 15 janvier 2025, MiniMax-01 est un LLM à poids ouverts désormais ancien à l’échelle de l’IA. Près de deux ans après sa sortie, il appartient à une génération probablement dépassée. Sa caractéristique majeure reste sa fenêtre de contexte d’environ un million de tokens.
DeepSeek-V3.1 DeepSeek-V3.1 est un LLM open-weights de DeepSeek, publié le 10 janvier 2025 sous licence MIT, avec usage commercial autorisé. Âgé d’environ un an, il appartient déjà à une génération ancienne à l’échelle de l’IA et doit surtout être replacé parmi les modèles de sa période.
QvQ-72B-Preview Publié par Qwen le 25 décembre 2024, QvQ-72B-Preview est un LLM expérimental de 73 milliards de paramètres consacré au raisonnement visuel. Près de deux ans après sa sortie, il appartient déjà à une génération ancienne à l’échelle de l’IA, aujourd’hui largement dépassée par les modèles…
o1-pro Publié le 17 décembre 2024 par OpenAI, o1-pro est un LLM propriétaire américain positionné sur le segment premium. À sa sortie, il figurait dans le top 4% des modèles de sa génération sur GPQA, un résultat qui le plaçait alors parmi les systèmes les plus performants en raisonnement…
o1 Sorti le 17 décembre 2024, o1 est un LLM propriétaire d’OpenAI au positionnement premium. Près de deux ans plus tard, il appartient déjà à une génération ancienne à l’échelle de l’IA. Sa fenêtre de contexte de 200 000 tokens reste l’une de ses caractéristiques marquantes.
Cohere: Command R7B (12-2024) Publié par Cohere le 14 décembre 2024, Cohere: Command R7B (12-2024) est un LLM aujourd’hui ancien à l’échelle de l’IA. Près de deux ans après sa sortie, il appartient à une génération probablement dépassée et souvent retirée du catalogue de son éditeur.
DeepSeek VL2 Sorti le 13 décembre 2024, DeepSeek VL2 est un modèle vision-langage de DeepSeek. Désormais ancien à l’échelle de l’IA, il appartient à une génération probablement dépassée par les modèles récents et susceptible d’avoir quitté le catalogue de son éditeur.
DeepSeek VL2 Small Sorti le 13 décembre 2024, DeepSeek VL2 Small est un modèle vision-langage de DeepSeek aujourd’hui ancien à l’échelle de l’IA. Cette variante de 16 milliards de paramètres appartient à une série fondée sur une architecture Mixture-of-Experts et s’appuie sur DeepSeekMoE-16B.
DeepSeek VL2 Tiny Publié par DeepSeek le 13 décembre 2024, DeepSeek VL2 Tiny est un modèle vision-langage de 3 milliards de paramètres. Près de deux ans représentent une ancienneté très importante dans l’IA : cette génération est désormais probablement dépassée par les modèles plus récents.
Phi 4 Publié par Microsoft le 12 décembre 2024, Phi 4 est un LLM open-weights sous licence MIT, utilisable commercialement. Près de deux ans représentent une très longue période en IA : ce modèle de 15 milliards de paramètres appartient désormais à une génération probablement dépassée et peut…
Llama 3.3 70B Llama 3.3 70B est un LLM de 70 milliards de paramètres publié par Meta aux États-Unis le 6 décembre 2024. Désormais ancien d’environ deux ans, un intervalle très long à l’échelle de l’IA, il doit être replacé parmi les modèles de sa période plutôt que comparé directement aux systèmes…
Llama 3.3 70B Instruct Publié par Meta le 6 décembre 2024, Llama 3.3 70B Instruct est un LLM de 70 milliards de paramètres désormais ancien à l’échelle de l’IA. À sa sortie, il se classait dans le top 36% des modèles de sa génération sur GPQA, un positionnement solide pour sa période.
nova-micro-v1 nova-micro-v1 est un LLM propriétaire d’Amazon. Son profil Benchable apparaît contrasté : les scores bruts sont élevés en Ethics, General Knowledge et Hallucinations, mais les classements correspondants restent en retrait.
nova-pro-v1 nova-pro-v1 est un LLM propriétaire édité par Amazon. Son profil Benchable se distingue surtout en Email Classification, où son classement relatif est nettement meilleur que dans les autres tâches évaluées.
QwQ-32B-Preview Publié par Qwen le 28 novembre 2024, QwQ-32B-Preview est un LLM causal expérimental consacré au raisonnement. Âgé d’environ deux ans, il appartient déjà à une génération ancienne à l’échelle de l’IA et doit être replacé dans le contexte des modèles disponibles lors de sa sortie.
Tulu 3 (Tülu 3) 70B Sorti le 21 novembre 2024, Tulu 3 (Tülu 3) 70B est un LLM de l’Allen Institute for AI. Âgé d’environ deux ans, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les modèles sont généralement dépassés et souvent retirés des catalogues.
Nova Lite Nova Lite est un LLM propriétaire lancé par Amazon le 20 novembre 2024. Près de deux ans après sa sortie, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont probablement dépassées et dont les modèles sont souvent retirés des catalogues.
Nova Micro Nova Micro est un LLM propriétaire lancé par Amazon le 20 novembre 2024. Près de deux ans plus tard, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont largement dépassées par celles des modèles plus récents.
Nova Pro Nova Pro est un LLM propriétaire d’Amazon, sorti le 20 novembre 2024. Avec environ deux ans d’ancienneté, il appartient déjà à une génération très ancienne à l’échelle de l’IA, aujourd’hui probablement dépassée et souvent retirée des catalogues.
Mistral Large 2407 Mistral Large 2407 est un LLM de Mistral AI sorti le 19 novembre 2024. Près de deux ans plus tard, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont aujourd’hui largement dépassées.
Pixtral Large Sorti le 18 novembre 2024, Pixtral Large est un LLM multimodal français de Mistral AI. Ce modèle de 124 milliards de paramètres associe un décodeur multimodal de 123 milliards à un encodeur visuel de 1 milliard, sur une base Mistral Large 2.
Claude 3.5 Haiku Claude 3.5 Haiku est un LLM propriétaire d’Anthropic, sorti le 4 novembre 2024. Près de deux ans représentent une ancienneté très importante dans l’IA générative : le modèle appartient désormais à une génération largement dépassée par les systèmes récents.
Claude 3.5 Sonnet Claude 3.5 Sonnet est un LLM propriétaire d’Anthropic, éditeur américain, sorti le 22 octobre 2024. Près de deux ans représentent une très longue période dans l’IA : ce modèle appartient désormais à une génération ancienne, largement dépassée par les systèmes haut de gamme plus récents.
Mistral: Ministral 3B Mistral: Ministral 3B est un LLM publié par Mistral AI le 17 octobre 2024. Près de deux ans après sa sortie, il appartient déjà à une génération ancienne à l’échelle de l’IA et ses résultats le situent loin des modèles haut de gamme actuels.
Mistral: Ministral 8B Publié par Mistral AI le 17 octobre 2024, Mistral: Ministral 8B est un LLM désormais ancien à l’échelle de l’IA. Près de deux ans après sa sortie, il appartient à une génération probablement dépassée par les modèles plus récents et susceptible de ne plus occuper une place centrale dans…
Ministral 8B Instruct Sorti le 16 octobre 2024, Ministral 8B Instruct est un LLM de Mistral AI comptant 8 milliards de paramètres. Âgé d’environ deux ans, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont désormais largement dépassées.
Inflection: Inflection 3 Pi Inflection 3 Pi est un LLM propriétaire publié par Inflection le 11 octobre 2024. Près de deux ans après sa sortie, il appartient déjà à une génération ancienne à l’échelle de l’IA et ses performances sont probablement dépassées par celles des modèles plus récents.
Inflection: Inflection 3 Productivity Inflection: Inflection 3 Productivity est un LLM propriétaire d’Inflection, lancé le 11 octobre 2024. À près de deux ans, il appartient déjà à une génération ancienne à l’échelle de l’IA. Ses performances sont probablement dépassées, et les modèles de cette période sont souvent retirés…
Llama 3.1 Nemotron 70B Instruct Publié par NVIDIA le 1 octobre 2024, Llama 3.1 Nemotron 70B Instruct est un LLM de 70 milliards de paramètres fondé sur Llama 3.1. Âgé d’environ deux ans, il appartient désormais à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles plus récents.
Llama 3.2 11B Instruct Publié par Meta le 25 septembre 2024, Llama 3.2 11B Instruct est un LLM de 11 milliards de paramètres désormais ancien à l’échelle de l’IA. Près de deux ans après sa sortie, il appartient à une génération probablement dépassée et souvent retirée des catalogues des éditeurs.
Llama 3.2 3B Instruct Publié par Meta le 25 septembre 2024, Llama 3.2 3B Instruct est un LLM de 3 milliards de paramètres destiné au suivi d’instructions. Près de deux ans après sa sortie, il appartient déjà à une génération ancienne à l’échelle de l’IA et ses performances apparaissent largement dépassées.
Llama 3.2 90B Instruct Publié par Meta le 25 septembre 2024, Llama 3.2 90B Instruct est un LLM open-weights de 90 milliards de paramètres, sous licence Llama 3.2 avec usage commercial autorisé. Sa fenêtre de contexte atteint 131 072 tokens et ses connaissances s’arrêtent au 31 décembre 2023.
Meta: Llama 3.2 1B Instruct Meta: Llama 3.2 1B Instruct est un LLM à poids ouverts lancé par Meta le 25 septembre 2024. À près de deux ans, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par des modèles plus récents. Ses connaissances s’arrêtent au 31 décembre 2023.
Llama 3.2 90B Llama 3.2 90B est un LLM publié par Meta le 24 septembre 2024. À sa sortie, il se plaçait dans le tiers supérieur des modèles de sa génération sur GPQA diamond, un test exigeant de questions scientifiques de niveau doctorat.
Qwen2.5 14B Instruct Qwen2.5 14B Instruct est un LLM open-weights de Qwen, publié le 19 septembre 2024 sous licence Apache 2.0, avec usage commercial autorisé. Âgé de près de deux ans, il appartient déjà à une génération ancienne à l’échelle de l’IA et doit être comparé aux modèles de sa période.
Qwen2.5 32B Instruct Publié par Qwen en septembre 2024, Qwen2.5 32B Instruct est désormais un LLM ancien à l’échelle de l’IA, proche de deux ans d’ancienneté. À sa sortie, il se situait dans le tiers supérieur des 35 modèles de sa génération évalués sur GPQA.
Qwen2.5 72B Instruct Publié par Qwen le 19 septembre 2024, Qwen2.5 72B Instruct est désormais un LLM ancien à l’échelle de l’IA, probablement dépassé par les modèles récents. À sa sortie, il se classait néanmoins dans le top 37% des LLM de sa génération sur GPQA.
Qwen2.5 7B Instruct Publié par Qwen le 19 septembre 2024, Qwen2.5 7B Instruct est un LLM open-weights sous licence Apache 2.0, utilisable commercialement. Désormais ancien à l’échelle de l’IA, il appartient à une génération probablement dépassée et souvent retirée des catalogues.
Qwen2.5-Coder 32B Instruct Qwen2.5-Coder 32B Instruct est un LLM de Qwen spécialisé dans la génération, le raisonnement et la correction de code. Sorti le 19 septembre 2024, il approche déjà deux ans, une ancienneté très importante dans l’IA. Ses connaissances s’arrêtent au 30 juin 2024.
Qwen2.5-Coder 7B Instruct Qwen2.5-Coder 7B Instruct est un LLM open-weights publié par Qwen en septembre 2024. Conçu comme une déclinaison Coder au format Instruct, il associe 7 milliards de paramètres à une fenêtre de contexte particulièrement étendue. Sa licence Apache 2.0 autorise les usages commerciaux.
Qwen2.5-72B Qwen2.5-72B est un LLM de 73 milliards de paramètres publié par l’éditeur chinois Qwen le 19 septembre 2024. Âgé d’environ deux ans, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles plus récents et souvent absente des catalogues…
Pixtral-12B Sorti le 17 septembre 2024, Pixtral-12B est un LLM multimodal de Mistral AI, aujourd’hui ancien à l’échelle de l’IA. Près de deux ans après son lancement, il appartient à une génération probablement dépassée par les modèles récents et susceptible de ne plus figurer dans les catalogues…
Qwen2.5-32B Qwen2.5-32B est un LLM chinois de 32 milliards de paramètres, publié par Qwen le 17 septembre 2024. Près de deux ans plus tard, il appartient à une génération déjà très ancienne à l’échelle de l’IA, probablement dépassée et souvent retirée des catalogues au profit de modèles plus récents.
o1-mini Publié par OpenAI le 12 septembre 2024, o1-mini est un LLM propriétaire dont les poids ne sont pas ouverts. Près de deux ans après sa sortie, il appartient déjà à une génération ancienne à l’échelle de l’IA, aujourd’hui probablement dépassée et souvent retirée des catalogues.
o1-preview Publié par OpenAI le 12 septembre 2024, o1-preview est un LLM propriétaire positionné sur le segment premium. Près de deux ans plus tard, il appartient à une génération déjà très ancienne à l’échelle de l’IA, probablement dépassée par des modèles plus récents et susceptible d’avoir…
Cohere: Command R (08-2024) Cohere: Command R (08-2024) est un LLM à poids ouverts publié par Cohere le 30 août 2024. Près de deux ans plus tard, son ancienneté est très importante à l’échelle de l’IA. Le modèle appartient désormais à une génération probablement dépassée. Ses connaissances s’arrêtent au 31 mars…
Qwen2-VL-72B-Instruct Publié par Qwen le 29 août 2024, Qwen2-VL-72B-Instruct est un LLM multimodal de 73 milliards de paramètres, ajusté pour suivre des instructions à partir de texte, d’images et de vidéos. Près de deux ans après sa sortie, il appartient déjà à une génération ancienne à l’échelle de l’IA et…
Phi-3.5-mini-instruct Sorti le 23 août 2024, Phi-3.5-mini-instruct est un LLM léger de Microsoft comptant 4 milliards de paramètres. Près de deux ans plus tard, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont probablement dépassées par celles des modèles plus…
Phi-3.5-MoE-instruct Sorti le 23 août 2024, Phi-3.5-MoE-instruct est un LLM open-weights de Microsoft sous licence MIT, avec usage commercial autorisé. Âgé d’environ deux ans, il appartient déjà à une génération ancienne à l’échelle de l’IA et ses performances sont désormais probablement dépassées.
Phi-3.5-vision-instruct Publié par Microsoft le 23 août 2024, Phi-3.5-vision-instruct est un modèle multimodal ouvert de la famille Phi-3. Avec près de deux ans d’ancienneté, il appartient déjà à une génération ancienne à l’échelle de l’IA et ses performances doivent être replacées dans le contexte de sa sortie.
Jamba 1.5 Large Jamba 1.5 Large est un LLM de 398 milliards de paramètres publié par AI21 Labs le 22 août 2024. Près de deux ans plus tard, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont probablement dépassées par celles des modèles plus récents.
Jamba 1.5 Mini Jamba 1.5 Mini est un LLM de 52 milliards de paramètres publié par AI21 Labs le 22 août 2024. Près de deux ans plus tard, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont probablement dépassées par celles des modèles récents.
Hermes 3 70B Hermes 3 70B est un LLM généraliste open-weights de Nous Research, publié le 15 août 2024 sous licence Apache 2.0. Âgé d’environ deux ans, il appartient déjà à une génération ancienne à l’échelle de l’IA et ses performances sont probablement dépassées par celles des modèles récents.
Grok-2 Grok-2 est un LLM propriétaire de xAI, lancé aux États-Unis le 13 août 2024. Près de deux ans plus tard, il appartient à une génération ancienne à l’échelle de l’IA, désormais largement dépassée par les modèles haut de gamme plus récents.
Grok-2 mini Grok-2 mini est un LLM propriétaire lancé par xAI le 13 août 2024. Près de deux ans plus tard, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont probablement dépassées par celles des modèles plus récents.
Mistral Large 2 Publié le 24 juillet 2024 par le français Mistral AI, Mistral Large 2 est un LLM de 123 milliards de paramètres doté d’une fenêtre de contexte de 128 000 tokens. Près de deux ans après sa sortie, il appartient déjà à une génération ancienne à l’échelle de l’IA et se trouve probablement…
Llama 3.1-405B Publié par Meta aux États-Unis le 23 juillet 2024, Llama 3.1-405B est un LLM de 405 milliards de paramètres. Près de deux ans après sa sortie, il appartient déjà à une génération ancienne à l’échelle de l’IA et ses performances sont probablement dépassées par celles des modèles plus…
Llama 3.1-70B Llama 3.1-70B est un grand modèle de langage publié par Meta le 23 juillet 2024. À sa sortie, il se plaçait dans le haut du panier de sa génération sur GPQA diamond, un benchmark de questions scientifiques de niveau doctorat.
Llama 3.1 405B Instruct Sorti le 23 juillet 2024, Llama 3.1 405B Instruct est déjà ancien à l’échelle de l’IA. Ce LLM de Meta appartient désormais à une génération probablement dépassée par les modèles haut de gamme plus récents.
Llama 3.1 70B Instruct Publié par Meta le 23 juillet 2024, Llama 3.1 70B Instruct est un LLM de 70 milliards de paramètres conçu pour suivre des instructions. Près de deux ans après sa sortie, il appartient déjà à une génération ancienne à l’échelle de l’IA et se trouve probablement dépassé par des modèles…
Llama 3.1 8B Instruct Publié par Meta le 23 juillet 2024, Llama 3.1 8B Instruct est désormais ancien à l’échelle de l’IA. Avec 8 milliards de paramètres, il représente un LLM compact de sa période, aujourd’hui probablement dépassé et souvent retiré des catalogues de l’éditeur.
Qwen2 72B Instruct Qwen2 72B Instruct est un LLM de Qwen sorti le 23 juillet 2024. Avec environ deux ans d’ancienneté, il appartient déjà à une génération ancienne à l’échelle de l’IA et doit être replacé parmi les modèles disponibles lors de son lancement, plutôt que comparé directement aux systèmes…
Qwen2 7B Instruct Qwen2 7B Instruct est un LLM de Qwen publié le 23 juillet 2024. Âgé de près de deux ans, il appartient désormais à une génération ancienne à l’échelle de l’IA, dont les performances sont largement dépassées par les modèles récents.
Llama 3.1-8B Llama 3.1-8B est un LLM publié par Meta le 23 juillet 2024. Près de deux ans après sa sortie, il appartient déjà à une génération ancienne à l’échelle de l’IA, où les évolutions de performances et les renouvellements de catalogues sont rapides.
Mistral NeMo Instruct Sorti le 18 juillet 2024, Mistral NeMo Instruct est un LLM de 12 milliards de paramètres développé conjointement par Mistral AI et NVIDIA. Près de deux ans plus tard, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles plus récents et…
GPT-4o mini GPT-4o mini est un LLM propriétaire lancé par OpenAI le 18 juillet 2024. Près de deux ans après sa sortie, il est déjà très ancien à l’échelle de l’IA et largement distancé par les modèles plus récents.
Mistral NeMo Publié par Mistral AI le 18 juillet 2024, Mistral NeMo appartient déjà à une génération ancienne de LLM. Près de deux ans représentent une durée très longue dans l’IA, où les modèles sont rapidement dépassés et fréquemment retirés des catalogues.
Gemma 2 27B Gemma 2 27B est un LLM open-weights de Google, publié le 27 juin 2024 sous licence Gemma, avec usage commercial autorisé. Ses 27 milliards de paramètres et sa fenêtre de contexte de 8 192 tokens le rattachent à une génération désormais ancienne, près de deux ans représentant une durée…
Gemma 2 9B Gemma 2 9B est un LLM open-weights de Google, publié le 27 juin 2024 sous licence Gemma, avec usage commercial autorisé. Ses 9 milliards de paramètres, sa fenêtre de contexte de 8 192 tokens et ses connaissances arrêtées au 30 juin 2024 définissent un modèle compact par son nombre de…
Qwen2-72B Qwen2-72B est un LLM chinois de 73 milliards de paramètres, publié par Qwen le 7 juin 2024. Près de deux ans plus tard, il appartient déjà à une génération ancienne à l’échelle de l’IA, où les progrès rapides rendent les modèles fréquemment dépassés ou retirés des catalogues.
Codestral-22B Publié par Mistral AI le 29 mai 2024, Codestral-22B est un modèle de langage causal de 22 milliards de paramètres spécialisé dans le code. Près de deux ans après sa sortie, il appartient déjà à une génération ancienne à l’échelle de l’IA, dont les performances sont aujourd’hui…
Mistral 7B Mistral 7B est un LLM de Mistral AI sorti le 27 mai 2024. Près de deux ans plus tard, il appartient déjà à une génération ancienne à l’échelle de l’intelligence artificielle, où les performances et les catalogues évoluent rapidement.
ChatGPT-4o Latest ChatGPT-4o Latest est un LLM propriétaire d’OpenAI, lancé le 13 mai 2024. Âgé d’environ deux ans, il est déjà très ancien à l’échelle de l’IA et reflète surtout l’état du marché au moment de sa sortie, lorsqu’il se situait dans le haut du panier de sa génération.
DeepSeek-V2.5 DeepSeek-V2.5 est un LLM de DeepSeek sorti le 8 mai 2024. Près de deux ans plus tard, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée par les modèles haut de gamme plus récents et souvent retirée des catalogues.
Gemini 1.5 Flash Gemini 1.5 Flash est un LLM propriétaire de Google, lancé le 1 mai 2024 avec des poids non ouverts. Sa caractéristique la plus marquante reste sa fenêtre de contexte de 1 048 576 tokens, soit environ un million, associée à des connaissances arrêtées au 1er novembre 2023.
Gemini 1.5 Pro Gemini 1.5 Pro est un LLM propriétaire de Google, lancé le 1 mai 2024 aux États-Unis. Âgé d’environ deux ans, il appartient déjà à une génération ancienne à l’échelle de l’IA, où le renouvellement des modèles est particulièrement rapide.
phi-3-medium 14B Publié par Microsoft le 23 avril 2024, phi-3-medium 14B est un LLM désormais ancien à l’échelle de l’IA. Près de deux ans après sa sortie, il appartient à une génération probablement dépassée et souvent retirée des catalogues des éditeurs.
Llama 3-8B Publié par Meta le 18 avril 2024, Llama 3-8B est un LLM désormais ancien à l’échelle de l’IA. Près de deux ans après sa sortie, il appartient à une génération largement dépassée par les modèles plus récents et souvent retirée des catalogues des éditeurs.
Meta: Llama 3 8B Instruct Publié par Meta le 18 avril 2024, Llama 3 8B Instruct est un LLM ancien à l’échelle de l’IA. Près de deux ans après sa sortie, il appartient à une génération probablement dépassée et susceptible de ne plus figurer au catalogue courant de son éditeur.
Llama 3-70B Publié par Meta le 18 avril 2024, Llama 3-70B est un LLM américain de 70 milliards de paramètres. Près de deux ans après sa sortie, il appartient déjà à une génération très ancienne à l’échelle de l’IA. Ses performances sont probablement dépassées et les modèles de cet âge sont souvent…
Mixtral 8x22B Mixtral 8x22B est un LLM publié par Mistral AI le 17 avril 2024. À sa sortie, il se plaçait dans la moitié supérieure des modèles de sa génération sur GPQA diamond, un test consacré aux questions scientifiques de niveau doctorat.
Mistral: Mixtral 8x22B Instruct Publié par Mistral AI le 17 avril 2024, Mixtral 8x22B Instruct appartient désormais à une génération ancienne à l’échelle de l’IA. Cette version de Mixtral 8x22B est affinée pour suivre des instructions. Ses poids sont ouverts, sa fenêtre de contexte atteint 65 536 tokens et ses…
WizardLM-2 8x22B WizardLM-2 8x22B est un LLM à poids ouverts publié par Microsoft le 16 avril 2024. Près de deux ans plus tard, il est ancien à l’échelle de l’IA : ses performances sont probablement dépassées et le modèle n’est souvent plus proposé dans les catalogues actuels de l’éditeur.
Grok-1.5V Grok-1.5V est un LLM propriétaire de xAI, lancé le 12 avril 2024. Ses poids ne sont pas ouverts, ce qui le distingue des modèles librement téléchargeables et modifiables.
GPT-4 Turbo GPT-4 Turbo est un LLM propriétaire d’OpenAI, lancé le 9 avril 2024. Âgé d’environ deux ans, il appartient déjà à une génération ancienne à l’échelle de l’IA, probablement dépassée et souvent retirée des catalogues. À sa sortie, il figurait néanmoins dans le top 15% des LLM de sa…
Qwen1.5-32B Qwen1.5-32B est un LLM publié par Qwen le 3 avril 2024. Âgé d’environ deux ans, il appartient déjà à une génération ancienne à l’échelle de l’IA, où les performances et les catalogues évoluent rapidement.
Grok-1.5 Grok-1.5 est un LLM propriétaire lancé par xAI le 28 mars 2024. Ses poids ne sont pas ouverts, ce qui le distingue des modèles librement accessibles et modifiables.
Gemini 1.5 Flash 8B Gemini 1.5 Flash 8B est un LLM propriétaire de Google, lancé le 15 mars 2024 avec 8 milliards de paramètres. Son principal trait distinctif est une fenêtre de contexte de 1 048 576 tokens, conçue pour traiter un volume d’informations particulièrement étendu.
Claude 3 Haiku Claude 3 Haiku est un LLM propriétaire d’Anthropic, lancé le 13 mars 2024. Près de deux ans plus tard, il appartient à une génération déjà très ancienne à l’échelle de l’IA et probablement dépassée. Sa fenêtre de contexte atteint 200 000 tokens, mais ses connaissances s’arrêtent au 31…
Claude 3 Opus Claude 3 Opus est un LLM propriétaire d’Anthropic, lancé le 29 février 2024. Âgé d’environ deux ans, il est désormais très ancien à l’échelle de l’IA et probablement dépassé par des modèles plus récents, alors qu’il se classait à sa sortie dans le top 6% de sa génération sur GPQA diamond.
Claude 3 Sonnet Claude 3 Sonnet est un LLM propriétaire d’Anthropic, d’origine américaine, publié le 29 février 2024. À sa sortie, il se plaçait dans le haut du panier de sa génération pour le raisonnement scientifique.
Mistral Large Mistral Large est un LLM français lancé par Mistral AI le 26 février 2024. Près de deux ans plus tard, il appartient à une génération déjà très ancienne à l’échelle de l’IA. Ses performances sont probablement dépassées et ce type de modèle est souvent retiré du catalogue de son éditeur.
Gemini 1.0 Pro Gemini 1.0 Pro est un LLM propriétaire de Google, lancé le 15 février 2024 aux États-Unis. Âgé d’environ deux ans, il appartient déjà à une génération ancienne à l’échelle de l’IA, aujourd’hui probablement dépassée et souvent retirée du catalogue de son éditeur.
Qwen1.5-72B Qwen1.5-72B est un LLM de 72 milliards de paramètres publié par Qwen le 4 février 2024. Originaire de Chine, il appartient désormais à une génération ancienne, près de deux ans représentant une période très longue à l’échelle de l’IA. Ses performances sont probablement dépassées et le…
gpt-3.5-turbo-0613 gpt-3.5-turbo-0613 est un LLM propriétaire d’OpenAI. Son profil Benchable est très contrasté : le modèle obtient son résultat le plus solide en classification d’e-mails, mais se montre nettement moins convaincant dans le suivi d’instructions et les connaissances générales.
OpenAI: GPT-4 Turbo Preview OpenAI: GPT-4 Turbo Preview est un LLM propriétaire lancé le 25 janvier 2024. Avec environ deux ans d’ancienneté, il appartient déjà à une génération ancienne à l’échelle de l’IA, désormais largement dépassée et souvent retirée des catalogues.
Mixtral 8x7B Sorti le 11 décembre 2023, Mixtral 8x7B est un LLM français de Mistral AI comptant 47 milliards de paramètres. Âgé d’environ trois ans, il appartient déjà à une génération ancienne à l’échelle de l’IA, où les progrès rapides rendent les modèles fréquemment dépassés ou retirés des…
DeepSeek LLM 67B DeepSeek LLM 67B est un grand modèle de langage publié par DeepSeek le 29 novembre 2023. Âgé d’environ trois ans, il appartient déjà à une génération ancienne à l’échelle de l’IA, où les progrès rapides rendent les modèles rapidement dépassés.
Claude 2.1 Claude 2.1 est un LLM propriétaire d’Anthropic, éditeur américain. Sorti le 21 novembre 2023, il approche déjà trois ans d’ancienneté, une durée très longue à l’échelle de l’IA. Ses performances doivent donc être replacées dans le contexte de sa génération.
OpenAI: GPT-3.5 Turbo Instruct OpenAI: GPT-3.5 Turbo Instruct est un LLM propriétaire américain de 20 milliards de paramètres, lancé le 28 septembre 2023. Avec près de trois ans d’ancienneté, il appartient déjà à une génération ancienne à l’échelle de l’IA. Ses connaissances s’arrêtent au 30 septembre 2021, ce qui…
OpenAI: GPT-3.5 Turbo 16k Publié par OpenAI le 28 août 2023, GPT-3.5 Turbo 16k est un LLM propriétaire désormais très ancien à l’échelle de l’IA. Sa fenêtre de contexte de 16 385 tokens constitue son principal trait distinctif. Près de trois ans après sa sortie, cette génération est probablement dépassée par les…
GPT-4 GPT-4 est un LLM propriétaire d’OpenAI, sorti le 28 août 2023. Près de trois ans plus tard, il appartient à une génération déjà ancienne à l’échelle de l’IA. Modèle de premier plan à son lancement, il est désormais probablement dépassé et souvent absent du catalogue courant de son éditeur.
Llama 2-70B Llama 2-70B est un LLM de 70 milliards de paramètres publié par Meta aux États-Unis le 18 juillet 2023. Près de trois ans plus tard, il appartient déjà à une génération ancienne à l’échelle de l’IA et ses résultats doivent être replacés dans le contexte de sa période de sortie.
Claude 2 Sorti le 11 juillet 2023, Claude 2 est un LLM propriétaire développé aux États-Unis par Anthropic. Âgé de près de trois ans, il appartient à une génération désormais très ancienne à l’échelle de l’IA. Ses performances actuelles le situent nettement derrière les modèles plus récents.
GPT-3.5 Turbo GPT-3.5 Turbo est un LLM propriétaire lancé par OpenAI le 21 mars 2023. Âgé d’environ trois ans, il appartient désormais à une génération ancienne à l’échelle de l’IA. Ses performances sont probablement dépassées et le modèle est aujourd’hui souvent retiré du catalogue de l’éditeur.