Z.ai: GLM 4.6V
Publié le 8 décembre 2025 par Zhipu AI, Z.ai: GLM 4.6V est un LLM multimodal de 106 milliards de paramètres destiné aux environnements cloud et aux clusters haute performance. Sa fenêtre de contexte atteint 131 072 tokens, soit le format 128k annoncé pour cette version.
Publié le 8 décembre 2025 par Zhipu AI, Z.ai: GLM 4.6V est un LLM multimodal de 106 milliards de paramètres destiné aux environnements cloud et aux clusters haute performance. Sa fenêtre de contexte atteint 131 072 tokens, soit le format 128k annoncé pour cette version.
Le modèle traite des images, des captures d’écran et des pages de documents, y compris comme entrées directes d’outils via le function calling multimodal. Il se distingue surtout par un tarif très économique, inférieur de 85 % à la moyenne des LLM similaires, tout en couvrant des usages mêlant texte, vision, documents et interfaces.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | Zhipu AI |
| Poids | 🟢 Poids ouverts |
| Date de sortie | 8 décembre 2025 |
| Multimodal | oui |
| Fenêtre de contexte | 131 072 tokens |
| Modalités (entrée → sortie) | image,text,video → text |
Classements Arena (Elo)
Arena Text · 200 modèles classés
| Rang | Modèle | Elo |
|---|---|---|
| 1ᵉ | Claude Fable 5 | 1507 |
| 2ᵉ | Claude Opus 4.6 | 1504 |
| 3ᵉ | Claude Opus 4.7 | 1503 |
| ⋯ | ⋯ | |
| 153ᵉ | Gemini 2.5 Flash Lite Preview | 1380 |
| 154ᵉ | Arcee AI: Trinity Large Preview | 1379 |
| 155ᵉ | Z.ai: GLM 4.6V | 1377 |
| 156ᵉ | Qwen3 235B A22B | 1375 |
| 157ᵉ | gemini-2.5-flash-lite-preview-06-17-thinking | 1374 |
Arena Vision · 135 modèles classés
| Rang | Modèle | Elo |
|---|---|---|
| 1ᵉ | Claude Fable 5 | 1318 |
| 2ᵉ | Claude Opus 4.7 | 1304 |
| 3ᵉ | Claude Opus 4.6 | 1299 |
| ⋯ | ⋯ | |
| 76ᵉ | Gemini 2.5 Flash Lite Preview | 1174 |
| 77ᵉ | gemini-2.0-flash-001 | 1172 |
| 78ᵉ | Z.ai: GLM 4.6V | 1164 |
| 79ᵉ | GPT-4o | 1162 |
| 80ᵉ | Claude 3.5 Sonnet | 1160 |
Tarifs
| Fournisseur | Entrée / 1M | Sortie / 1M | Cache lecture / 1M |
|---|---|---|---|
| NovitaAI | 0,3 $ | 0,9 $ | 0,055 $ |
Prix en dollars US par million de tokens.
Sa tarification se situe 86 % en dessous de la moyenne des LLM similaires, et 18,3 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).
Notre analyse
Forces. GLM 4.6V combine une longue fenêtre de contexte avec plusieurs fonctions multimodales concrètes : compréhension de documents longs ou multiples, génération entrelacée d’images et de texte, reproduction d’interfaces frontend et édition visuelle à partir de captures d’écran. Son function calling multimodal peut transmettre directement des images, des pages de documents ou des captures à des outils. Son principal avantage compétitif reste le coût : l’entrée commence à 0,3 $ par million de tokens et la sortie à 0,9 $, soit environ 18,3 fois moins que les modèles frontière. Ce positionnement repose sur trois sources de données concordantes.
Limites et points d'attention. Les résultats Arena placent le modèle loin des premières positions. En texte, il se situe dans le dernier quart du classement, avec un écart net face au modèle de tête. En vision, son classement reste également dans la moitié inférieure. Ces résultats indiquent que son prix très bas ne s’accompagne pas d’un niveau de préférence comparable à celui des modèles haut de gamme évalués dans les mêmes arènes. GLM 4.6V cible donc surtout les traitements multimodaux à grand volume, les documents, les captures d’écran et les interfaces lorsque le coût compte davantage qu’un classement de premier plan.
Sources des données : OpenRouter (openrouter.ai) · Arena.ai (arena.ai) · LLM-Stats (llm-stats.com).