Kwaipilot: KAT-Coder-Pro V2.5
Kwaipilot: KAT-Coder-Pro V2.5 est un LLM orienté code, édité par kwaipilot et sorti le 10 juillet 2026. Il se caractérise par une fenêtre de contexte de 256 000 tokens et par un positionnement tarifaire très économique.
Kwaipilot: KAT-Coder-Pro V2.5 est un LLM orienté code, édité par kwaipilot et sorti le 10 juillet 2026. Il se caractérise par une fenêtre de contexte de 256 000 tokens et par un positionnement tarifaire très économique.
Son prix se situe 65% sous la moyenne des LLM similaires et environ 7,4 fois sous celui des modèles frontière. Ce rapport entre coût, contexte étendu et résultats en programmation constitue son principal intérêt.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | kwaipilot |
| Poids | ▫ n.d. |
| Date de sortie | 10 juillet 2026 |
| Multimodal | non |
| Fenêtre de contexte | 256 000 tokens |
| Modalités (entrée → sortie) | text → text |
Performances (benchmarks)
| Benchmark | Score | Rang (LLM) | Source | Fiabilité |
|---|---|---|---|---|
| Benchable : General Knowledge (Baseline) | 100,0 % | 1ᵉ / 161 | benchable | ✅ Mesuré |
| Benchable : Ethics (Baseline) | 100,0 % | 1ᵉ / 159 | benchable | ✅ Mesuré |
| Benchable : Reasoning (Baseline) | 100,0 % | 1ᵉ / 155 | benchable | ✅ Mesuré |
| Benchable : Email Classification (Baseline) | 98,3 % | 54ᵉ / 163 | benchable | ✅ Mesuré |
| Benchable : Coding (Baseline) | 96,1 % | 6ᵉ / 162 | benchable | ✅ Mesuré |
| Benchable : Mathematics (Baseline) | 94,4 % | 28ᵉ / 140 | benchable | ✅ Mesuré |
| Benchable : Hallucinations (Baseline) | 91,3 % | 88ᵉ / 146 | benchable | ✅ Mesuré |
| Benchable : Instruction Following (Baseline) | 0,0 % | 145ᵉ / 163 | benchable | ✅ Mesuré |
Comment se situe-t-il ?
Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.
Benchable : General Knowledge (Baseline)
Benchable : Ethics (Baseline)
Tarifs
| Fournisseur | Entrée / 1M | Sortie / 1M | Cache lecture / 1M |
|---|---|---|---|
| StreamLake | 0,74 $ | 2,96 $ | 0,15 $ |
Prix en dollars US par million de tokens.
Sa tarification se situe 65 % en dessous de la moyenne des LLM similaires, et 7,4 fois moins cher que les modèles frontières (Claude Fable 5, GPT-5.6 Sol, Gemini 3.5 Flash).
Coût & vitesse agentiques
| Indicateur | Valeur |
|---|---|
| Coût moyen par benchmark — Benchable | 0,1 $ |
| Latence moyenne par benchmark — Benchable | 8 min 30 s |
Coûts et durées réels mesurés en exécutant le modèle comme agent. PinchBench = un run complet de 147 tâches (harness OpenClaw) ; Benchable = moyenne par benchmark. Sources : PinchBench, Benchable.ai.
Notre analyse
Forces. Kwaipilot: KAT-Coder-Pro V2.5 se place dans le top 10 de Coding (Baseline), avec le sixième rang sur 162 modèles. Ce classement en fait une option solide pour les tâches de programmation. Sa fenêtre de 256 000 tokens accueille des volumes de code et de texte importants dans un même contexte. Son tarif renforce ce positionnement : il coûte 65% de moins que la moyenne des LLM similaires et environ 7,4 fois moins que les modèles frontière.
Limites et points d'attention. Le résultat de 98% en Email Classification (Baseline) correspond seulement au 54e rang sur 163, ce qui place le modèle en retrait sur cette tâche. Les scores parfaits en General Knowledge, Ethics et Reasoning sont peu discriminants : il partage la première place avec respectivement 41, 71 et 14 autres modèles sur des benchmarks plafonnés. Mathematics est également plafonné et non discriminant, avec une 28e place partagée. Le modèle convient surtout aux tâches de code nécessitant un contexte étendu et un coût maîtrisé.
Sources des données : OpenRouter (openrouter.ai) · Benchable.ai (benchable.ai) · LLM-Stats (llm-stats.com).