AI co-mathematician
AI co-mathematician est un LLM de Google, sorti le 8 mai 2026 et positionné sur les mathématiques de recherche. Il se distingue par des résultats de premier plan sur deux versions privées de FrontierMath Tier 4, consacrées à des problèmes très difficiles.
AI co-mathematician est un LLM de Google, sorti le 8 mai 2026 et positionné sur les mathématiques de recherche. Il se distingue par des résultats de premier plan sur deux versions privées de FrontierMath Tier 4, consacrées à des problèmes très difficiles.
Les deux évaluations le placent dans le top 10, avec une première place sur l’une des versions. Cette position repose sur deux sources de données concordantes.
Caractéristiques
| Caractéristique | Valeur |
|---|---|
| Type | Grand modèle de langage (LLM) |
| Éditeur | |
| Poids | ▫ n.d. |
| Date de sortie | 8 mai 2026 |
Performances (benchmarks)
| Benchmark | Score | Rang (LLM) | Source | Fiabilité |
|---|---|---|---|---|
| Epoch: FrontierMath-Tier-4-v2-Private | 75,6 % | 2ᵉ / 18 | epoch | ✅ Mesuré |
| Epoch: FrontierMath-Tier-4-2025-07-01-Private | 47,9 % | 1ᵉ / 25 | epoch | ✅ Mesuré |
Comment se situe-t-il ?
Le modèle (en orange) comparé aux meilleurs modèles sur chaque dimension évaluée, et à ses voisins de classement.
Epoch: FrontierMath-Tier-4-v2-Private
Epoch: FrontierMath-Tier-4-2025-07-01-Private
Notre analyse
Forces. AI co-mathematician obtient ses résultats les plus marquants sur FrontierMath-Tier-4-2025-07-01-Private (mathématiques de recherche, très difficiles), où il arrive en tête parmi 55 modèles. Il reste également dans le top 10 sur FrontierMath-Tier-4-v2-Private, face à 37 modèles. Ces classements indiquent une forte compétitivité sur les deux versions privées du benchmark, plutôt qu’un résultat isolé sur une seule évaluation.
Limites et points d'attention. Les performances varient sensiblement entre les deux versions de FrontierMath Tier 4, avec 48% sur l’une et 76% sur l’autre. Le passage de la première à la quatrième place montre aussi que son avance dépend de la version considérée et du groupe de modèles comparé. Les résultats établissent donc son niveau sur des problèmes mathématiques de recherche très difficiles, sans justifier une généralisation à d’autres catégories de tâches. AI co-mathematician s’adresse principalement aux usages centrés sur les mathématiques de recherche.
Sources des données : LLM-Stats (llm-stats.com) · Epoch AI (epoch.ai), CC-BY-4.0.