DirectIA
  • Applications IA
  • Modèles
    • Modèles LLM
    • Modèles d'embeddings
    • Génération d'images
    • Génération de vidéos
    • Synthèse vocale (TTS)
    • Reconnaissance vocale (STT)
    • Génération de musique
    • Benchmarks
  • Hardware
    • Toutes les machines
    • Cartes graphiques
    • Mini-PC mémoire unifiée
    • Stations IA
    • Apple Silicon
    • PC à NPU
    • Serveurs & accélérateurs
  • Formation IA
  • Actualités

Benchmarks

Terminal-Bench 2.1

Terminal-Bench 2.1 est un benchmark créé par le Laude Institute et Stanford University pour évaluer la capacité des agents IA à piloter un ordinateur depuis un terminal. Il repose sur des tâches réelles, complètes et exécutées de manière autonome en ligne de commande.
18 juil. 2026 à 23:03

Terminal-Bench

Terminal-Bench est un benchmark conçu par Stanford University, le Laude Institute et sa communauté pour éprouver des agents d’IA dans de véritables environnements de terminal isolés. Il repose sur des tâches complètes, élaborées et vérifiées par des humains.
18 juil. 2026 à 23:02

Terminal-Bench 2.0

Terminal-Bench 2.0 est un benchmark créé par l’équipe Terminal-Bench du Laude Institute et de Stanford University. Il évalue la capacité d’agents d’intelligence artificielle à utiliser de manière autonome une interface en ligne de commande pour accomplir des tâches réalistes de bout en…
18 juil. 2026 à 23:01
DirectIA © 2026. Propulsé par Ghost