DirectIA
  • Applications IA
  • Modèles
    • Modèles LLM
    • Modèles d'embeddings
    • Génération d'images
    • Génération de vidéos
    • Synthèse vocale (TTS)
    • Reconnaissance vocale (STT)
    • Génération de musique
    • Benchmarks
  • Hardware
    • Toutes les machines
    • Cartes graphiques
    • Mini-PC mémoire unifiée
    • Stations IA
    • Apple Silicon
    • PC à NPU
    • Serveurs & accélérateurs
  • Formation IA
  • Actualités

Benchmarks

BFCL-v3

BFCL-v3 est un benchmark conçu en 2024 par la Gorilla LLM team de l’UC Berkeley pour évaluer les capacités d’appel de fonctions des grands modèles de langage dans des interactions agentiques.
18 juil. 2026 à 23:05

BFCL-V4

BFCL-V4, conçu par la Gorilla LLM team de l’UC Berkeley, est un benchmark consacré à l’évaluation des modèles capables d’appeler correctement des fonctions et des API. Il couvre des appels simples, multiples, parallèles ou imbriqués dans différents scénarios de programmation.
18 juil. 2026 à 23:05

BFCL v2

BFCL v2 est un benchmark créé en 2024 par Berkeley Gorilla, à l’UC Berkeley, pour évaluer les capacités d’appel de fonctions des grands modèles de langage. Il s’appuie sur des scénarios issus de fonctions d’entreprise, de projets open source et de contributions d’utilisateurs.
18 juil. 2026 à 23:04

BFCL

BFCL, créé en 2024 par l’UC Berkeley et la Gorilla LLM team, est un benchmark consacré à l’évaluation du function calling. Il examine la capacité d’un modèle à transformer une instruction en langage naturel en appels de fonctions ou d’outils correctement sélectionnés et structurés selon…
18 juil. 2026 à 23:03
DirectIA © 2026. Propulsé par Ghost