Modèles de reconnaissance vocale

Le catalogue des modèles de reconnaissance vocale (speech-to-text), classés par éditeur. Chaque fiche détaille le taux d'erreur de mots (WER) et les usages.

Modèles de reconnaissance vocale

24 modèles de reconnaissance vocale (speech-to-text), classés par éditeur.

ÉditeurModèleWERLicenceDate de sortie
xAIxAI: Grok STT 1.0n.d.▫ n.d.23 juil. 2026
Grok Speech to Text, xAI4,03 %▫ n.d.18 avr. 2026
DeepgramNova 35,18 %🔒 Propriétaire15 juil. 2026
Smallest.aiSmallest AI Pulse Pro2,43 %▫ n.d.16 juin 2026
SonioxSoniox v5 Async3,81 %🔒 Propriétaire11 juin 2026
GladiaSolaria-3, Gladia3,23 %🔒 Propriétaire10 juin 2026
MicrosoftMicrosoft: MAI-Transcribe 1.52,38 %▫ n.d.2 juin 2026
NVIDIANVIDIA: Parakeet TDT 0.6B v3n.d.▫ n.d.27 mai 2026
Mistral AIMistral: Voxtral Mini Transcribe3,53 %▫ n.d.15 mai 2026
Voxtral Small2,77 %▫ n.d.15 juil. 2025
GoogleGoogle: Chirp 3n.d.▫ n.d.5 mai 2026
OpenAIOpenAI: GPT-4o Mini Transcribe4,47 %🔒 Propriétaire1 mai 2026
Whisper Large V3 Turbon.d.🟢 Ouvert1 mai 2026
OpenAI: GPT-4o Transcribe3,96 %🔒 Propriétaire27 avr. 2026
Whisper Large v24,06 %🔒 Propriétaire8 déc. 2022
QwenQwen3.5 Omni Plus3,55 %▫ n.d.29 mars 2026
Coheretranscribe-03-20264,57 %▫ n.d.26 mars 2026
AssemblyAIAssemblyAI U3 Realtime Pro - Max Accuracy3,02 %🔒 Propriétaire3 mars 2026
Universal-3 Pro3,12 %🔒 Propriétaire3 févr. 2026
ElevenLabsScribe v22,18 %🔒 Propriétaire9 janv. 2026
ReplicateCanary Qwen 2.5B, NVIDIA4,27 %▫ n.d.17 juil. 2025
Rev AIRev AI5,92 %🔒 Propriétaire24 oct. 2019
Amazon BedrockAmazon Transcribe4,12 %🔒 Propriétaire4 avr. 2018
SpeechmaticsSpeechmatics Enhanced4,05 %🔒 Propriétaire