xAI: Grok STT 1.0 Publié par xAI le 23 juillet 2026, xAI: Grok STT 1.0 est un modèle de reconnaissance vocale. Il convertit la parole en texte pour alimenter des outils de transcription et des interfaces vocales.
Speechmatics Enhanced Speechmatics Enhanced est un modèle de reconnaissance vocale développé par Speechmatics. Il transforme la parole en texte afin d’automatiser la production de transcriptions.
Nova 3 Nova-3 est un modèle de reconnaissance vocale développé par Deepgram. Il convertit la parole en texte et se positionne comme une solution de transcription offrant une précision globalement bonne.
Smallest AI Pulse Pro Smallest AI Pulse Pro est un modèle de reconnaissance vocale édité par Smallest.ai. Il convertit la parole en texte et se positionne comme une solution de transcription à très faible taux d’erreur.
Soniox v5 Async Soniox v5 Async est un modèle de reconnaissance vocale édité par Soniox. Il transforme la parole en texte et se positionne comme un système performant pour automatiser la transcription de contenus audio.
Solaria-3, Gladia Solaria-3 est un modèle de reconnaissance vocale développé par Gladia. Il convertit la parole en texte et se positionne à un niveau de précision élevé selon la mesure d’intelligibilité d’Artificial Analysis.
Microsoft: MAI-Transcribe 1.5 Microsoft: MAI-Transcribe 1.5 est un modèle de reconnaissance vocale publié par Microsoft le 2 juin 2026. Il convertit la parole en texte pour automatiser la production de transcriptions écrites.
NVIDIA: Parakeet TDT 0.6B v3 NVIDIA: Parakeet TDT 0.6B v3 est un modèle de reconnaissance vocale édité par NVIDIA, sorti le 27 mai 2026. Il convertit la parole en texte afin d’automatiser la production de transcriptions.
Mistral: Voxtral Mini Transcribe Mistral: Voxtral Mini Transcribe est un modèle de reconnaissance vocale de Mistral AI, sorti le 15 mai 2026. Il convertit la parole en texte pour automatiser la production de transcriptions.
Google: Chirp 3 Google: Chirp 3 est un modèle de reconnaissance vocale de Google, sorti le 5 mai 2026. Il convertit la parole en texte et relève d’un positionnement tarifaire premium.
Whisper Large V3 Turbo OpenAI: Whisper Large V3 Turbo est un modèle de reconnaissance automatique de la parole publié par OpenAI le 1er mai 2026. Il convertit l’audio en texte, détecte automatiquement la langue source et peut traduire la parole vers l’anglais.
OpenAI: GPT-4o Mini Transcribe OpenAI: GPT-4o Mini Transcribe est un modèle de reconnaissance vocale édité par OpenAI et sorti le 1er mai 2026. Il convertit la parole en texte pour automatiser des tâches de transcription.
OpenAI: GPT-4o Transcribe OpenAI: GPT-4o Transcribe est un modèle de reconnaissance vocale publié par OpenAI le 27 avril 2026. Il convertit la parole en texte et se positionne comme une solution très économique parmi les modèles comparables.
Grok Speech to Text, xAI Grok Speech to Text est un modèle de reconnaissance vocale édité par xAI. Il convertit la parole en texte et se positionne à un niveau de précision élevé selon la mesure d’intelligibilité d’Artificial Analysis.
Qwen3.5 Omni Plus Qwen3.5 Omni Plus est un modèle de reconnaissance vocale publié par Qwen le 29 mars 2026. Il convertit la parole en texte et se destine aux applications nécessitant une transcription automatique.
transcribe-03-2026 transcribe-03-2026 est un modèle de reconnaissance vocale édité par Cohere. Il convertit la parole en texte, afin d’automatiser la production de transcriptions écrites à partir de contenus audio.
AssemblyAI U3 Realtime Pro - Max Accuracy AssemblyAI U3 Realtime Pro - Max Accuracy est un modèle de reconnaissance vocale édité par AssemblyAI. Il convertit la parole en texte et vise un positionnement axé sur la précision de la transcription.
Universal-3 Pro Universal-3 Pro est un modèle de reconnaissance vocale développé par AssemblyAI. Il convertit la parole en texte pour automatiser la production de transcriptions.
Scribe v2 Scribe v2 est un modèle de reconnaissance vocale développé par ElevenLabs. Il convertit la parole en texte pour automatiser la production de transcriptions.
Canary Qwen 2.5B, NVIDIA Canary Qwen 2.5B, NVIDIA est un modèle de reconnaissance vocale édité par Replicate. Il transforme la parole en texte afin d’automatiser la production de transcriptions.
Voxtral Small Voxtral Small est un modèle de reconnaissance vocale édité par Mistral AI. Il convertit la parole en texte et se positionne à un excellent niveau d’intelligibilité, selon la mesure réalisée par Artificial Analysis.
Whisper Large v2 Whisper Large v2 est un modèle de reconnaissance vocale développé par OpenAI. Il convertit la parole en texte afin de produire une transcription exploitable.
Rev AI Rev AI est un modèle de reconnaissance vocale édité par Rev AI. Il convertit la parole en texte, afin de produire une transcription exploitable à partir d’un contenu oral.
Amazon Transcribe Amazon Transcribe est un modèle de reconnaissance vocale édité par Amazon Bedrock. Il convertit la parole en texte afin d’automatiser la production de transcriptions écrites à partir de contenus audio.