Amazon Transcribe

Amazon Transcribe est un modèle de reconnaissance vocale édité par Amazon Bedrock. Il convertit la parole en texte afin d’automatiser la production de transcriptions écrites à partir de contenus audio.

Amazon Transcribe est un modèle de reconnaissance vocale édité par Amazon Bedrock. Il convertit la parole en texte afin d’automatiser la production de transcriptions écrites à partir de contenus audio.

Son positionnement repose sur une bonne précision de transcription, évaluée par le Word Error Rate. La mesure disponible est corroborée par deux sources de données concordantes, ce qui renforce la solidité du résultat observé.

Caractéristiques

CaractéristiqueValeur
TypeReconnaissance vocale (speech-to-text)
ÉditeurAmazon Bedrock
Poids🔒 Propriétaire
Date de sortie4 avril 2018
Taux d'erreur de mots (WER)4,12 % (plus bas = meilleur)

Notre analyse

Forces. Amazon Transcribe affiche un WER de 4,1 % sur la mesure d’intelligibilité d’Artificial Analysis. Ce taux d’erreur relativement bas indique une transcription précise, même s’il reste au-dessus du seuil de 3 % correspondant à un niveau excellent. La concordance de deux sources de données apporte un signal cohérent sur cette qualité.

Limites et points d’attention. Le WER doit être lu dans le bon sens : plus il est faible, meilleure est la reconnaissance vocale. Avec 4,1 %, Amazon Transcribe présente donc un résultat solide, sans se placer dans la catégorie des performances excellentes définie sous 3 %. Usages pertinents : sous-titrage, transcription de réunions, dictée et commandes vocales.


Sources des données : Artificial Analysis (artificialanalysis.ai) · LLM-Stats (llm-stats.com).