Google: Chirp 3

Google: Chirp 3 est un modèle de reconnaissance vocale de Google, sorti le 5 mai 2026. Il convertit la parole en texte et relève d’un positionnement tarifaire premium.

Google: Chirp 3 est un modèle de reconnaissance vocale de Google, sorti le 5 mai 2026. Il convertit la parole en texte et relève d’un positionnement tarifaire premium.

Sa tarification distingue un traitement d’entrée payant et une sortie gratuite. Malgré son positionnement premium, son prix est annoncé 63 % sous la moyenne des modèles similaires, sur la base de deux sources de données concordantes.

Caractéristiques

CaractéristiqueValeur
TypeReconnaissance vocale (speech-to-text)
ÉditeurGoogle
Poids▫ n.d.
Date de sortie5 mai 2026
Modalités (entrée → sortie)audio → transcription

Tarifs

FournisseurEntrée / 1MSortie / 1MCache lecture / 1M
Google Vertex16000 $gratuitn.d.

Prix en dollars US par million de tokens.

Sa tarification se situe 51 % en dessous de la moyenne des modèles similaires.

Notre analyse

Forces. Chirp 3 associe la reconnaissance vocale à un tarif inférieur à la moyenne de sa catégorie. La gratuité de la sortie réduit la composante facturée après le traitement de l’entrée. Les informations tarifaires reposent sur deux sources concordantes, ce qui renforce la cohérence du positionnement indiqué.

Limites et points d’attention. Le modèle reste classé premium et applique un coût d’entrée, un paramètre important pour les traitements portant sur de grands volumes audio. La qualité d’un modèle speech-to-text se mesure objectivement avec le WER, un taux d’erreur où une valeur plus basse correspond à une transcription plus fidèle. Usages pertinents : sous-titrage, transcription de réunions, dictée et commandes vocales.


Sources des données : OpenRouter (openrouter.ai) · LLM-Stats (llm-stats.com).