Définition·
Capacités

Speech-to-Text

Technologie qui transcrit automatiquement la parole en texte écrit.

Explication détaillée

Le Speech-to-Text (STT) ou ASR (Automatic Speech Recognition) repose sur des modèles deep learning capables de gérer plusieurs langues, accents et bruits de fond. Il alimente la dictée, la transcription de réunions, le sous-titrage et la commande vocale.

Exemples

Transcription de réunions Zoom
Sous-titres automatiques YouTube
Dictée vocale sur iPhone
Whisper (OpenAI)

Questions fréquentes

Quelle précision attendre ?

Les meilleurs modèles dépassent 95% en bonnes conditions ; bruit, accents et termes métier réduisent la qualité.

Termes associés

Dernière mise à jour : 15/07/2026

Talent AI

Passez de la théorie à la pratique

Publiez une mission ou rejoignez la communauté des meilleurs experts IA, Data et Machine Learning.