Definición·
Capacidades

Text-to-Speech

Tecnología que sintetiza una voz realista a partir de un texto escrito.

Explicación detallada

El Text-to-Speech (TTS) genera habla natural, a veces clonada a partir de una voz real. Los modelos recientes gestionan la prosodia, las emociones, varios idiomas y acentos, lo que abre la puerta a asistentes de voz, audiolibros y doblaje automático.

Ejemplos

Voz de Siri o Google Assistant
ElevenLabs para clonar una voz
Lectura en voz alta de un artículo
Doblaje automático de vídeos

Preguntas frecuentes

¿Riesgos de fraude?

El clonación vocal facilita las estafas del tipo «fraude al presidente»; se recomiendan controles de identidad adicionales.

Términos relacionados

Última actualización: 15/7/2026

Talent AI

Pasa de la teoría a la práctica

Publica una misión o únete a la comunidad de los mejores expertos en IA, Data y Machine Learning.