ElevenLabs lanza Eleven v4, un modelo de voz emotiva con IA que interpreta tono y emoción desde el texto, no solo pronunciación. Número uno en Artificial Analysis en septiembre; preferido en el 75% de pruebas ciegas.

El control es explícito: etiquetas como [risas] o [dicho con enfado, acento francés] cambian la interpretación sin regrabar. Clona una voz con diez segundos de audio y la mantiene reconocible en más de 90 idiomas.

Dirigir un voiceover deja de ser repetir tomas hasta acertar el tono: se describe la intención y el modelo la ejecuta. Turbo responde en unos 150 milisegundos, suficiente para agentes conversacionales en vivo.

Ya disponible en la API, ElevenAgents y ElevenCreative. No se detalla coste por minuto: mejor probarlo gratis antes de comprometer presupuesto de doblaje.