Esta semana coinciden tres anuncios que apuntan al mismo movimiento: el doblaje con IA deja de tratarse aparte del vídeo y entra en el mismo render. FLUX 3, de Black Forest Labs, genera hasta 20 segundos de vídeo con diálogo, música y efectos en el mismo paso que el plano, con diálogo en varios idiomas. Aún está en Early Access y las comparativas que publica la propia compañía son preliminares.
HeyGen lanzó gratis un lip sync que sincroniza cualquier audio con cualquier plano y dobla a más de 175 idiomas, con clonación de voz desde una muestra de 15 segundos. Vivideo.ai unió generador de voz, avatares y montaje en un único proyecto, sin saltar entre apps para cada paso. Tres empresas distintas, la misma dirección: menos pasos entre grabar y publicar en otro idioma.
La fuerza detrás es el coste de adaptar una pieza a varios mercados sin repetir rodaje. Doblar un anuncio a diez idiomas significaba diez sesiones de estudio y diez actores de voz. Ahora una muestra de audio o un prompt de texto generan la variante completa, incluido el ajuste de labios al nuevo idioma.
Para Ana, esto acorta el testing de una misma pieza en varios mercados sociales: un plano sirve para varias campañas sin nueva sesión de rodaje. El ahorro está en la localización, no en generar más piezas desde cero.
Para Pablo, el sonido pasa de fase aparte de postproducción a parámetro del render, aunque todavía sin muestra pública abierta a examen. Para Lucía, el riesgo es de marca: ninguno de los tres anuncios documenta qué pasa en un plano de cabeza en movimiento rápido, el punto donde el lip sync suele fallar y delatar la pieza como generada.
Vigilar en los próximos 30 a 90 días: si FLUX 3 sale de Early Access con muestra pública verificable, si HeyGen publica límites reales de duración y calidad en movimiento rápido, y qué idiomas cubre en firme el generador de voz de Vivideo.ai. Antes de sustituir un doblaje profesional por lip sync generado, probarlo primero en un plano estático de marca, no en el corte final de una campaña.
