Pika Labs lanzó el 14 de agosto cuatro modelos de audio generativo: Soundtrack (sincroniza sonido desde vídeo), Music, SFX y Speech, cerrando el ciclo vídeo con audio en un timeline.
Music genera canciones de hasta seis minutos en segundos; SFX crea efectos desde texto en menos de un segundo; Speech clona voces a 48 kHz. Sin ejemplos de audio verificables, si suena a mezcla profesional o a IA genérica queda por comprobar.
De sostenerse las cifras, hasta 20 veces más barato que ElevenLabs o Hunyuan Foley, sonorizar vídeo social o de marca deja de depender de bancos de música con licencia y de voice-over por encargo.
Antes de producción de marca: correr un brief real por los cuatro modelos y comparar el output contra un mezclador humano, caso por caso.
