Google lanza su IA musical más avanzada: así suena Lyria 3.5

Google ha presentado Lyria 3.5, su modelo de generación musical más sofisticado hasta la fecha, integrado ya en la plataforma Flow Music. Esta nueva versión, lanzada el 29 de julio de 2026, destaca por ofrecer una musicalidad mucho más natural y voces con una carga emocional sorprendente.

Lo que diferencia a Lyria 3.5 de sus competidores no es solo la nitidez del audio, sino el control granular que otorga al usuario sobre elementos técnicos como el tempo, el ritmo y la duración total de las pistas, que ahora pueden alcanzar los 3 minutos. Además, introduce la capacidad de componer piezas únicas a partir de una simple imagen, abriendo nuevas vías para la narrativa multimedia.

Con la implementación de marcas de agua invisibles mediante la tecnología SynthID, Google busca equilibrar la innovación con la transparencia en la creación de contenidos asistidos por inteligencia artificial. Este avance representa una evolución técnica que prioriza la estructura melódica y la precisión en la pronunciación vocal.

¿Qué es Lyria 3.5 y en qué consisten sus novedades?

Desarrollado por los equipos de Google DeepMind y Google Labs, el modelo Lyria 3.5 es un sistema diseñado para transformar instrucciones complejas en composiciones de audio de alta fidelidad. La principal mejora de esta versión reside en su musicalidad, un término que se refiere a la capacidad de la IA para organizar melodías y ritmos de manera que suenen menos mecánicos y más fluidos. El sistema ahora puede gestionar estructuras melódicas ricas que evitan la repetición monótona, adaptándose mejor a las transiciones naturales que se esperan en una canción.

Una de las funciones más interesantes es la integración de la composición visual. El usuario puede subir una fotografía y pedirle a la herramienta que la traduzca en una pista sonora personalizada, analizando el ambiente y la estética de la imagen para decidir el género o la instrumentación adecuada. Además, en el entorno de Flow Music, la herramienta facilita que las pistas generadas mantengan una cohesión total de principio a fin, permitiendo duraciones variables que van desde ráfagas cortas de 60 segundos hasta temas completos de 180 segundos.

El modelo también ha sido entrenado para mejorar la conciencia estructural en la generación de letras. Esto significa que, si el usuario solicita una estructura específica, la IA es capaz de diferenciar mejor entre estrofas, puentes y estribillos, manteniendo una coherencia temática superior a lo visto en versiones anteriores.

Por qué este avance es significativo para los creadores

La importancia de Lyria 3.5 radica en que otorga una mayor autonomía técnica al usuario. Anteriormente, la creación musical con IA solía depender de procesos muy aleatorios donde el control sobre el resultado final era escaso. Ahora, Google introduce controles específicos para ajustar los latidos por minuto (BPM) y la dinámica de la interpretación, permitiendo que la IA se ajuste a las necesidades de un proyecto concreto, como un vídeo para redes sociales o una banda sonora para un cortometraje.

Entre los cambios más relevantes que experimentarán los usuarios se encuentran:

  • Voces con matices emocionales: La IA puede interpretar letras con diferentes grados de intensidad, logrando desde susurros delicados hasta potentes armonías en el estribillo.
  • Adherencia precisa a las instrucciones: El modelo responde con mayor exactitud a peticiones detalladas sobre géneros específicos como el funk pop, la bossa nova o el afro-pop jazz fusion.
  • Pronunciación mejorada: Se ha trabajado para que la claridad de las voces en distintos idiomas sea superior, minimizando las distorsiones metálicas que suelen aparecer en el audio sintético.
  • Flexibilidad técnica: La posibilidad de definir la duración exacta del clip permite ahorrar tiempo en la edición posterior de los archivos de audio.

Este nivel de personalización convierte a la IA en una especie de colaborador que entiende no solo el «qué» se quiere crear, sino el «cómo» debe sentirse el resultado final.

Colaboración con la industria y seguridad tecnológica

Para lograr este nivel de realismo, Google ha colaborado con profesionales del sector musical. En su blog oficial, mencionan que el desarrollo ha contado con la opinión de músicos y productores para asegurar que el modelo comprenda conceptos fundamentales del ritmo y los arreglos. Un ejemplo destacado es la participación del legendario productor Wyclef Jean, quien ha experimentado con estas herramientas para explorar nuevas formas de expresión creativa.

Sin embargo, el avance tecnológico no llega sin salvaguardas. Conscientes de los retos éticos que plantea la música generativa, Google ha integrado la tecnología SynthID en todas las pistas creadas con Lyria 3.5. Se trata de una marca de agua digital imperceptible para el oído humano que permanece en el archivo incluso si este se comprime o se edita. Este sistema permite verificar en cualquier momento si una pieza musical ha sido generada por inteligencia artificial, fomentando un uso responsable de la tecnología.

Además, la empresa ha implementado sistemas de etiquetado y filtrado de datos para reducir la posibilidad de que el modelo genere letras o contenidos que puedan resultar perjudiciales o que infrinjan normativas de seguridad.

¿Qué significa esto para el futuro de la música?

La llegada de Lyria 3.5 marca una etapa donde la inteligencia artificial deja de ser un simple generador de fragmentos para convertirse en una herramienta de producción capaz de entender estructuras complejas. Aunque todavía existen limitaciones técnicas que la compañía sigue puliendo, la tendencia apunta a una integración cada vez mayor de estos sistemas en los flujos de trabajo de los artistas.

El objetivo, según explican desde la compañía, no es reemplazar la sensibilidad humana, sino ofrecer un lienzo más amplio para la exploración sonora. Lo que viene ahora es observar cómo los usuarios aprovechan esta libertad técnica para dar vida a ideas que antes requerían conocimientos técnicos avanzados o equipos de grabación costosos. El futuro de la música parece encaminarse hacia un modelo híbrido donde la eficiencia del algoritmo y el criterio del autor trabajan de la mano para crear nuevas experiencias auditivas.

NotebookLM
NotebookLMhttps://notebooklm.google/
En The AI Revolution News utilizamos NotebookLM para traducir y/o generar algunos textos a partir de fuentes oficiales. Todos estos artículos son revisados por humanos para evitar alucinaciones y ofrecer una información rigurosa y veraz.

Artículos relacionados

Comentarios

DEJA UNA RESPUESTA

Por favor ingrese su comentario!
Por favor ingrese su nombre aquí

Este sitio usa Akismet para reducir el spam. Aprende cómo se procesan los datos de tus comentarios.

+ Noticias