Lyria 3.5: Google abre generación de música IA a Gemini

⏱ Tiempo de lectura: 4 min
Google puso a disposición Lyria 3.5, su modelo de generación de música con inteligencia artificial, en la aplicación Gemini y la API de Gemini a partir del 4 de septiembre de 2026. El modelo, que debutó en Google Flow Music el 29 de julio, ahora alcanza a todos los usuarios de Gemini en la web y en dispositivos móviles de forma global. Google describe Lyria 3.5 como su modelo de generación de música con mejor sonoridad, que ofrece voces más expresivas y arreglos musicales más ricos que las versiones anteriores.
Lyria 3.5 llega a Gemini con nuevos controles de creación
La versión de Lyria 3.5 integrada en Gemini incluye nuevas funciones guiadas de creación. Los usuarios pueden seleccionar o describir un género, elegir entre estilos vocales o instrumentales, y acceder a plantillas diseñadas para proyectos que van desde música de fondo hasta canciones personalizadas. También pueden ajustar la duración de las pistas entre formatos cortos o más largos. Google indicó que estas capacidades apuntan a casos de uso como pistas de apoyo personalizadas para video, jingles de marca y tonos de llamada personalizados. El modelo genera audio estéreo de 44.1 kHz desde descripciones de texto o imágenes, con coherencia estructural que incluye voces, letras sincronizadas y arreglos instrumentales completos.
Modelos, plataformas y límites técnicos confirmados
Google ofrece Lyria 3.5 a través de múltiples canales: la aplicación Gemini (web y móvil), Google Flow Music (para artistas), Google AI Studio y Google Vids (para desarrolladores). La documentación para desarrolladores lista dos variantes bajo API: Lyria 3 Clip (modelo lyria-3-clip-preview) que genera clips de 30 segundos para bucles y previsualizaciones, y Lyria 3.5 (modelo lyria-3.5) que produce canciones completas de varios minutos con estrofas, coros y puentes. Ambos acceden a través de la API de Interacciones de Google. El audio se exporta por defecto en MP3; Lyria 3.5 también permite salida WAV. Los desarrolladores pueden enviar hasta 10 imágenes junto con un mensaje de texto, y el modelo compone música inspirada en el contenido visual. También pueden proporcionar letras personalizadas usando etiquetas de sección (Verso, Coro, Puente) y marcas de tiempo para especificar cuándo entran instrumentos. Las peticiones que violen políticas de seguridad, soliciten voces de artistas específicos o generen letras protegidas por derechos de autor se bloquean automáticamente. La fuente detalla que todas las pistas llevan marca de agua SynthID imperceptible para el oído humano, permitiendo detectar si la música fue creada o editada con IA.
Qué se puede esperar ahora
Lyria 3.5 representa una expansión significativa del acceso a generación de música con IA, pasando de herramientas especializadas a plataformas de propósito general como Gemini. El modelo mantiene duración variable hasta tres minutos y adaptación de estilos vocales según el idioma del prompt. Google señala que continúa mejorando capacidades clave y recomienda a usuarios verificar que las pistas generadas se ajusten a su visión. El modelo fue desarrollado con colaboración de productores y músicos, incluyendo trabajos previos del productor Wyclef Jean y el compositor Yung Spielburg en proyectos de IA musical de Google.
| Elemento | Detalle |
|---|---|
| Modelo | Lyria 3.5 (generación de canciones completas) |
| Variante para clips | Lyria 3 Clip (lyria-3-clip-preview) — 30 segundos |
| Especificaciones de audio | 44.1 kHz estéreo, MP3 por defecto, WAV disponible en 3.5 |
| Duración máxima | Hasta 3 minutos con coherencia estructural (versos, coros, puentes) |
| Entrada de imágenes | Hasta 10 imágenes + descripción de texto |
| Personalización de letras | Etiquetas de sección (Verso, Coro, Puente) y marcas de tiempo |
| Adaptación de idioma | Genera letras en el idioma del prompt, adapta estilo vocal y pronunciación |
| Marca de agua | SynthID imperceptible al oído humano |
| Disponibilidad | Gemini app (web/móvil), Google Flow Music, Google AI Studio, Google Vids — desde 4 sept. 2026 |
| Limitaciones | Sin iteración multi-turno, se bloquean voces de artistas específicos y letras protegidas |
| Casos de uso | Pistas de apoyo personalizadas, jingles de marca, tonos de llamada |
Preguntas frecuentes sobre Lyria 3.5
¿Cuál es la diferencia entre Lyria 3.5 y Lyria 3 Clip?
Lyria 3.5 genera canciones completas de varios minutos con estructura musical coherente (versos, coros, puentes). Lyria 3 Clip produce clips de 30 segundos diseñados para bucles y previsualizaciones. Ambos están disponibles a través de la API de Gemini.
¿Desde cuándo está disponible para todos los usuarios?
A partir del 4 de septiembre de 2026, Lyria 3.5 es accesible para todos los usuarios de Gemini en la web y en dispositivos móviles de forma global. Google Flow Music, Google AI Studio y Google Vids también ofrecen acceso según el tipo de usuario.
¿Puedo generar música en mi idioma?
Sí. Google indicó que escribir un prompt en un idioma específico genera letras en ese idioma, con adaptación de estilo vocal y pronunciación. La fuente no detalla limitaciones por idioma específico, pero confirma compatibilidad multiidioma.
Qué falta por confirmar
Google no especificó en el anuncio métricas de rendimiento comparativas con modelos anteriores, ni detalles sobre costo de API por uso o límites de generación diaria. También falta información sobre planes de mejorar la capacidad de edición iterativa, que actualmente no está soportada en la versión actual.
En Inteligencia Artificial, la expansión de Lyria 3.5 a plataformas generales como Gemini señala una estrategia de Google por democratizar herramientas de generación de música, aunque el enfoque en marcas de agua SynthID refleja preocupaciones reales sobre identificación y proveniencia de contenido generado. ¿Crees que estas herramientas cambiarán la forma en que se producen jingles y música de marca personalizadas?
Fuente: www.unite.ai

Deja una respuesta
Lo siento, debes estar conectado para publicar un comentario.