
Última actualización 08-15-2026
Categoría:
Reviews:
Join thousands of AI enthusiasts in the World of AI!
MusicLM
MusicLM es un modelo de generación de audio de Google Research que crea música a partir de descripciones textuales a 24 kHz. La página pública de ejemplos aloja clips de muestra para indicaciones como bandas sonoras de arcade, fusiones de reggaeton-EDM y jazz relajante, además de generaciones más largas en modo historia que cambian de estilo a lo largo de segmentos temporizados. Google publicó el conjunto de datos MusicCaps con 5,500 pares de música y texto junto con el artículo.
A diferencia de las aplicaciones para consumidores que ofrecen una sola caja de indicaciones, MusicLM se publicó como una demostración de investigación con muestras pre-generadas en lugar de un producto con inicio de sesión. Su característica principal es la condicionamiento conjunto de texto y melodía: puedes tararear o silbar una melodía y el modelo la vuelve a interpretar en un nuevo género descrito en texto. El modo historia enlaza múltiples descripciones para que la música evolucione a lo largo de las secciones.
MusicLM es importante como la base de investigación detrás de los modelos musicales posteriores Lyria de Google, pero esta página es para escuchar ejemplos publicados, no para crear nuevas pistas de forma interactiva. Investigadores y músicos lo estudian por la consistencia en piezas largas, el condicionamiento de pintura a música y los resultados de transferencia de melodía documentados en el artículo de 2023.
Genera música a 24 kHz a partir de leyendas de texto enriquecido
El modo historia encadena múltiples indicaciones de texto en segmentos temporizados
El condicionamiento de texto y melodía transforma melodías tarareadas o silbadas en nuevos estilos
El condicionamiento de leyendas de pintura combina descripciones de obras de arte con audio generado
Ejemplos de generación larga cubren techno melódico, swing y jazz relajante
El conjunto de datos MusicCaps incluye 5,500 pares de música y texto escritos por expertos
La salida a 24 kHz y la coherencia de varios minutos estaban por delante de la mayoría de los sistemas de texto a música de 2023.
El condicionamiento de melodía permite a los investigadores reestilizar melodías tarareadas con leyendas de texto.
El modo historia demuestra transiciones controlables de larga duración a través de secuencias de indicaciones.
El conjunto de datos MusicCaps proporcionó a la comunidad investigadora 5,500 pares de música y texto etiquetados.
Sin interfaz interactiva de generación; los usuarios solo pueden reproducir muestras de investigación alojadas.
Las herramientas de música para consumidores de Google pasaron a la familia Lyria en lugar de esta página de demostración.
La página de ejemplos es un artefacto de investigación estático, no un producto mantenido con soporte.
¿Qué es MusicLM?
MusicLM es un modelo de Google Research que genera música de alta fidelidad a partir de descripciones de texto. Utiliza un modelado jerárquico secuencia a secuencia para producir audio a 24 kHz que se mantiene consistente durante varios minutos.
¿Puedo crear música nueva con MusicLM en línea?
La página de ejemplos de MusicLM aloja muestras de audio pre-generadas de la investigación de Google. Es un sitio de demostración, no una aplicación interactiva de creación musical donde los usuarios envían sus propios comandos.
¿MusicLM soporta entrada de melodía?
Sí. MusicLM puede condicionarse tanto en texto como en una melodía, transformando melodías silbadas o tarareadas en nuevos géneros como jazz, ópera o sintetizadores electrónicos descritos en el texto.
¿Qué es MusicCaps en MusicLM?
MusicCaps es un conjunto de datos de 5,500 pares de música y texto con descripciones detalladas escritas por expertos humanos. Google Research lo lanzó junto con MusicLM para apoyar futuras investigaciones en generación de audio.
¿MusicLM es gratis para usar?
La página de ejemplos de investigación de MusicLM es gratuita para explorar. Google no lanzó MusicLM como un producto de consumo pago; herramientas musicales posteriores usan la familia de modelos Lyria en Google Flow Music y Gemini.
¿Cómo funciona el modo historia de MusicLM?
El modo historia de MusicLM alimenta una secuencia de comandos de texto con marcas de tiempo, como música para meditación y luego para correr. Cada texto influye en cómo el modelo continúa a partir de tokens semánticos derivados de la sección anterior.
