Google DeepMind lanza el modelo de generación musical Lyria 3.5, que soporta la creación de canciones de hasta 3 minutos
El 30 de julio, Google DeepMind lanzó el modelo de generación musical Lyria 3.5, mejorando la estructura musical, la calidad de las letras, el cumplimiento de instrucciones, la interpretación vocal y el control de la duración de las canciones, siendo capaz de generar directamente canciones completas de hasta 3 minutos. Lyria 3.5 utiliza una arquitectura de difusión latente, generando en un espacio latente de audio temporal, con datos de entrenamiento que incluyen audio etiquetado con diferentes niveles de granularidad, y se entrena mediante SFT y aprendizaje por refuerzo que combina retroalimentación humana y de críticos. Todo el contenido generado está incrustado con una marca de agua SynthID. Google no ha revelado la escala, origen ni los benchmarks cuantitativos de los datos de entrenamiento, pero ha indicado que, en comparación con Lyria 2, ha logrado mejoras significativas en la claridad del audio y el cumplimiento de las instrucciones de las letras. Lyria 3.5 se integra por primera vez en Flow Music, soportando la creación musical conversacional, Stem, remix, publicación de música, generación de listas de reproducción, y puede vincularse con Veo para generar videos musicales, además de permitir el desarrollo de plugins de audio, juegos musicales y DAWs personalizados, construyendo un ecosistema completo que abarca la creación, edición, publicación y distribución musical.
Precio de --
Este contenido se ofrece únicamente con fines informativos generales y no constituye un asesoramiento financiero, de inversión, legal ni fiscal. Cualquier evento, recompensa, promoción en línea o información relacionada que se mencione en el presente documento no debe considerarse como una recomendación, solicitud o invitación a comprar, vender, operar o de negociar de otra manera con cualquier criptoactivo. Los criptoactivos son sumamente volátiles y pueden provocar pérdidas. La disponibilidad de los servicios, productos y eventos relacionados de WEEX puede variar según la región. Tienes la responsabilidad de asegurarte de que tu participación esté de acuerdo con las leyes y regulaciones locales vigentes.
Te puede gustar

Higgsfield recauda 400 millones de dólares, valorada en 5.4 mil millones de dólares

El modelo XiaoHongShu supera en 4.9 puntos al modelo OpenAI de EE. UU.

Gemini 3.7 Flash a 0,75 dólares por millón de tokens, discrepancias con la documentación oficial de Google

Amazon utiliza por defecto el contenido de Twitch para entrenar IA

ByteDance aplica el modelo de IA bidireccional SeedRealtime en Doubao

Alibaba Cloud Wan3.0 alcanza un tiempo de generación de 30 segundos, igualando a Seedance 2.5

ByteDance lanza el modelo de gran escala SeedRealtime para audio y video en tiempo real

Ford lanza Territory Platinum, el SUV más equipado de su gama

Fish Audio obtiene 720 millones de won en inversión semilla

ByteDance lanza Seedance 2.5, generando videos de 30 segundos con soporte para 50 materiales

Grok Voice Think Fast 2.0 obtiene el primer lugar en la evaluación de Agentes, el precio de la API aumenta un 60%

OpenAI lanza GPT Transcribe y GPT Live Transcribe, con un precio reducido del 25%

Fish Audio completa una ronda de financiación inicial de 50 millones de dólares

Goldman Sachs interpreta la reunión del fundador de Minimax: Corrección de valoración de MiniMax, precio objetivo más de 3 veces superior

Mira Murati lanza el modelo de código abierto Inkling en OpenRouter

ByteDance lanza el modelo de audio generativo Seed Audio 1.0

Goldman Sachs: La inflación en EE.UU. está pasando de ser local a una expansión generalizada, pero aún no se repite la crisis de 2022

Kaspersky GReAT revela el marco de malware OkoBot: diseñado para robar frases de recuperación de billeteras de criptomonedas, cookies del navegador y más

El NBU simplifica las reglas de identificación de clientes en los bancos

El Departamento de Defensa de EE. UU. publica 40 documentos y videos sobre OVNIs







