Google DeepMind lance le modèle de génération musicale Lyria 3.5, capable de créer des chansons de 3 minutes maximum
Le 30 juillet, Google DeepMind a lancé le modèle de génération musicale Lyria 3.5, améliorant la structure musicale, la qualité des paroles, le respect des instructions, la performance vocale et le contrôle de la durée des chansons, permettant de générer directement des chansons complètes de 3 minutes maximum. Lyria 3.5 utilise une architecture de diffusion latente, générant des sons dans un espace latent audio temporel, avec des données d'entraînement comprenant des enregistrements audio annotés avec différents niveaux de granularité. Il a été affiné grâce à l'apprentissage par renforcement combinant des retours humains et des critiques, et tout le contenu généré est intégré avec un filigrane SynthID. Google n'a pas divulgué l'échelle, la source ou les benchmarks quantitatifs des données d'entraînement, mais a indiqué qu'en comparaison avec Lyria 2, des améliorations significatives ont été réalisées en termes de clarté audio et de respect des instructions des paroles. Lyria 3.5 est intégré pour la première fois dans Flow Music, supportant la création musicale conversationnelle, le Stem, le remix, la publication musicale, la génération de playlists, et peut interagir avec Veo pour générer des vidéos musicales, tout en permettant le développement de plugins audio, de jeux musicaux et de DAW personnalisés, construisant un écosystème complet couvrant la création, l'édition, la publication et la distribution musicale.
Prix de --
Ce contenu est fourni à titre informatif uniquement et ne constitue pas un conseil financier, d'investissement, juridique ou fiscal. Les événements, récompenses, promotions en ligne ou informations mentionnées ici ne doivent pas être considérés comme une recommandation, une sollicitation ou une invitation à acheter, vendre, trader ou effectuer toute autre opération sur des actifs crypto. Les actifs crypto sont très volatils et peuvent entraîner des pertes. La disponibilité des services, produits et événements liés à WEEX peut varier selon les régions. Veuillez vous assurer que votre participation respecte les lois et réglementations locales applicables.
Vous pourriez aussi aimer

Le modèle XiaoHongShu surpasse l'OpenAI américain de 4,9 points

Tiffany, un acteur menaçant, soupçonné de vol d'actifs cryptographiques et de jeu

ByteDance applique le modèle AI à double sens SeedRealtime sur l'application Doubao

La société d'IA audio Noiz termine un tour de financement de plusieurs millions de yuans

Alibaba Cloud Wan3.0 atteint 30 secondes de génération, égalant Seedance 2.5

ByteDance lance le modèle de grande taille SeedRealtime pour l'audio et la vidéo en duplex intégral

Sam Altman déclare que ChatGPT peut générer des podcasts sur la croissance des enfants

ByteDance lance Seedance 2.5, permettant de générer des vidéos de 30 secondes avec 50 éléments

Grok Voice Think Fast 2.0 obtient la première place des évaluations d'Agent, le prix de l'API augmente de 60%

OpenAI lance GPT Transcribe et GPT Live Transcribe, avec une réduction de 25% des prix

Fish Audio lève 50 millions de dollars lors d'un tour de financement de démarrage

Messi investit dans World Labs fondé par Fei-Fei Li

ByteDance lance le modèle audio génératif Seed Audio 1.0

Le Japon lance le projet Noetra AI, Nvidia fournit 27 500 GPU Rubin

La NBU simplifie les règles d'identification des clients dans les banques

Lancement de l'outil Agent Step Edge pour le traitement local, avec un délai d'appel minimum de 0,1 seconde

Une vidéo falsifiée de Cristiano Ronaldo utilisée pour promouvoir le jeton cryptographique USWR






