Alibaba Cloud Wan3.0 atteint 30 secondes de génération, égalant Seedance 2.5
Le nouveau modèle vidéo de la génération Alibaba Cloud Wan3.0 est en phase de test public, avec un temps de génération par session doublé de 15 secondes pour Wan2.7 à 30 secondes, égalant ainsi Seedance 2.5. En plus de prendre en charge le texte, les images, l'audio et la vidéo, Wan3.0 peut également lire directement des documents Word, Excel, PPT, PDF et Markdown, générant des présentations de produits, des supports de cours, des graphiques animés et des rapports d'affaires. Le modèle prend en charge la sélection intelligente de la durée, l'extension de la vidéo, et peut modifier les images, les scénarios et les dialogues selon les instructions. La génération met l'accent sur l'amélioration de la cohérence des personnages, des objets, des sons, des relations spatiales et du style visuel, mais la qualité sonore et la précision du texte à l'écran nécessitent encore des améliorations. Wan3.0 est déjà disponible sur Alibaba Cloud Bailian, Wanjing Yike, le site officiel de Wanxiang et sur le PC de Qianwen, avec une mise en ligne progressive de l'application Qianwen. L'API sera bientôt entièrement ouverte, avec des frais de 0,3 yuan, 0,6 yuan et 1,2 yuan par seconde pour les résolutions 480P, 720P et 1080P respectivement, générer une vidéo de 30 secondes en 1080P coûtera 36 yuan.
Prix de --
Ce contenu est fourni à titre informatif uniquement et ne constitue pas un conseil financier, d'investissement, juridique ou fiscal. Les événements, récompenses, promotions en ligne ou informations mentionnées ici ne doivent pas être considérés comme une recommandation, une sollicitation ou une invitation à acheter, vendre, trader ou effectuer toute autre opération sur des actifs crypto. Les actifs crypto sont très volatils et peuvent entraîner des pertes. La disponibilité des services, produits et événements liés à WEEX peut varier selon les régions. Veuillez vous assurer que votre participation respecte les lois et réglementations locales applicables.
Vous pourriez aussi aimer

Le modèle XiaoHongShu surpasse l'OpenAI américain de 4,9 points

Tiffany, un acteur menaçant, soupçonné de vol d'actifs cryptographiques et de jeu

ByteDance applique le modèle AI à double sens SeedRealtime sur l'application Doubao

La société d'IA audio Noiz termine un tour de financement de plusieurs millions de yuans

ByteDance lance le modèle de grande taille SeedRealtime pour l'audio et la vidéo en duplex intégral

Sam Altman déclare que ChatGPT peut générer des podcasts sur la croissance des enfants

ByteDance lance Seedance 2.5, permettant de générer des vidéos de 30 secondes avec 50 éléments

Grok Voice Think Fast 2.0 obtient la première place des évaluations d'Agent, le prix de l'API augmente de 60%

Google DeepMind lance le modèle de génération musicale Lyria 3.5, capable de créer des chansons de 3 minutes maximum

OpenAI lance GPT Transcribe et GPT Live Transcribe, avec une réduction de 25% des prix

Fish Audio lève 50 millions de dollars lors d'un tour de financement de démarrage

Messi investit dans World Labs fondé par Fei-Fei Li

ByteDance lance le modèle audio génératif Seed Audio 1.0

Le Japon lance le projet Noetra AI, Nvidia fournit 27 500 GPU Rubin

La NBU simplifie les règles d'identification des clients dans les banques

Lancement de l'outil Agent Step Edge pour le traitement local, avec un délai d'appel minimum de 0,1 seconde

Une vidéo falsifiée de Cristiano Ronaldo utilisée pour promouvoir le jeton cryptographique USWR






