ByteDance aplica el modelo de IA bidireccional SeedRealtime en Doubao
ByteDance ha implementado el modelo de IA bidireccional SeedRealtime, que procesa simultáneamente voz, video y texto, en la aplicación Doubao. La organización de investigación en IA, Seed, presentó SeedRealtime el día 10. Este modelo integra audio, video y texto en una estructura de extremo a extremo, procesando el reconocimiento, la comprensión, el juicio y la expresión de manera paralela. SeedRealtime admite interacciones bidireccionales que evalúan el flujo de la conversación mientras recibe entradas, sin esperar a que el usuario termine de hablar, e incluye una función de cambio de turno de conversación que reemplaza al detector de actividad de voz externo (VAD). Según la evaluación interna de ByteDance, los problemas de ritmo conversacional se redujeron a la mitad en comparación con la estructura en cascada existente. Este modelo es una extensión de las capacidades del modelo de voz bidireccional Seeduplex, presentado en abril, que redujo a la mitad las tasas de respuestas incorrectas y de interrupciones en entornos ruidosos. La tasa de interrupciones del AI mientras el usuario duda se redujo en un 40%, y el índice de fluidez conversacional mejoró en un 12%. Sin embargo, no se ha confirmado una conexión directa entre este anuncio y el mercado de criptomonedas y blockchain. La información publicada por ByteDance no incluye planes para la emisión de tokens o la integración con redes blockchain.
Precio de --
Este contenido se ofrece únicamente con fines informativos generales y no constituye un asesoramiento financiero, de inversión, legal ni fiscal. Cualquier evento, recompensa, promoción en línea o información relacionada que se mencione en el presente documento no debe considerarse como una recomendación, solicitud o invitación a comprar, vender, operar o de negociar de otra manera con cualquier criptoactivo. Los criptoactivos son sumamente volátiles y pueden provocar pérdidas. La disponibilidad de los servicios, productos y eventos relacionados de WEEX puede variar según la región. Tienes la responsabilidad de asegurarte de que tu participación esté de acuerdo con las leyes y regulaciones locales vigentes.
Te puede gustar

Higgsfield recauda 400 millones de dólares, valorada en 5.4 mil millones de dólares

El modelo XiaoHongShu supera en 4.9 puntos al modelo OpenAI de EE. UU.

Gemini 3.7 Flash a 0,75 dólares por millón de tokens, discrepancias con la documentación oficial de Google

Amazon utiliza por defecto el contenido de Twitch para entrenar IA

Alibaba Cloud Wan3.0 alcanza un tiempo de generación de 30 segundos, igualando a Seedance 2.5

ByteDance lanza el modelo de gran escala SeedRealtime para audio y video en tiempo real

Ford lanza Territory Platinum, el SUV más equipado de su gama

Fish Audio obtiene 720 millones de won en inversión semilla

ByteDance lanza Seedance 2.5, generando videos de 30 segundos con soporte para 50 materiales

Grok Voice Think Fast 2.0 obtiene el primer lugar en la evaluación de Agentes, el precio de la API aumenta un 60%

Google DeepMind lanza el modelo de generación musical Lyria 3.5, que soporta la creación de canciones de hasta 3 minutos

OpenAI lanza GPT Transcribe y GPT Live Transcribe, con un precio reducido del 25%

Fish Audio completa una ronda de financiación inicial de 50 millones de dólares

Goldman Sachs interpreta la reunión del fundador de Minimax: Corrección de valoración de MiniMax, precio objetivo más de 3 veces superior

Mira Murati lanza el modelo de código abierto Inkling en OpenRouter

ByteDance lanza el modelo de audio generativo Seed Audio 1.0

Goldman Sachs: La inflación en EE.UU. está pasando de ser local a una expansión generalizada, pero aún no se repite la crisis de 2022

Kaspersky GReAT revela el marco de malware OkoBot: diseñado para robar frases de recuperación de billeteras de criptomonedas, cookies del navegador y más

El NBU simplifica las reglas de identificación de clientes en los bancos

El Departamento de Defensa de EE. UU. publica 40 documentos y videos sobre OVNIs






