Grok Voice Think Fast 2.0 obtiene el primer lugar en la evaluación de Agentes, el precio de la API aumenta un 60%
SpaceXAI ha lanzado Grok Voice Think Fast 2.0, un modelo de agente de voz diseñado para atención al cliente, ventas y escenarios telefónicos, que tiene la capacidad de entender a los usuarios, generar respuestas de voz y llamar a herramientas. La nueva versión mejora las capacidades de razonamiento, transcripción y diálogo. Según la evaluación de Artificial Analysis, el índice de voz integral de Grok es del 82.9%, ocupando el segundo lugar, solo detrás del 84.1% de Qwen Audio 3.0 Realtime Plus. En la prueba de referencia τ-Voice para tareas de atención al cliente, Grok se posicionó en primer lugar con un 56.5%, superando al 54.6% de Qwen y al 45.7% de GPT-Realtime-2.1 High. El tiempo de respuesta inicial es de 0.70 segundos. El precio de la API ha aumentado de 0.05 USD por minuto a 0.08 USD, lo que representa un incremento del 60%, con un costo de audio de 4.80 USD por hora.
Precio de --
Este contenido se ofrece únicamente con fines informativos generales y no constituye un asesoramiento financiero, de inversión, legal ni fiscal. Cualquier evento, recompensa, promoción en línea o información relacionada que se mencione en el presente documento no debe considerarse como una recomendación, solicitud o invitación a comprar, vender, operar o de negociar de otra manera con cualquier criptoactivo. Los criptoactivos son sumamente volátiles y pueden provocar pérdidas. La disponibilidad de los servicios, productos y eventos relacionados de WEEX puede variar según la región. Tienes la responsabilidad de asegurarte de que tu participación esté de acuerdo con las leyes y regulaciones locales vigentes.
Te puede gustar

Higgsfield recauda 400 millones de dólares, valorada en 5.4 mil millones de dólares

El modelo XiaoHongShu supera en 4.9 puntos al modelo OpenAI de EE. UU.

Gemini 3.7 Flash a 0,75 dólares por millón de tokens, discrepancias con la documentación oficial de Google

Amazon utiliza por defecto el contenido de Twitch para entrenar IA

ByteDance aplica el modelo de IA bidireccional SeedRealtime en Doubao

Alibaba Cloud Wan3.0 alcanza un tiempo de generación de 30 segundos, igualando a Seedance 2.5

ByteDance lanza el modelo de gran escala SeedRealtime para audio y video en tiempo real

Ford lanza Territory Platinum, el SUV más equipado de su gama

Fish Audio obtiene 720 millones de won en inversión semilla

ByteDance lanza Seedance 2.5, generando videos de 30 segundos con soporte para 50 materiales

Google DeepMind lanza el modelo de generación musical Lyria 3.5, que soporta la creación de canciones de hasta 3 minutos

OpenAI lanza GPT Transcribe y GPT Live Transcribe, con un precio reducido del 25%

Fish Audio completa una ronda de financiación inicial de 50 millones de dólares

Goldman Sachs interpreta la reunión del fundador de Minimax: Corrección de valoración de MiniMax, precio objetivo más de 3 veces superior

Mira Murati lanza el modelo de código abierto Inkling en OpenRouter

ByteDance lanza el modelo de audio generativo Seed Audio 1.0

Goldman Sachs: La inflación en EE.UU. está pasando de ser local a una expansión generalizada, pero aún no se repite la crisis de 2022

Kaspersky GReAT revela el marco de malware OkoBot: diseñado para robar frases de recuperación de billeteras de criptomonedas, cookies del navegador y más

El NBU simplifica las reglas de identificación de clientes en los bancos

El Departamento de Defensa de EE. UU. publica 40 documentos y videos sobre OVNIs






