Grok Voice Think Fast 2.0 zdobywa pierwsze miejsce w ocenie Agentów, ceny API wzrastają o 60%
SpaceXAI wprowadza Grok Voice Think Fast 2.0, model głosowego agenta przeznaczony do obsługi klienta, sprzedaży i scenariuszy telefonicznych, który potrafi rozumieć użytkowników, generować odpowiedzi głosowe i korzystać z narzędzi. Nowa wersja poprawia zdolności wnioskowania, transkrypcji i prowadzenia rozmów. Ocena Artificial Analysis pokazuje, że wskaźnik ogólny głosu Grok wynosi 82,9%, co plasuje go na drugim miejscu, tuż za Qwen Audio 3.0 Realtime Plus, który uzyskał 84,1%. W teście τ-Voice dla zadań obsługi klienta Grok z wynikiem 56,5% zajmuje pierwsze miejsce, przewyższając Qwen z 54,6% i GPT-Realtime-2.1 High z 45,7%. Czas pierwszego dźwięku wynosi 0,70 sekundy. Ceny API wzrosły z 0,05 USD za minutę do 0,08 USD, co oznacza wzrost o 60%, a koszt audio na godzinę wynosi 4,80 USD.
Cena --
Niniejsza treść ma charakter wyłącznie informacyjny i nie stanowi porady finansowej, inwestycyjnej, prawnej ani podatkowej. Wszelkie wydarzenia, nagrody, promocje online lub powiązane informacje, o których tu mowa, nie powinny być traktowane jako rekomendacja, zachęta ani zaproszenie do kupna, sprzedaży, wymiany lub innego rodzaju obrotu aktywami kryptograficznymi. Aktywa kryptograficzne charakteryzują się dużą zmiennością i mogą prowadzić do strat. Dostępność usług, produktów i powiązanych wydarzeń WEEX może się różnić w zależności od regionu. Użytkownik jest odpowiedzialny za upewnienie się, że jego udział jest zgodny z obowiązującymi lokalnymi przepisami i regulacjami.
Możesz również polubić

Cztery narzędzia sprzed 20 lat, których Windows 11 wciąż nie może zastąpić

Anthropic ujawnia sposób na wprowadzenie niewidocznego znaku wodnego w tekstach Claude'a

Model XiaoHongShu o 4,9 punktu wyższy niż amerykański OpenAI

ByteDance wprowadza model AI SeedRealtime do aplikacji Doubao

Firma Audio AI Noiz zakończyła finansowanie w rundzie seed na dziesiątki milionów

ByteDance wprowadza model SeedRealtime do dwukierunkowej komunikacji audio-wideo

Ford wprowadza Territory Platinum, najlepiej wyposażony SUV w swojej gamie

Sam Altman twierdzi, że ChatGPT może generować podcasty o dorastaniu dzieci

Fish Audio pozyskuje 720 milionów wonów w inwestycji seed

ByteDance wprowadza Seedance 2.5, generując 30-sekundowe wideo z 50 materiałami

Google DeepMind wprowadza model generowania muzyki Lyria 3.5, który wspiera tworzenie utworów o długości do 3 minut

OpenAI wprowadza GPT Transcribe i GPT Live Transcribe, obniżając ceny o 25%

ByteDance wprowadza model generowania dźwięku Seed Audio 1.0

NBU uprościł zasady identyfikacji klientów w bankach

Departament Obrony USA opublikował 40 dokumentów i filmów o UFO

Fałszywe wideo z Ronaldo wykorzystane do promocji tokena kryptowalutowego USWR

Moment płatności agentów AI: Kto zostanie Stripe’em gospodarki maszynowej?

Sztuczna inteligencja wymusza dywersyfikację przechowywania Bitcoina

Bank centralny zakazał reklamy nielegalnych działalności związanych z kryptowalutami i płatnościami

OKI vs IKE vs IKZE: co wybrać w 2026? Podatki, limity i wyliczenia na 2027 rok

Charles Schwab rozszerza platformę kryptowalutową poza Bitcoin i Ethereum

Natura zmienia CEO: Carlucci wraca po dekadzie

Focus: inflacja spada, ale spadek PKB bardziej niepokoi

Regulacja rynku przewidywań wywołuje polityczną grę

Warren Buffett obchodzi 96. urodziny: inwestycje, które uczyniły go legendą Wall Street

Po odbiciu ceny akcji MiniMax o 92%: Co zostaje, gdy firma modelowa odejmuje model

FBI i australijska policja oskarżają dwóch mężczyzn w sprawie TeamPCP

Meta w trudnej sytuacji po zwolnieniach związanych z AI: wzrost incydentów bezpieczeństwa o 40%, czas na naprawy wzrósł o 70%

Bitcoin utrzymuje się na poziomie 78 tys. dolarów, gdy atak w Cieśninie Ormuz podnosi cenę ropy powyżej 90 dolarów





