DeepSeek V4 Flash zmniejsza różnicę w wydajności z Claude'em
DeepSeek V4 Flash zmniejsza różnicę z modelem Claude firmy Anthropic dzięki niskim kosztom API i kontekstowi 1 miliona tokenów. Jednak w publicznych benchmarkach trudno jest ogólnie przewyższyć model Claude'a. V4 Flash wykorzystuje 284 miliardy parametrów, a aktywny model to 'DeepSeek-V4-Flash-0731'. Ceny wynoszą 0,66 USD poza szczytem i 1,32 USD w szczycie, co jest tańsze w porównaniu do opłaty za wyjście modelu Claude'a Opus 4,8 wynoszącej 25 USD. Jednak DeepSeek planuje podnieść ceny API dla V4 Pro i V4 Flash oraz wprowadzić nowy cennik od 17 sierpnia. W porównaniach wydajności V4 Flash uzyskał 82,7 punktu w benchmarku terminalowym 2.1, podczas gdy Claude uzyskał 85,0 punktu, co oznacza niewielką różnicę. Jednak w takich testach jak NL2Repo i CyberGym, Claude był dominujący. DeepSeek podkreśla, że V4 Flash rozszerzył zakres wydajności w stosunku do kosztów, co pozwala firmom na wybór modeli w zależności od najwyższej wydajności i dużych zadań wywołania. Efekty oszczędności kosztów AI V4 Flash dla przedsiębiorstw muszą zostać potwierdzone przez rzeczywiste przypadki wdrożenia.
Cena --
Niniejsza treść ma charakter wyłącznie informacyjny i nie stanowi porady finansowej, inwestycyjnej, prawnej ani podatkowej. Wszelkie wydarzenia, nagrody, promocje online lub powiązane informacje, o których tu mowa, nie powinny być traktowane jako rekomendacja, zachęta ani zaproszenie do kupna, sprzedaży, wymiany lub innego rodzaju obrotu aktywami kryptograficznymi. Aktywa kryptograficzne charakteryzują się dużą zmiennością i mogą prowadzić do strat. Dostępność usług, produktów i powiązanych wydarzeń WEEX może się różnić w zależności od regionu. Użytkownik jest odpowiedzialny za upewnienie się, że jego udział jest zgodny z obowiązującymi lokalnymi przepisami i regulacjami.
Możesz również polubić

Wydanie OpenClaw 2.0, 933 deweloperów wzięło udział w aktualizacji

Izrael utrzymuje warunki wycofania w negocjacjach z Gazą i Libanem

Virtuals, eksperyment z modelem dochodowym 40 000 agentów AI

EIP-8141, rozważany jako kandydat do aktualizacji Hegotá

Sudan: Fuzja AI i Web3 to pewny trend, płatności i potwierdzenie własności staną się niezbędne

Coinbase wprowadza system AI CEEcil z długoterminową pamięcią i zdolnością do aktywnego przetwarzania zadań

Podwyżka płac dla pracowników domowych we wrześniu

OpenAI przewiduje osiągnięcie AGI do końca 2026 roku

Funkcja przeglądarki w ChatGPT Work od OpenAI umożliwia automatyczne logowanie się do kont

8-12% obiecują, 5-6% otrzymują: ekspert mówi o rzeczywistej rentowności nieruchomości w Europie

Nowy model płatności za usługi Google Cloud Gemini Enterprise

Parametry MiniMax M3Pro mają wzrosnąć do około 3T

Nowa funkcja logowania na stronie w ChatGPT Work

Figure uruchamia projekt Index, nagradzając ludzi za wkład w dane treningowe

Wiceprezes Tencent twierdzi, że niedobór mocy obliczeniowej spowalnia rozwój modelu Hunyuan

SKILD AI wprowadza model podstawowy robota S1, ucząc się z wideo w 10 minut

Hayes ogłasza harmonogram testnetu na październik 2026 roku

Token airdrop $FLOP, Hayes ogłasza uczciwe uruchomienie bez przedsprzedaży

Meta planuje wprowadzenie platformy agentów AI HATCH

Generał Czereśnia i inne ukraińskie firmy obronne uruchamiają produkcję dronów i robotów w Finlandii

Wykorzystanie tokenów przez agentów AI wzrosło 14-krotnie od lutego

Wydatki na Fable 5 wynoszą 11,4%, ograniczone przyjęcie AI

Plater i Workday współpracują w zakresie transformacji AI w obszarze HR i finansów

Klienci korporacyjni wybierają tańsze modele zamiast Claude Fable 5

Buterin przestawia priorytety w roadmapie Ethereum

INDODAX Podkreśla Równowagę Regulacji i Innowacji w Rozwoju Kryptowalut - Świat Fintech

OpenAI odkrywa problem z dodatkowym zużyciem Codex, jutro pełne resetowanie

Szef działu chipów Tencentu, Gao Jianlin, odchodzi, aby założyć własną firmę i opracować AI CPU oparty na RISC-V

Google wprowadza funkcję zdalnego sterowania dla Antigravity 2.0




