Після підвищення цін на DeepSeek Flash добове споживання токенів знизилося більш ніж на 50%
DeepSeek V4 Flash, запущений 1 серпня, підвищив добове споживання токенів з приблизно 30 трильйонів до 180 трильйонів, зростання в 6 разів, наблизившись до добового обсягу обробки OpenRouter на всіх платформах. Його ціна становить 1/350 від Fable, 1/175 від GPT-5.6 Sol та 1/70 від Claude Sonnet, що вважається дешевим AI. 16 серпня DeepSeek підвищив ціни в години пік в 5 разів (в не пікові години - в 2.5 рази), що призвело до зниження добового споживання токенів моделі більш ніж на 50% від пікового значення. Генеральний директор OpenCode Джей В. зазначив, що підвищення цін є пасивним кроком у відповідь на зростання витрат на GPU. Наразі OpenCode шукає постачальників, які можуть приймати трафік за старими цінами, приблизно 1000 блоків B300 потрібно для підтримки поточного попиту. DeepSeek Flash виявив проблеми на ринку AI моделей.
Ціна --
Цей контент надано лише для загальних інформаційних цілей і не є фінансовою, інвестиційною, юридичною чи податковою консультацією. Події, нагороди, онлайн-акцій або пов’язану інформацію, згадана тут, не слід розглядати як рекомендацію, прохання чи запрошення до купівлі, продажу, торгівлі чи інших операцій з криптоактивами. Криптоактиви є дуже волатильними та можуть призвести до збитків. Доступність послуг, продуктів WEEX та пов’язаних із ними подій може відрізнятися залежно від регіону. Ви несете відповідальність за забезпечення відповідності вашої участі чинному місцевому законодавству та нормативним актам.
Вам також може сподобатися
![[Енергетичний аналіз] Наступна вузька ланка AI — це не GPU... «електромережа» заблокована](/public-static/16_c530d6305c.png?format=avif)
[Енергетичний аналіз] Наступна вузька ланка AI — це не GPU... «електромережа» заблокована

AI-хмара IREN перевищила доходи від видобутку біткоїнів, акції впали на 8%

IREN планує інвестиції в 250-300 мільярдів доларів у розширення AI, що викликає занепокоєння інвесторів

Bullish надає кредитний ліміт у 100 мільйонів доларів для USD.AI

Хуан Женьсюн назвав передові AI лабораторії інвестиційною можливістю

Samsung розробляє 8-шарову HBM4E для задоволення вимог NVIDIA

Як працює фінансування GPU: структура кредитування під заставу GPU від USD.AI

Гейз, AI-агент пропонує платіжний засіб Flop

Apple представила Mac mini з чіпом M6, початкова ціна 899 доларів

Відомий венчурний капітал a16z: «Інноваційна методологія» за останні 75 років, ШІ повністю переписав

Максимальний клієнт показує свої карти на день фінансового звіту|Ранковий бюлетень Rewire

Apple представила перший 2-нанометровий чіп M6 та чотирьохядерний чіп M5 Ultra

Enflame, китайський конкурент Nvidia у сфері ІІ, виходить на біржу

Штучний інтелект перебуває на етапі розширення кредиту: чим сильніший AI, тим більше ФРС потрібно знижувати процентні ставки

CFTC розглядає доцільність перпетуальних ф'ючерсів на GPU обчислення【Останні новини】

Пропозиція Ethereum скоротить випуск 33,800 ETH і зруйнує кожен розгорнутий легкий клієнт Altair

Томаш Тунгус: Ботлнек інфраструктури ШІ підвищує витрати

Зниження ціни токенів AI не заважає розширенню ринку

NVIDIA почала масове виробництво Groq 3 LPX, який буде розгорнуто в дата-центрах Nebius

BMO встановила цільову ціну для AMD на рівні 550 доларів

NVIDIA SpaceXAI впроваджує процесор Vera для прискорення агентного ШІ

6GW ядерна енергетика: неформальна угода між Nano Nuclear та Tillman

Aethir планує побудувати AI дата-центри потужністю 20 МВт у 10 місцях США та Європи

Aethir запускає програму ACCELERATE, створюючи 20 МВт обчислювальної потужності та оновлюючи механізм токенів

Недостатність обчислювальної потужності AI, ймовірно, триватиме до 2028 року

Лей Цзюнь представив чіпи Xuanjie O3, O100 та D100

DaliPoh, переходить на пряму поставку в ланцюзі постачання оптичних комунікацій NVIDIA

Запит на 474 гігавати: перевірка електропостачання дата-центрів зросла

AMD інвестує 10 мільярдів доларів у тайванську екосистему AI-напівпровідників



