NVIDIA Qwen3.8-Flash-Next досягає понад 16 тисяч токенів на секунду на платформі GB300 NVL72

By: www.theblockbeats.info|2026/08/26 17:14:34
0
Поширити
copy
Оцінити в GoogleОцінити в Google

NVIDIA опублікувала статтю, в якій зазначається, що остання попередня модель Alibaba Qwen3.8-Flash-Next отримала підтримку платформи NVIDIA GB300 NVL72. Загальна кількість параметрів моделі становить 1760 мільярдів, при цьому на кожен токен активується близько 6 мільярдів параметрів. Модель нативно підтримує контекст до 262 тисяч токенів і може бути розширена до 1 мільйона токенів за допомогою YaRN, орієнтуючись на застосування Agent з довгим контекстом, такі як інтелектуальне програмування, обробка документів та виклики інструментів. NVIDIA зазначає, що Qwen3.8-Flash-Next використовує змішану архітектуру Gated DeltaNet (GDN) та Qwen Sparse Attention (QSA) для зменшення обчислювальних витрат та витрат на кешування KV у сценаріях з довгим контекстом. Тестування показало, що на платформі GB300 NVL72 ця модель має пропускну здатність понад 16 тисяч токенів на секунду на один GPU, а пропускна здатність для одного користувача перевищує 200 токенів на секунду; також підтримує такі інфраструктури, як SGLang, vLLM та TensorRT-LLM.

Ціна --

--
--
--

Цей контент надано лише для загальних інформаційних цілей і не є фінансовою, інвестиційною, юридичною чи податковою консультацією. Події, нагороди, онлайн-акцій або пов’язану інформацію, згадана тут, не слід розглядати як рекомендацію, прохання чи запрошення до купівлі, продажу, торгівлі чи інших операцій з криптоактивами. Криптоактиви є дуже волатильними та можуть призвести до збитків. Доступність послуг, продуктів WEEX та пов’язаних із ними подій може відрізнятися залежно від регіону. Ви несете відповідальність за забезпечення відповідності вашої участі чинному місцевому законодавству та нормативним актам.

Вам також може сподобатися

DGrid AI: реконструкція механізму довіри до інфраструктури AI за допомогою PoQ та верифікаційних вузлів

200 AI торгових продуктів абсолютно неефективні? Колишній співзасновник Foresight Ventures зробив щось інакше

Qualcomm випустила IMSDK 2.0 для розвитку додатків на основі AI на краю

Чому ваше письмо звучить як AI? Редактори a16z навчають вас, як повернути «людський дотик»

Apple представила Mac mini з чіпом M6, початкова ціна 899 доларів

Новий Mac mini з чіпом M6 має початкову ціну 899 доларів, що на 100 доларів більше, ніж у заміненій моделі • Apple оновила Mac Studio, позиціонуючи обидві лінійки продуктів для виконання AI завдань на локальних пристроях • Попередні замовлення розпочалися у вівторок, доставка очікується 22 вересня.

CFTC розглядає доцільність перпетуальних ф'ючерсів на GPU обчислення【Останні новини】

CFTC проводить збір думок щодо "перпетуальних обчислювальних ф'ючерсів". Термін подачі коментарів до 20 жовтня 2026 року. Запрошуємо вас взяти участь через офіційний сайт.
...

Вміст

Найновіші статті

Більше

Нещодавні лістинги монет на WEEX

iconiconiconiconiconicon
Підтримка клієнтів:@weikecs
Співпраця:@weikecs
Кількісна торгівля та маркетмейкінг:[email protected]
VIP-програма:[email protected]