NVIDIA Qwen3.8-Flash-Next erreicht über 16.000 Token/Sekunde Durchsatz auf GB300 NVL72
NVIDIA hat in einem Artikel bekannt gegeben, dass das neueste Vorschau-Modell von Alibaba, Qwen3.8-Flash-Next, die Unterstützung der NVIDIA GB300 NVL72 Plattform erhalten hat. Das Modell hat eine Gesamtparameterzahl von 176 Milliarden, wobei etwa 6 Milliarden Parameter pro Token aktiviert werden. Es unterstützt nativ einen Kontext von 262.000 Token und kann über YaRN auf bis zu 1 Million Token erweitert werden, hauptsächlich für Anwendungen von Agenten mit langem Kontext in intelligentem Programmieren, Dokumentenverarbeitung und Toolaufrufen. NVIDIA erklärte, dass Qwen3.8-Flash-Next eine gemischte Architektur aus Gated DeltaNet (GDN) und Qwen Sparse Attention (QSA) verwendet, um die Berechnungs- und KV-Cache-Kosten in Szenarien mit langem Kontext zu reduzieren. Tests zeigen, dass das Modell auf dem GB300 NVL72 mit einem einzelnen GPU-Durchsatz von über 16.000 Token/Sekunde und einem Durchsatz von über 200 Token/Sekunde pro Benutzer arbeitet. Es unterstützt auch Inferenz-Frameworks wie SGLang, vLLM und TensorRT-LLM.
---Preis
Dieser Inhalt wird nur zu allgemeinen Informationszwecken bereitgestellt und stellt keine finanzielle, Anlage-, Rechts- oder Steuerberatung dar. Alle erwähnten Ereignisse, Prämien, Online-Aktionen oder zugehörige Informationen sollten nicht als Empfehlung, Aufforderung oder Einladung zum Kauf, Verkauf, Handel oder anderweitigem Umgang mit Krypto-Assets betrachtet werden. Krypto-Assets sind sehr volatil und können zu Verlusten führen. Die Verfügbarkeit von WEEX Services, Produkten und zugehörigen Aktionen kann je nach Region unterschiedlich sein. Sie sind dafür verantwortlich sicherzustellen, dass Ihre Teilnahme mit geltenden lokalen Gesetzen und Vorschriften übereinstimmt.
Das könnte Ihnen auch gefallen

DGrid AI: Vertrauensmechanismen für KI-Infrastruktur mit PoQ und Validierungsknoten neu gestalten

200 AI-Handelsprodukte völlig nutzlos? Ehemaliger Mitgründer von Foresight Ventures hat eine andere Sichtweise

Qualcomm veröffentlicht IMSDK 2.0 zur Förderung der Entwicklung von Edge-AI-Anwendungen

Apple bringt Mac mini mit M6-Chip auf den Markt, ab 899 US-Dollar

CFTC prüft die Zulässigkeit von perpetual Futures im GPU-Computing

Thomson Reuters entwickelt mit 40 Millionen Dollar das Rechts-AI-Modell 'Thomson'

Tencent, WeChat WeLM-Team erhält Zuwachs durch Forscher für Nachtraining

JPMorgan interpretiert: Sinkende Preise für Token und H100 – Beginnt die Kosten für KI zu sinken?

Replikation des "DeepSeek-Moments"? Wall Street sagt: Kimi K3 verstärkt tatsächlich die Nachfrage nach Rechenleistung

Wichtigste Erkenntnisse: Volltext der Rede von Google-Chef-Wissenschaftler Shanahan

Agentic Design Patterns: Ein Buch, das mich dazu brachte, „Was genau ist ein Agent?“ zu überdenken

WORLD3 veröffentlicht strategisches Weißbuch zur KI: Hat über 100 Milliarden LLM-Token verarbeitet

a16z Gründer: Im Zeitalter der Agenten hat sich das, was wirklich zählt, verändert.

Wie NVIDIA das Zahlungsmodell der Grundlage für PayPal entwickelt hat

Die Zahl der Nutzer der B.AI LLM-Dienstleistungen hat die Millionengrenze überschritten.

Die Zahl der B.AI-Nutzer übersteigt offiziell 800.000.

Die Nutzerzahl der B.AI LLM-Serviceplattform hat 750.000 überschritten.

Untersuchungen zeigen, dass KI-Router von Drittanbietern Sicherheitslücken aufweisen, die zu Kryptowährungsdiebstahl führen können.

Base gibt die Auswahlliste für den Base Batch 003 Accelerator bekannt; 12 Projekte aus den Bereichen KI und DeFi haben es in die engere Auswahl geschafft.

Solana Stiftung: 15 Millionen On-Chain-Zahlungen von KI-Agenten wurden verarbeitet, und Stablecoins werden zum Standard-Zahlungsinstrument

Die grundlegende Geschäftsvereinbarung der Billionen-Dollar-Agentenwirtschaft: Beim Verständnis von ERC-8183 geht es nicht nur um Zahlungen, sondern um die Zukunft.

„Onkel wurde von einem Hummer verletzt“ – um 440.000 Dollar betrogen: Ist die KI-Agentin wirklich so gut darin, solche Maschen zu durchbrechen?

WEEX KI Trading Hackathon Regeln & Richtlinien
Dieser Artikel erklärt die Regeln, Anforderungen und Preisstruktur für die WEEX KI Trading Hackathon Finals, bei denen die Finalisten mit KI-gesteuerten Handelsstrategien unter realen Marktbedingungen konkurrieren.
Lohnt sich der WEEX AI Trading Hackathon? $1.88M Preispool und Regeln erklärt
Ein KI-Handelswettbewerb mit einem Preispool von 1,88 Mio. $ – erkunde die WEEX AI Trading Hackathon Regeln, OpenAPI Trading und Teilnahmevoraussetzungen nur für KI.



