GLM-5.3-Flash est officiellement open source, 320 milliards de paramètres activent 18 milliards, au prix d'un dixième de GLM-5.2
Zhipu a officiellement rendu open source GLM-5.3-Flash, avec les poids du modèle désormais disponibles sur Hugging Face sous licence MIT. Le modèle a un total de 320 milliards de paramètres, mais n'active que 18 milliards à la fois, prenant en charge le texte, les images et les vidéos, ce qui en fait le premier modèle multimodal natif de la série GLM-5. La déclaration officielle indique que GLM-5.3-Flash surpasse GLM-5.2 dans l'ensemble, avec des évaluations de programmation et d'agent approchant celles de Claude Opus 4.8, et est proposé à seulement un dixième du prix de GLM-5.2. Le nouveau modèle introduit une architecture d'attention sparse et d'attention linéaire mixte, et est pré-entraîné en utilisant 30 trillions de tokens de données multimodales. Les tests communautaires sur un petit échantillon de DeepSWE d'Ox Alpha ont atteint jusqu'à 80 %, mais les scores sont tombés à environ 63 % après l'augmentation de la taille de l'échantillon. Après que les poids aient été rendus open source, les développeurs peuvent déployer en utilisant des frameworks comme vLLM, SGLang et KTransformers sans dépendre de l'API de modèles anonymes.
Prix de --
Ce contenu est fourni à titre informatif uniquement et ne constitue pas un conseil financier, d'investissement, juridique ou fiscal. Les événements, récompenses, promotions en ligne ou informations mentionnées ici ne doivent pas être considérés comme une recommandation, une sollicitation ou une invitation à acheter, vendre, trader ou effectuer toute autre opération sur des actifs crypto. Les actifs crypto sont très volatils et peuvent entraîner des pertes. La disponibilité des services, produits et événements liés à WEEX peut varier selon les régions. Veuillez vous assurer que votre participation respecte les lois et réglementations locales applicables.
Vous pourriez aussi aimer

SK Hynix approfondit sa coopération avec le Japon en matière de stockage et développe une base de packaging HBM aux États-Unis

Louer de l'énergie Tron pour réduire les frais de transaction USDT : TronBid étend son marché d'échange

HRF finance 16 projets de Bitcoin en Amérique Latine et dans les Caraïbes

Changxin et Yangtze Memory Technologies valident leur qualité avec Apple pour élargir le marché nord-américain

Alibaba annonce Qwen3.8-Flash-Next, basé sur l'architecture Qwen4

Augmentation des prix des appareils Amazon : l'Echo Dot coûte 60 % de plus

SK Hynix et SanDisk dévoilent la première norme de flash à haute bande passante de 512 Go

Microsoft corrige la vulnérabilité CVE-2026-69836 dans Entra ID

Application de tarifs réduits pour les appels API le week-end par DeepSeek

Gemini 3.7 Flash établit un record de croissance en une semaine

DeepSeek V4 Pro disponible depuis le 24 avril

SK Hynix relance l'investissement dans la ligne de production NAND de Dalian, augmentation de la capacité de 50%

Retard dans le lancement de Google Gemini 3.5 Pro

OpenRouter : Les modèles chinois occupent huit places dans le classement hebdomadaire

Kioxia : bénéfice net de 842,17 milliards de yens au premier trimestre, en deçà des attentes du marché

Lancement de l'API B.AI sur Gemini 3.6 Flash et 3.5 Flash-Lite

Les analystes prévoient que la pénurie de mémoire flash NAND sera atténuée d'ici 2027

Kioxia fournit des échantillons de puces flash de nouvelle génération aux clients

Le site officiel de Deepseek annonce la documentation de l'API deepseek-v4

Le protocole de levier RWA 3F a complété un financement de 4 millions de dollars, dirigé par Maven 11







