GLM-5.3-Flash офіційно відкрито, 320 мільярдів параметрів активують 18 мільярдів, ціна в одну десяту від GLM-5.2
Zhipu офіційно відкрив GLM-5.3-Flash, моделі тепер доступні на Hugging Face під ліцензією MIT. Модель має загалом 320 мільярдів параметрів, але активує лише 18 мільярдів одночасно, підтримуючи текст, зображення та відео, що робить її першою рідною мультимодальною моделлю в серії GLM-5. Офіційна заява вказує, що GLM-5.3-Flash перевершує GLM-5.2 в цілому, з оцінками програмування та агентів, що наближаються до Claude Opus 4.8, і коштує лише одну десяту від GLM-5.2. Нова модель впроваджує змішану архітектуру розрідженої та лінійної уваги і попередньо навчена на 30 трильйонах токенів мультимодальних даних. Тестування спільноти на малих вибірках Ox Alpha's DeepSWE досягло 80%, але оцінки впали до приблизно 63% після розширення вибірки. Після відкриття ваги, розробники можуть розгортати, використовуючи такі фреймворки, як vLLM, SGLang та KTransformers, без залежності від API анонімних моделей.
Ціна --
Цей контент надано лише для загальних інформаційних цілей і не є фінансовою, інвестиційною, юридичною чи податковою консультацією. Події, нагороди, онлайн-акцій або пов’язану інформацію, згадана тут, не слід розглядати як рекомендацію, прохання чи запрошення до купівлі, продажу, торгівлі чи інших операцій з криптоактивами. Криптоактиви є дуже волатильними та можуть призвести до збитків. Доступність послуг, продуктів WEEX та пов’язаних із ними подій може відрізнятися залежно від регіону. Ви несете відповідальність за забезпечення відповідності вашої участі чинному місцевому законодавству та нормативним актам.
Вам також може сподобатися

DeepSeek відкриває ваги V4-Flash-Vision-Exp, підтримує локальне розгортання

Коментар Bernstein про сім основних пам'ятей: після HBM, DRAM та NAND змагаються за наступний трильйонний ринок

Потужність токенів платформи B.AI перевищила 5,74 трильйона

Google створює WikiSkill, щоб агенти ШІ запам'ятовували свої помилки та покращувалися

B.AI безкоштовна модельна лінійка повністю запущена, шість флагманських моделей доступні безкоштовно

Ant Group представила фінансову модель Ling-3.0-flash-Fin, відкриття наступного тижня

Оренда енергії Tron, зниження комісії за USDT: TronBid розширює торговий ринок

HRF фінансує 16 проектів з Bitcoin в Латинській Америці та Карибському басейні

NVIDIA Qwen3.8-Flash-Next досягає понад 16 тисяч токенів на секунду на платформі GB300 NVL72

Longxin та Yangtze Memory Technologies підтверджують якість з Apple, розширюючи ринок Північної Америки

Фонд прав людини надає 60 мільйонів сатоші на 16 проєктів

Алі оголосила про Qwen3.8-Flash-Next, заснований на архітектурі Qwen4

Muse Spark 1.2 Contributor версія безкоштовно на обмежений час

Microsoft виправив вразливість CVE-2026-69836 у Entra ID

DeepSeek API застосовує знижені тарифи на вихідні

Gemini 3.7 Flash встановив рекорд зростання за тиждень після запуску

Ціна Gemini 3.7 Flash становить 0,75 долара за мільйон токенів, відмінність з офіційними документами Google

DeepSeek запустила V4 Pro, Claude Fable 5 показує на 5,3% кращі результати за вартістю, що в 4600% вища

DeepSeek V4 Pro, доступний з 24 квітня

Ant Group запустила модель ШІ з 124 мільярдами параметрів, яка перевершує її гіганта з 1 трильйоном

Flash Trade може зупинити свою діяльність, шукає варіанти придбання

Коли починають мігрувати вузькі місця - Перепризначення між'єднання, HBM та всієї імперії зберігання

Ант Групп запускає Ling 3.0 Flash з активацією 5,1 мільярда токенів на токен

Ant Group Ling-3.0-flash офіційно відкрито, версія FP8 лише 128 ГБ

Затримка запуску Google Gemini 3.5 Pro

OpenRouter тижневий рейтинг: китайські моделі займають вісім позицій

DeepSeek перевершує Google, стає лідером за кількістю запитів на OpenRouter цього тижня

Відновлення API DeepSeek, V4 Flash займає 70%

Запуск національного суперкомп'ютерного інтернету DeepSeek-V4-Flash API





