Ant Group Ling-3.0-flash офіційно відкрито, версія FP8 лише 128 ГБ
Ant Group офіційно відкрила ваги Ling-3.0-flash, пропонуючи оригінальну версію BF16 та кількісну версію FP8, обидві під ліцензією MIT, доступні на Hugging Face та ModelScope, з можливістю самостійного розгортання за допомогою SGLang або vLLM. Версія BF16 займає близько 255 ГБ, а версія FP8 - близько 128 ГБ, що майже вдвічі менше, FP8 зберігає параметри з нижчою точністю, знижуючи вимоги до зберігання та відеопам'яті. Офіційні тести показали, що максимальна різниця між FP8 та BF16 становить 1,57 бала. Ling-3.0-flash має загальну кількість параметрів 1240 мільярдів, активуючи лише 5,1 мільярда під час кожного генерування, підтримує контекст до 256 тисяч токенів, головним чином орієнтуючись на завдання агентів, такі як програмування, пошук, глибоке дослідження та виклик інструментів. Офіційні оцінки показали, що ця модель досягає або перевищує показники попередніх моделей з трильйонами параметрів, таких як Ring-2.6-1T на більшості бенчмарків.
Ціна --
Цей контент надано лише для загальних інформаційних цілей і не є фінансовою, інвестиційною, юридичною чи податковою консультацією. Події, нагороди, онлайн-акцій або пов’язану інформацію, згадана тут, не слід розглядати як рекомендацію, прохання чи запрошення до купівлі, продажу, торгівлі чи інших операцій з криптоактивами. Криптоактиви є дуже волатильними та можуть призвести до збитків. Доступність послуг, продуктів WEEX та пов’язаних із ними подій може відрізнятися залежно від регіону. Ви несете відповідальність за забезпечення відповідності вашої участі чинному місцевому законодавству та нормативним актам.
Вам також може сподобатися

DeepSeek відкриває ваги V4-Flash-Vision-Exp, підтримує локальне розгортання

Коментар Bernstein про сім основних пам'ятей: після HBM, DRAM та NAND змагаються за наступний трильйонний ринок

Потужність токенів платформи B.AI перевищила 5,74 трильйона

Google створює WikiSkill, щоб агенти ШІ запам'ятовували свої помилки та покращувалися

B.AI безкоштовна модельна лінійка повністю запущена, шість флагманських моделей доступні безкоштовно

Ant Group представила фінансову модель Ling-3.0-flash-Fin, відкриття наступного тижня

Оренда енергії Tron, зниження комісії за USDT: TronBid розширює торговий ринок

HRF фінансує 16 проектів з Bitcoin в Латинській Америці та Карибському басейні

NVIDIA Qwen3.8-Flash-Next досягає понад 16 тисяч токенів на секунду на платформі GB300 NVL72

GLM-5.3-Flash офіційно відкрито, 320 мільярдів параметрів активують 18 мільярдів, ціна в одну десяту від GLM-5.2

Longxin та Yangtze Memory Technologies підтверджують якість з Apple, розширюючи ринок Північної Америки

Фонд прав людини надає 60 мільйонів сатоші на 16 проєктів

Алі оголосила про Qwen3.8-Flash-Next, заснований на архітектурі Qwen4

Muse Spark 1.2 Contributor версія безкоштовно на обмежений час

Microsoft виправив вразливість CVE-2026-69836 у Entra ID

DeepSeek API застосовує знижені тарифи на вихідні

Gemini 3.7 Flash встановив рекорд зростання за тиждень після запуску

Ціна Gemini 3.7 Flash становить 0,75 долара за мільйон токенів, відмінність з офіційними документами Google

DeepSeek запустила V4 Pro, Claude Fable 5 показує на 5,3% кращі результати за вартістю, що в 4600% вища

DeepSeek V4 Pro, доступний з 24 квітня

Ant Group запустила модель ШІ з 124 мільярдами параметрів, яка перевершує її гіганта з 1 трильйоном

Flash Trade може зупинити свою діяльність, шукає варіанти придбання

Коли починають мігрувати вузькі місця - Перепризначення між'єднання, HBM та всієї імперії зберігання

Ант Групп запускає Ling 3.0 Flash з активацією 5,1 мільярда токенів на токен

Затримка запуску Google Gemini 3.5 Pro

OpenRouter тижневий рейтинг: китайські моделі займають вісім позицій

DeepSeek перевершує Google, стає лідером за кількістю запитів на OpenRouter цього тижня

Відновлення API DeepSeek, V4 Flash займає 70%

Запуск національного суперкомп'ютерного інтернету DeepSeek-V4-Flash API



