Writer випустив нову модель Palmyra X6, що знижує витрати
Біткоїн-інформатор повідомляє:
Корпоративні клієнти все більше звертають увагу на витрати на впровадження ШІ, особливо на фоні постійного зростання обсягу викликів великих моделей. Нова модель та супутні інструменти, випущені Writer, націлені саме на цю проблему: зменшити витрати на виконання без зміни звичок використання підприємств.
Palmyra X6 для корпоративного впровадження
Writer у четвер представив свою нову флагманську модель Palmyra X6. Ця модель створена на основі післятренувальної версії відкритої моделі Z.ai GLM-5.2, її позиціонування — безпосереднє використання в підприємствах, а не просто досягнення високих результатів у бенчмарках.
Компанія стверджує, що Palmyra X6 буде надаватися паралельно з іншими моделями Writer, а також з зовнішніми моделями, підключеними через Azure або Amazon Bedrock, що дозволяє клієнтам не відновлювати всю систему навколо єдиної моделі.
Супутнє оновлення націлене на витрати токенів
Разом з новою моделлю було випущено важливе оновлення стандартного агентного harness Writer. Основна увага приділяється не лише самій моделі, а й процесам планування, виклику та міркування під час виконання багатоступеневих завдань.
- Нова модель — Palmyra X6
- Базова модель — GLM-5.2
- Витрати на базові завдання можуть знизитися до 50%
Writer очікує, що нова модель разом з цією інфраструктурною адаптацією дозволить клієнтам знизити витрати на базові завдання до 50%. Компанія підкреслює, що якщо складні завдання можуть бути виконані з меншою кількістю токенів і швидше, загальні витрати на впровадження значно знизяться.
Дослідження підтверджує ефективність оптимізації процесів
Нещодавно команда дослідників Writer опублікувала статтю, яка також підтримує це твердження. У статті тестувалися різні моделі в умовах різних виконавчих процесів, і результати показали, що в багатьох випадках оптимізація ефективності harness є більш стабільною, ніж проста зміна моделі, в середньому забезпечуючи близько 40% зниження витрат.
Генеральний директор Writer Мей Хабіб зазначила, що інтерес корпоративних клієнтів до постійного переслідування нових бенчмарків зменшується, і їхня увага переключається на стабільність витрат. Вона також зазначила, що деякі технічні керівники підприємств втрачають довіру до великих лабораторій ШІ, оскільки бізнес-моделі останніх тісно пов'язані з обсягом використання токенів.
Ціна --
Цей контент надано лише для загальних інформаційних цілей і не є фінансовою, інвестиційною, юридичною чи податковою консультацією. Події, нагороди, онлайн-акцій або пов’язану інформацію, згадана тут, не слід розглядати як рекомендацію, прохання чи запрошення до купівлі, продажу, торгівлі чи інших операцій з криптоактивами. Криптоактиви є дуже волатильними та можуть призвести до збитків. Доступність послуг, продуктів WEEX та пов’язаних із ними подій може відрізнятися залежно від регіону. Ви несете відповідальність за забезпечення відповідності вашої участі чинному місцевому законодавству та нормативним актам.
Вам також може сподобатися

DGrid AI глибоке дослідження: як децентралізована AI інфраструктура робить послуги «викликаними, перевіреними, розрахованими»

Офіційне впровадження режиму Bot Mode в Hermes, підтримка AI-колективної роботи

Гонка за ШІ: США вимагають обрати свій табір - французький Mistral звертається до Китаю

GPT-5.6 знизив вартість на третину за завдання

ZCode безкоштовно роздає 100 мільйонів токенів GLM-5.3, акція призупинена через годину після запуску

web3: Z.ai випустила програмну модель GLM-5.3, націлену на ринок відкритих ваг

Zhipu Tangjie оголосив, що запуск GLM-5.3 наближається

GPT-5.6 Sol, на 13% дешевше за загальні витрати, ніж Kimi K3

Mistral починає хостинг моделі GLM-5.2 від Zhiyu

Оновлення ZCode від Zhipu, запуск функції Goal+ SubAgent

Користувачі Zhipu наближаються до 7 мільйонів, активовано понад 50 тисяч вітчизняних AI чіпів

GLM-5.2 обвалюється на 95% і загрожує DeepSeek у ціновій війні штучного інтелекту

Pally завершила фінансування на 5,2 мільйона доларів, Cyber Fund та Y Combinator стали провідними інвесторами

AMD представила корпоративну платформу програмування AI AMD Instinct Coder

Важливі новини за ніч та ранок (3-4 серпня)

Модель GLM-5.3 від Zhiyu, ймовірно, була раніше розкрита

Джя Янцин заснував Intent Lab, запустив команду Agent Fleet

Шахрайський ШІ OpenAI зламав ще чотири платформи, крім Hugging Face

DeepSeek Harness розпочинає бета-тестування цього тижня, перші користувачі обрані з невеликих групових чатів

Колишній співробітник Anthropic стверджує, що хакери використовують Claude та Codex

Moonshot AI оприлюднила вагу Kimi K3 з 2,8 трильйона параметрів, частка токенів зросла до 68%

Огляд моделі Inkling AI від Міри Мураті: Найкраща відкрита модель на Заході

Хуан Ренсюнь заявив, що відкриті та закриті AI моделі будуть співіснувати в довгостроковій перспективі

Міністерство торгівлі США оцінює здатність Kimi K3 до кібератак, результати викликають суперечки

Невикористані обчислювальні потужності, дешева електрика, непомічені моделі — DGrid хоче перетворити їх на прибуток

Zhizhu побудував дата-центр потужністю 1 ГВт, використовуючи вітчизняні чіпи

Проект 01.ai планує IPO в Гонконзі у 2027 році, з часткою доходів від закордонного бізнесу 50%

Війна та ротація: різке падіння акцій AI-семікондукторів

DGrid Genesis за півроку отримав понад 23 мільйони доларів: децентралізований AI переходить до етапу реальної платної верифікації




