Writer wprowadza nowy model Palmyra X6, koncentrując się na obniżeniu kosztów
Wiadomości z CoinWorld:
Klienci biznesowi coraz bardziej zwracają uwagę na koszty wdrożenia AI, szczególnie w kontekście rosnącego zapotrzebowania na duże modele. Nowy model i narzędzia towarzyszące, które wprowadza Writer, mają na celu złagodzenie tej presji: starają się obniżyć koszty realizacji bez zmiany przyzwyczajeń użytkowników w firmach.
Palmyra X6 skierowany do wdrożeń w firmach
W czwartek Writer zaprezentował nowy flagowy model Palmyra X6. Model ten oparty jest na wersji po treningu otwartego modelu Z.ai GLM-5.2 i jest zaprojektowany do bezpośredniego użycia w firmach, a nie tylko do osiągania wysokich wyników w testach benchmarkowych.
Firma twierdzi, że Palmyra X6 będzie oferowany równolegle z innymi modelami Writer oraz zewnętrznymi modelami dostępnymi przez Azure lub Amazon Bedrock, co oznacza, że klienci nie muszą przebudowywać całego systemu wokół jednego modelu.
Aktualizacje towarzyszące mają na celu obniżenie kosztów tokenów
Wraz z nowym modelem wprowadzono również ważną aktualizację standardowego agentic harness Writer. Kluczowym elementem nie jest tylko sam model, ale także procesy harmonogramowania, wywoływania i wnioskowania podczas realizacji zadań wieloetapowych.
- Nowy model to Palmyra X6
- Model bazowy pochodzi z GLM-5.2
- Koszt podstawowych zadań może zostać obniżony o maksymalnie 50%
Writer przewiduje, że nowy model, w połączeniu z tą infrastrukturą, pozwoli klientom na obniżenie kosztów podstawowych zadań o maksymalnie 50%. Firma podkreśla, że jeśli złożone zadania można wykonać przy mniejszej liczbie tokenów i szybszym tempie, całkowite koszty wdrożenia znacznie spadną.
Badania wskazują, że optymalizacja procesów jest bardziej skuteczna
Zespół badawczy Writer niedawno opublikował pracę, która wspiera tę tezę. Badanie testowało zmiany kosztów różnych modeli w różnych procesach wykonawczych, a wyniki pokazały, że w wielu przypadkach optymalizacja efektywności harness jest bardziej stabilna niż sama zmiana modelu, co średnio przynosi około 40% obniżki kosztów.
Dyrektor generalny Writer, May Habib, stwierdziła, że zainteresowanie klientów biznesowych ciągłym dążeniem do nowych testów benchmarkowych maleje, a ich uwaga przesuwa się w stronę stabilizacji kosztów. Dodała, że niektórzy technicy w firmach tracą zaufanie do dużych laboratoriów AI, częściowo z powodu tego, że ich model biznesowy jest ściśle związany z ilością używanych tokenów.
Cena --
Niniejsza treść ma charakter wyłącznie informacyjny i nie stanowi porady finansowej, inwestycyjnej, prawnej ani podatkowej. Wszelkie wydarzenia, nagrody, promocje online lub powiązane informacje, o których tu mowa, nie powinny być traktowane jako rekomendacja, zachęta ani zaproszenie do kupna, sprzedaży, wymiany lub innego rodzaju obrotu aktywami kryptograficznymi. Aktywa kryptograficzne charakteryzują się dużą zmiennością i mogą prowadzić do strat. Dostępność usług, produktów i powiązanych wydarzeń WEEX może się różnić w zależności od regionu. Użytkownik jest odpowiedzialny za upewnienie się, że jego udział jest zgodny z obowiązującymi lokalnymi przepisami i regulacjami.
Możesz również polubić

Tryb bota Hermes Bot Mode wbudowany, wspiera współpracę AI w grupach

ZCode wstrzymuje akcję rozdawania 100 milionów tokenów GLM-5.3 po godzinie od uruchomienia

ZhiPu Tangjie zapowiada nadchodzące uruchomienie GLM-5.3

Mistral zaczyna hostować model GLM-5.2 od Z.ai

Claude Code wyprzedza CodeBuddy w 17 z 28 porównań

Aktualizacja ZCode od Zhipu, nowa funkcjonalność Goal+ Subagent

AMD wprowadza platformę programistyczną AI dla przedsiębiorstw AMD Instinct Coder

DeepSeek Harness rozpoczyna testy wewnętrzne w tym tygodniu, pierwsi użytkownicy wybrani z małych grup czatowych

Moonshot AI ujawnia wagi modelu Kimi K3 z 2,8 biliona parametrów, udział tokenów w modelu wzrasta do 68%

Departament Handlu USA ocenia zdolności ataków sieciowych Kimi K3, wyniki budzą kontrowersje

Wojna i rotacja kapitału powodują gwałtowny spadek akcji w sektorze półprzewodników AI

GPT-5.6 Sol na szczycie rankingu projektowania front-end, wyprzedza GPT-5.5 o 18 miejsc

Zakupy międzynarodowe w dolarach: przewodnik po systemie Puerta a Puerta bez niespodzianek

Twój mózg działa na 20 watów. AI potrzebuje elektrowni

"Zaciąganie długów na akcje" – szaleństwo dźwigni... Dlaczego Wall Street zwraca uwagę na gwałtowny spadek na koreańskim rynku akcji

Negatywne PKB w III kwartale wkrótce na radarze rynku

CEO Jeremy Allaire mówi, że Circle zbudował „platformę dla internetowego systemu finansowego”, ale cirBTC ma tylko 40 BTC

Arthur Hayes wskazał na dużą kryptowalutę, którą rynek mocno niedocenia

Prognoza ceny VeChain (VET): możliwa dynamika kursu do 2050 roku

Rezerwy stablecoinów skoncentrowane na obligacjach skarbowych o terminie do 93 dni

USDC na koszulce Chelsea: co umowa mówi o kryptowalutach w sporcie

Polymarket rozszerza się na 20 lig, konflikt z regulacjami wciąż rośnie

ETH: anatomia niedoboru

Ulubiony broker Bitcoina Wall Street właśnie zrezygnował z handlu instytucjonalnego, aby gonić gigawaty energii

SHAKA Festival 2026: W Biarritz francuska technologia zamienia salę konferencyjną na plażę

Raport o bezpieczeństwie Neocloud: szokujące błędy w konfiguracji infrastruktury, RCE między najemcami mogące dotknąć banki, telekomunikację, a nawet agencje wywiadowcze

Czarny trójkąt na giełdach kryptowalut: dlaczego sprzedawca kryptowaluty może stać się oskarżonym

G20 w Asheville: USA zwołują finansistów świata, aby rozmawiać o wzroście i sankcjach przeciwko Iranowi

Uzbekistan potwierdza zakup myśliwca J-10CE i kwestionuje dominację militarną Rosji w Azji Środkowej





