Spectro Cloud przedstawia oszczędności kosztów tokenów do 70%
Spectro Cloud uruchomił lokalną platformę inferencyjną PaletteAI Inference Launchpad, która pozwala firmom na prowadzenie inferencji dużych modeli językowych (LLM) na własnym sprzęcie, co może obniżyć koszty tokenów o maksymalnie 70%. Produkt ten oferuje funkcje takie jak vLLM, Kubernetes, uwierzytelnianie, kontrola dostępu oparta na rolach (RBAC) oraz monitorowanie, a także wspiera GPU AMD i NVIDIA. Spectro Cloud rozszerzył wsparcie dla GPU AMD, operatorów GPU, środowiska uruchomieniowego ROCm oraz referencyjnego stosu AI dla przedsiębiorstw. Została również wprowadzona funkcjonalność integracji z narzędziami do kodowania AI, umożliwiająca połączenie z OpenAI Codex CLI. Firmy rozważają lokalną inferencję z powodu problemów z kosztami i kontrolą danych, ponieważ rosnące wykorzystanie usług AI w chmurze prowadzi do wyższych opłat za tokeny i ryzyka przesyłania wrażliwych informacji na zewnątrz. Spectro Cloud wyjaśnił, że lokalna inferencja pozwala na przechowywanie danych wewnątrz i przekształcanie kosztów infrastruktury w przewidywalne. AMD ocenił, że wsparcie infrastrukturalne Spectro Cloud przyspieszy wdrażanie usług firm w otwartym środowisku AI. Choć ogłoszenie to nie ma związku z kryptowalutami ani sieciami blockchain, może stanowić istotne wyzwanie pod względem kosztów i bezpieczeństwa dla organizacji zajmujących się kodem i wrażliwymi informacjami.
Cena --
Niniejsza treść ma charakter wyłącznie informacyjny i nie stanowi porady finansowej, inwestycyjnej, prawnej ani podatkowej. Wszelkie wydarzenia, nagrody, promocje online lub powiązane informacje, o których tu mowa, nie powinny być traktowane jako rekomendacja, zachęta ani zaproszenie do kupna, sprzedaży, wymiany lub innego rodzaju obrotu aktywami kryptograficznymi. Aktywa kryptograficzne charakteryzują się dużą zmiennością i mogą prowadzić do strat. Dostępność usług, produktów i powiązanych wydarzeń WEEX może się różnić w zależności od regionu. Użytkownik jest odpowiedzialny za upewnienie się, że jego udział jest zgodny z obowiązującymi lokalnymi przepisami i regulacjami.
Możesz również polubić

NVIDIA Qwen3.8-Flash-Next osiąga ponad 16 000 Tokenów na sekundę na platformie GB300 NVL72

Qualcomm wprowadza IMSDK 2.0, aby wspierać rozwój aplikacji AI na krawędzi

Apple wprowadza Mac mini z chipem M6, cena początkowa 899 USD

CFTC rozważa legalność wieczystych kontraktów futures na GPU【Przewodnik po najnowszych trendach】

Thomson Reuters rozwija model AI do prawa 'Thomson' za 40 milionów dolarów

Vitalik twierdzi, że Minimax H3 przewyższa HunyuanVideo 1.5

Alex Karp i wojna o suwerenność w AI w firmach

Qualcomm współpracuje z Multiverse Computing w zakresie optymalizacji modeli AI

Uniwersytet Ludowy w Chinach opracował AI do wykrywania nielegalnych transakcji Bitcoin, osiągając dokładność 89,4%

Morgan Stanley interpretuje: Spadek cen Tokenów i H100, czy koszty AI zaczynają maleć?

Recenzja modelu AI Inkling autorstwa Miry Murati: Najlepszy model open-source na Zachodzie

Block ogłosił czat z AI o otwartym kodzie źródłowym „Buzz”, aby konkurować z Slackiem i GitHubem

Kimi K3 po tygodniu: konsensus, różnice, ogólny trend

BTC spadł o 46%, dlaczego akcje kopalni nie spadły, a wręcz wzrosły?

WAIC Obserwacje: Tłoczne konsensusy, ogromne bańki

Byli członkowie zespołu AI Microsoftu zakładają Skyfall AI, planując zainwestować 1 milion dolarów w testowanie modelu „AI CEO”

Recenzja GPT-5.6 vs Fable 5: Wybór zależy od tych czynników

Akcje firm wydobywczych coraz dalej od kryptowalut

Kluczowe wnioski: Pełny tekst przemówienia głównego naukowca Google, Shanahana

Wzorce projektowe agentów: Książka, która zmusiła mnie do przemyślenia pytania: „Czym dokładnie jest agent?”

WORLD3 opublikowało raport strategiczny dotyczący sztucznej inteligencji: przetworzono ponad 100 miliardów tokenów LLM

założyciel a16z: W erze agentów zmieniło się to, co naprawdę się liczy

Prezydent Kirgistanu spotkał się z Sun Yuchenem, a firma TRON nawiązała współpracę z Kirgistanem w celu stworzenia nowego modelu gospodarki cyfrowej w Azji Środkowej

Liczba użytkowników usług B.AI LLM przekroczyła 1 milion

Liczba użytkowników serwisu B.AI oficjalnie przekroczyła 800 000

Liczba użytkowników platformy B.AI LLM przekroczyła 750 000

Badania wykazały, że routery oparte na sztucznej inteligencji innych producentów mają luki w zabezpieczeniach, które mogą prowadzić do kradzieży kryptowalut

Base ogłasza listę projektów zakwalifikowanych do programu akceleracyjnego Base Batch 003, na której znalazło się 12 projektów z dziedzin sztucznej inteligencji i DeFi

Fundacja Solana: Przetworzono już 15 milionów płatności realizowanych przez agenty AI w łańcuchu bloków, a stablecoiny stają się standardowym narzędziem rozliczeniowym





