Kimi K3 z Chin opuścił swoją piaskownicę, aby znaleźć odpowiedzi na testy
Kimi K3 od Moonshot AI opuścił piaskownicę, w której był testowany, i przeszedł do otwartego internetu, aby znaleźć odpowiedzi na postawione mu problemy, według firmy zabezpieczeń Frontier Security.
Model był oceniany pod kątem umiejętności obrony w cyberbezpieczeństwie i wyraźnie polecono mu rozwiązywanie problemów bez ich wyszukiwania. Frontier stwierdził, że nie podjął się tego zadania wcale. Zamiast tego zbadał sieć, ustalił, że rozwiązywanie DNS dla github.com działa, sklonował oficjalne repozytorium benchmarkowe i odczytał rozwiązanie z dysku.
Frontier nazywa to "graniem w specyfikacje poprzez wycieki z sieci", zauważając, że piaskownice zbudowane na frameworkach takich jak blokada AI Security Institute blokują ruch przychodzący, pozostawiając jednocześnie otwarte porty HTTPS i DNS. Zdolne agenty rutynowo sprawdzają swoje środowisko powłoki przy uruchamianiu, a model, który znajduje github.com jako osiągalny, może pobierać rozwiązania referencyjne za pomocą standardowych narzędzi wiersza poleceń.
Błędna konfiguracja umożliwiła to, podobnie jak w ostatnich incydentach ujawnionych przez OpenAI i Anthropic. "Znaleźliśmy wyciek w piaskownicy," powiedział dyrektor generalny Yaron Singer w rozmowie z WIRED. "Ale odkryliśmy również, że Kimi skorzystał z tej luki."
Badacz Paul Kassianik powiedział WIRED, że model jest "bardzo dobry w dążeniu do celu wszelkimi możliwymi sposobami" i brakuje mu zabezpieczeń, które powstrzymałyby go przed oszustwem lub ucieczką. Moonshot nie odpowiedział na prośbę publikacji o komentarz.
Agenci AI łamiący ograniczenia
Gdzie modele Anthropic i OpenAI, które złamały ograniczenia, zostały złapane w wewnętrznych ocenach, z których jedna nie została wydana, a wersje, które celowały w prawdziwych ludzi w testach rządowych w Wielkiej Brytanii, miały swoje klasyfikatory cybernetyczne celowo wyłączone, Kimi K3 jest ogólnie dostępny do pobrania, a Frontier testował go z zabezpieczeniami, które miałby zwykły użytkownik. Ta dostępność, jak napisała firma, sprawia, że takie zachowanie jest w zasięgu przeciwników i czyni incydent potencjalnie bardziej szkodliwym.
Kimi K3 nie wyrządził również żadnych szkód. Nie zaatakował niczego po wyjściu, ponieważ nie musiał. Model OpenAI zhakował Hugging Face i cztery inne usługi, aby uzyskać odpowiedzi benchmarkowe, podczas gdy Kimi znalazł swoje odpowiedzi w publicznym repozytorium.
Piaskownica używana przez Frontier została zbudowana na frameworku oceny AI Security Institute w Wielkiej Brytanii. AISI ujawnił w tym tygodniu, że agenci w jego własnym teście cybernetycznym przeszli do internetu i celowali w prawdziwych ludzi - to oddzielny incydent, dotyczący modeli Anthropic i OpenAI z wyłączonymi zabezpieczeniami. W opublikowanym we wtorek raporcie zauważono, że AISI teraz skanuje historyczne uruchomienia ocen w poszukiwaniu podobnych zachowań, a Kimi K3 jest jednym z modeli poddawanych przeglądowi. AISI nie odpowiedział na prośbę WIRED o komentarz.
Większe twierdzenie Frontier jest takie, że same benchmarki są skompromitowane. Model, który odczytuje odpowiedź z GitHub, nadal przechodzi, więc wysokie wyniki mogą odzwierciedlać nieszczelną środowisko, a nie prawdziwe rozumowanie. A jeśli jeden zdolny model znalazł skrót, firma argumentuje, że inne modele, którym przyznano dostęp do powłoki, mogą również z niego korzystać, co zwiększyłoby wyniki w całej dziedzinie, a nie tylko dla Kimi.
Modele optymalizują dla funkcji celu, napisał Frontier, a nie dla "ludzkiej intencji stojącej za benchmarkiem", dodając, że tam, gdzie istnieje ścieżka sieciowa do rozwiązania, "wystarczająco zdolny agent ją znajdzie."
Ogólny problem
Matt Fredrikson, dyrektor generalny Gray Swan i profesor nadzwyczajny na Carnegie Mellon, powiedział WIRED, że to zachowanie jest nieprzypadkowe. Dając modelowi cel bez wyraźnych granic wokół niego, powiedział, "znajdzie sposób, aby uzyskać odpowiedź." Opisał to jako przestrogę dla każdego, kto uruchamia modele jako agentów w narzędziach takich jak OpenClaw.
Badacze Frontier podnoszą ten sam punkt z drugiej strony: zdolność, która pozwala Kimi znaleźć drogę na zewnątrz, czyni również modele o otwartych wagach silnymi narzędziami obronnymi. Ich własne benchmarki wysoko oceniają Kimi w znajdowaniu luk w oprogramowaniu i sieciach, a Hugging Face użył nieujawnionego chińskiego modelu, aby się obronić podczas incydentu z OpenAI.
Wydany w lipcu, Kimi K3 jest największym modelem open-source, jaki kiedykolwiek opublikowano, i wstrząsnął rynkami w porównaniach do debiutu DeepSeek.
Cena --
Niniejsza treść ma charakter wyłącznie informacyjny i nie stanowi porady finansowej, inwestycyjnej, prawnej ani podatkowej. Wszelkie wydarzenia, nagrody, promocje online lub powiązane informacje, o których tu mowa, nie powinny być traktowane jako rekomendacja, zachęta ani zaproszenie do kupna, sprzedaży, wymiany lub innego rodzaju obrotu aktywami kryptograficznymi. Aktywa kryptograficzne charakteryzują się dużą zmiennością i mogą prowadzić do strat. Dostępność usług, produktów i powiązanych wydarzeń WEEX może się różnić w zależności od regionu. Użytkownik jest odpowiedzialny za upewnienie się, że jego udział jest zgodny z obowiązującymi lokalnymi przepisami i regulacjami.
Możesz również polubić

Lido DAO przyznaje 60000 dolarów na wsparcie standardów operacyjnych weryfikatorów ValOS

tZERO i ICE nawiązują współpracę, ICE inwestuje w rundę finansowania tZERO i uzyskuje licencję na patenty blockchain

Urzędnicy z Peru będą się szkolić w zakresie kryptowalut i cyberbezpieczeństwa

Renaiss osiągnęło przychody przekraczające 30 milionów dolarów, wprowadza standard weryfikacji sprawiedliwości losowania blind boxów

Focus: inflacja spada, ale spadek PKB bardziej niepokoi

Strategia kupuje 4603 BTC za 370 milionów USD

Amerykański rynek akcji, rosnące podobieństwa do kryzysu finansowego z 1907 roku

Meta w trudnej sytuacji po zwolnieniach związanych z AI: wzrost incydentów bezpieczeństwa o 40%, czas na naprawy wzrósł o 70%

Kontrowersje dotyczące BIP-110 Bitcoina związane z hard forkiem Proof of Work

David Schwartz, dyrektor Ripple, zareagował na zwolenników BIP 110

DeepSeek udostępnia wagi V4-Flash-Vision-Exp, wspierając lokalne wdrożenie

Honda i Nissan wspólnie opracowują oprogramowanie dla nowej generacji samochodów

Rząd oficjalizował nową podwyżkę płac dla wojskowych, służb bezpieczeństwa i pracowników publicznych: ile wyniesie

Ontology wstrzymuje produkcję bloków w sieci głównej z powodu potencjalnych obaw o bezpieczeństwo

Cyfrowy rubel nie budzi znaczącego zainteresowania wśród Rosjan, uważa Sberbank

Polymarket przygotowuje się na nieprawidłowości w handlu podczas wyborów pośrednich

Zhao Changpeng dzieli się sposobem radzenia sobie ze stresem, podkreślając znaczenie wysiłku

JPMorgan rozszerza zespół ds. aktywów kryptograficznych w dziale bankowości detalicznej

USD.AI pozyskuje 100 milionów dolarów od Bullish

Matt Damon wystąpi jako główny mówca! Nowojorski „Ripple Swell 2026” zyskał uwagę

USA wzywają G20 do przemyślenia handlu z Chinami

Tajlandia wprowadza „TH-AI Passport”, obejmujący 5 milionów użytkowników i oferujący 33 modele AI

Trader stracił ponad 350 tysięcy CAD na zakładach dotyczących SpaceX

Ministerstwo Gospodarki promuje integrację mózgu z maszynami oraz sztuczną inteligencję w produktach dostosowanych do osób starszych

Kto sprzedaje Yushu? Duża wymiana akcji na wysokim poziomie, w przyszłym roku 228,7 miliona akcji zostanie uwolnionych

Firma Ripple przekazuje 300 tysięcy dolarów na pomoc w powodzi w Nepalu i Tybecie

CEO Tethera twierdzi, że stablecoiny są bardziej wiarygodne niż tokeny depozytowe

Arbitraż kryptowalut i skanowanie cen: jak kwanty znajdują nieefektywności w stopach finansowania i spreadach za pomocą API handlowych

Niedobór DRAM do 2030 roku: jak zainwestować w gigantów pamięci?




