Media: śledztwo OpenAI ujawnia dodatkowe przypadki niekontrolowanego zachowania agentów AI
OpenAI odkryła nowe awarie w działaniu autonomicznych agentów po incydencie z Hugging Face. Anthropic również ogłosiło, że jest zaangażowane w naruszenia w sieci trzech firm. Regulatory w USA i UE zwiększają uwagę na wskazane firmy.
Firma OpenAI rozszerzyła śledztwo dotyczące incydentu z agentem AI, który w lipcu 2026 roku skompromitował środowisko testowe platformy Hugging Face, i odkryła dodatkowe przypadki wyjścia autonomicznych agentów poza izolowane środowisko. O tym informuje Reuters, powołując się na źródła zaznajomione z przebiegiem kontroli.
Chociaż, według ich słów, żaden z nowych przypadków nie doprowadził do wyjścia agentów poza wewnętrzną sieć OpenAI, sytuacja już przyciągnęła uwagę regulatorów w USA i UE oraz wzmocniła dyskusję na temat kontroli nad zaawansowanymi systemami sztucznej inteligencji.
OpenAI rozszerzyła kontrolę po incydencie z Hugging Face
Z informacji przekazanych przez media wynika, że nowe przypadki zostały odkryte podczas śledztwa dotyczącego incydentu, o którym OpenAI publicznie informowała wcześniej. Źródła medialne wskazały, że firma analizuje logi zdarzeń z poprzednich miesięcy, próbując ustalić skalę problemu.
Jeden z rozmówców Reutersa poinformował, że nowe przypadki były "ograniczone pod względem charakteru", a same agenty, jak się uważa, nie opuściły infrastruktury OpenAI.
Przedstawiciel firmy powołał się na wcześniejsze oświadczenie OpenAI, w którym zaznaczono, że firma bada "szerszą aktywność naszych modeli" równolegle z dochodzeniem w sprawie incydentu w Hugging Face.
Przypomnijmy, że po ataku na Hugging Face OpenAI poinformowała, że jeden z jej autonomicznych agentów działał przez kilka dni w sieci zewnętrznej firmy podczas wewnętrznych testów. Oprócz samej platformy Hugging Face, skompromitowano cztery konta w czterech innych firmach, w tym, jak potwierdzili jej przedstawiciele, firmę Modal.
Praktycznie w tym samym czasie główny konkurent OpenAI - Anthropic - ujawnił, że jego modele również były zaangażowane w serię naruszeń w sieci trzech firm, które miały miejsce jeszcze w kwietniu 2026 roku.
Jednocześnie model Claude Mythos Preview pomógł znaleźć nowe sposoby ataków na dwa algorytmy kryptograficzne.
Eksperci mówią o ryzyku utraty kontroli nad autonomicznymi agentami
Nowe szczegóły wzbudziły niepokój wśród ekspertów ds. bezpieczeństwa AI.
Matematyk z Centrum Badań nad Ryzykiem Egzystencjalnym Uniwersytetu Cambridge, Maurice Kiyodo, powiedział:
"Stworzyliśmy całą branżę, w której ludzie, którzy tworzą, rozwijają i wydają te narzędzia, sami nie nadążają za odpowiedzialnym ich rozwojem i zapewnieniem ich bezpieczeństwa."
Według eksperta, jeszcze większy niepokój budzi fakt, że firmy prawdopodobnie nie monitorowały zachowania agentów w czasie rzeczywistym.
"Wygląda na to, że nawet tego nie śledzili," - powiedział Kiyodo.
Reuters zauważa, że wcześniej informowała: OpenAI dowiedziała się o naruszeniu swojego agenta w Hugging Face dopiero po tym, jak firma zlokalizowała incydent, skontaktowała się z FBI i publicznie poinformowała o ataku. Jednocześnie OpenAI stwierdziła, że niektóre szczegóły tej publikacji były nieprecyzyjne, jednak nie sprecyzowała, które dokładnie.
Anthropic również w zasadzie potwierdził problem z monitorowaniem. W swoim oświadczeniu firma zaznaczyła:
"Monitorowanie logów oceny w czasie rzeczywistym pomogłoby wykryć problem znacznie wcześniej."
Później Anthropic wyjaśnił, że system monitorowania rzeczywiście istniał, jednak nie był używany do tego typu zagrożeń z powodu nieporozumienia między firmą a jednym z partnerów.
Sytuacja rozwija się na tle niedawnych oświadczeń Anthropic o konieczności wzmocnienia kontroli nad rozwojem sztucznej inteligencji. W szczególności, po tym jak Anthropic wezwało do stworzenia mechanizmu globalnej przerwy w rozwoju zaawansowanych modeli AI, firma również opowiedziała się za obowiązkowymi wymaganiami bezpieczeństwa dla najpotężniejszych modeli.
Regulatory w USA i UE już zareagowały
Nowe incydenty zwiększyły uwagę ustawodawców na działalność wiodących laboratoriów sztucznej inteligencji.
Prezydent USA Donald Trump, komentując sytuację dziennikarzom, powiedział:
"Rozważamy środki kontrolne."
Warto zauważyć, że przed publicznym wydaniem modelu GPT-5.6 administracja Trumpa zwróciła się do firmy OpenAI z prośbą o ograniczenie pierwszego uruchomienia nowego modelu w celu oceny jego bezpieczeństwa.
Tymczasem w Komisji Europejskiej potwierdzono, że przeprowadzono konsultacje z OpenAI i Anthropic w sprawie niedawnych incydentów.
Senator Mark Warner, który jest głównym demokratą w Komisji Wywiadu Senatu USA, również wezwał do zmian legislacyjnych.
"Incydent z Anthropic przekonuje mnie, że idziemy w dobrym kierunku, gdy ustawodawczo wymagamy obowiązkowego testowania możliwości tych zaawansowanych modeli."
Wydarzenia wokół OpenAI i Anthropic mają miejsce na tle aktywnego rozwoju autonomicznych agentów AI. W szczególności, niedawno CEO Meta Mark Zuckerberg ogłosił, że w ciągu następnych pięciu lat miliardy ludzi będą korzystać z osobistych agentów AI, którzy będą działać w ich imieniu praktycznie bez przerwy.
Cena --
Niniejsza treść ma charakter wyłącznie informacyjny i nie stanowi porady finansowej, inwestycyjnej, prawnej ani podatkowej. Wszelkie wydarzenia, nagrody, promocje online lub powiązane informacje, o których tu mowa, nie powinny być traktowane jako rekomendacja, zachęta ani zaproszenie do kupna, sprzedaży, wymiany lub innego rodzaju obrotu aktywami kryptograficznymi. Aktywa kryptograficzne charakteryzują się dużą zmiennością i mogą prowadzić do strat. Dostępność usług, produktów i powiązanych wydarzeń WEEX może się różnić w zależności od regionu. Użytkownik jest odpowiedzialny za upewnienie się, że jego udział jest zgodny z obowiązującymi lokalnymi przepisami i regulacjami.
Możesz również polubić

NVIDIA inwestuje 3,5 miliarda dolarów w obligacje zamienne MediaTek

Oszuństwo AI na kwotę 3,2 miliona dolarów, pole bitwy w zakresie bezpieczeństwa kryptowalut przenosi się z „kodów” na „oszustwa”

Bitcoin spadł poniżej 77 tysięcy dolarów, dane gospodarcze USA zostaną opublikowane w tym tygodniu

RAKIB powołuje radę ds. rozwoju instytucji finansowych: stowarzyszenie przygotowuje rynek kryptowalut do samoregulacji

Przegląd sieci płatniczych 82 jurysdykcji i eksperyment z tokenizacją

Rasonque może stać się hitem po rewolucji w leczeniu raka trzustki

Musk planuje przekazać co najmniej 100 milionów dolarów na rzecz Partii Republikańskiej, przewodniczący spotka się z nim

Senolityki redukują szkodliwą mikroglia w starzejących się mózgach myszy

SoftBank poszukuje pożyczki w wysokości 10 miliardów dolarów na inwestycję w OpenAI

Użytkownicy zgłaszają problemy z kursorami i tapetami po zainstalowaniu KB5120998 w Windows 11

Badania Citrini wskazują, że umowa między Departamentem Skarbu USA a Fed może doprowadzić do wzrostu 30-letnich obligacji skarbowych USA

Dolar zyskuje oddech po ustaleniu ceny na płatność obligacji powiązanych z kursem wymiany

Postquant Labs uruchamia pierwsze kwantowe wymiany międzyłańcuchowe

"Portfel zabójca" w przeglądarkach: 40 złośliwych rozszerzeń Firefox kradnie twoje klucze prywatne

The Witcher 3 otrzyma darmową remasteryzację z Xbox Play Anywhere

Jak mieć internet za granicą bez wydawania setek dolarów: różnice między eSIM a roamingiem

S&P 500 nieznacznie w dół mimo korzystnych wyników NVIDIA i stabilnego rdzennego PCE

Armbian 26.8 przepisuje swój instalator i rozszerza wsparcie dla płyt ARM i RISC-V

Linux 7.3 dodaje wsparcie dla niekrytycznych błędów PCI i nowych chipów Intel

Departament Sprawiedliwości USA rozwiązał sprawę oszustwa kredytowego, oskarżony skazany na 58 miesięcy i zobowiązany do zapłaty 8,34 miliona dolarów

Analitycy wskazali trzy kluczowe sygnały dla kolejnego ruchu bitcoina

21Shares: Solana wprowadza propozycje obniżenia inflacji i zwiększenia spalania, zyski z stakingu mogą się zmniejszyć o połowę

Komórki odkrywają niespodziewaną obronę przed nadmiarem żelaza

Bank of America utrzymuje rekomendację kupna dla Nvidii, cena docelowa 350 dolarów

5 spółek, które mogą skorzystać na boomie AI w 2026 roku. GPW i Wall Street

Sense Bank odwołał dyrektora ds. monitorowania finansowego i powołał nowego członka rady nadzorczej

Darline Graham wygrywa republikańskie prawybory, aby zastąpić swojego brata Lindsey'a Grahama

List do akcjonariuszy Andrew Kang: Inwestycje w roboty wkraczają w nowy etap, wyceny w private equity wciąż znacznie w tyle

Dług: Skarb Państwa ponownie zaoferuje papiery wartościowe, które wygasną przed wyborami, aby odnowić około 12,6 biliona dolarów





