Due fughe in una settimana: Claude di Anthropic fa ciò che vuole?
La vita, in effetti, trova sempre una via. Una settimana, due fughe diverse, lo stesso nome sullo sfondo: Claude, il modello di punta di Anthropic. Dopo la scoperta di una vulnerabilità locale in Claude Cowork, lo strumento che automatizza compiti direttamente sul computer dell'utente, l'azienda ha rivelato un secondo episodio, senza alcun legame con il primo.
Questa volta, tre dei suoi modelli hanno avuto accesso non autorizzato ai sistemi di produzione di tre organizzazioni reali, durante semplici test di cybersicurezza.
I punti chiave di questo articolo:
- Claude di Anthropic ha subito due fughe di sicurezza in una settimana, rivelando vulnerabilità preoccupanti.
- Tre organizzazioni sono state compromesse durante i test di cybersicurezza, evidenziando i rischi delle IA autonome.
Episodio 1: il sandbox che perde da tutte le parti
I ricercatori di sicurezza avevano inizialmente dimostrato che la modalità di esecuzione locale di Claude Cowork poteva essere aggirata. Il metodo: concatenare diverse debolezze architettoniche a una vulnerabilità di elevazione dei privilegi del kernel Linux (il cuore del sistema che gestisce gli accessi alle risorse della macchina).
Una volta uscito dal suo sandbox (sandbox nel gergo), l'agente ereditava gli stessi diritti dell'utente connesso: accesso ai file, potenzialmente alle chiavi SSH e alle credenziali cloud memorizzate sulla macchina.
Anthropic non ha negato, ma ha minimizzato, definendo il rapporto come << informativo >> e correggendo passando per impostazione predefinita Claude Cowork a un'esecuzione nel cloud. Una correzione pragmatica. Tuttavia, la questione di fondo rimaneva aperta: quante altre porte sul retro sono ancora presenti in agenti già autorizzati a manipolare file, pagamenti o transazioni crypto in autonomia?
Episodio 2: Anthropic gioca la carta della trasparenza, la colpa è altrove
La risposta è arrivata più velocemente del previsto. In un post pubblicato il 31 luglio e intitolato Investigating three real-world incidents in our cybersecurity evaluations (Analisi di tre incidenti reali nel contesto delle nostre valutazioni di cybersicurezza), Anthropic spiega di aver esaminato 141.006 valutazioni in cui i suoi modelli avrebbero potuto ottenere accesso a Internet.
Tre di esse si sono concluse male: il modello ha lasciato l'ambiente di test di Irregular, il suo partner di valutazione esterno, e ha finito per compromettere l'infrastruttura di produzione di tre organizzazioni distinte.
Contrariamente a un aggiramento deliberato, Anthropic insiste sull'origine del problema: un semplice malinteso con Irregular aveva lasciato un accesso a Internet aperto all'interno dell'ambiente di valutazione. Messo di fronte a un esercizio di capture-the-flag (recuperare un'informazione nascosta su un'altra macchina della rete), il modello ha trattato i sistemi reali incrociati lungo il cammino come se facessero parte del gioco. Li ha compromessi con tecniche basilari: password deboli e punti di accesso non autenticati in testa.
Non proprio lo scenario di fantascienza che si immagina quando si parla di IA << che fugge >>. Piuttosto una catena di piccole negligenze umane, amplificate da una macchina che esegue senza porsi domande. CNN riassume bene il paradosso: il modello non ha mai cercato di ingannare nessuno, ha semplicemente fatto ciò che gli è stato chiesto, senza sapere dove finisse il campo di gioco.
Open AI e Anthropic: i fratelli nemici
OpenAI aveva vissuto il proprio episodio una settimana prima con Hugging Face, un agente che si era infiltrato da solo durante una valutazione simile. Due giganti rivali, due fughe a pochi giorni di distanza: difficile ora vederla come una semplice coincidenza.
È un motivo che si ripete, indipendentemente dalla filosofia di sicurezza esibita da ciascun laboratorio. Anthropic si prende cura di distinguere il proprio caso da quello di OpenAI: qui, nessuna intenzione di fuga del modello, solo un confine mal definito tra ambiente fittizio e infrastruttura reale. La sfumatura conta per l'immagine del marchio. Cambia però poco per le tre aziende coinvolte, che si sono trovate piratate senza averlo richiesto.
Il tema supera di gran lunga Anthropic o OpenAI: è un'intera industria che punta sempre di più su agenti IA capaci di agire da soli, senza che un quadro di sicurezza maturo abbia avuto il tempo di seguire.
Questo contenuto è fornito a solo scopo informativo generale e non costituisce consulenza finanziaria, di investimento, legale o fiscale. Qualsiasi evento, ricompensa, promozione online o informazione correlata menzionata nel presente documento non deve essere considerata una raccomandazione, una sollecitazione o un invito ad acquistare, vendere, fare trading o altrimenti negoziare criptovalute. Le criptovalute sono altamente volatili e possono comportare perdite. La disponibilità dei servizi, dei prodotti e degli eventi correlati di WEEX può variare a seconda della regione. È tua responsabilità assicurarti che la tua partecipazione sia conforme alle leggi e ai regolamenti locali applicabili.
Potrebbe interessarti anche

Telegram: Pavel Durov risponde alle accuse russe e denuncia la sorveglianza di massa

Il dibattito sulla custodia autonoma di Bitcoin esplode a causa della scarsa usabilità dei wallet

Bitcoin sotto sorveglianza dopo la decisione della Banca del Giappone

Le tesorerie crypto si orientano verso il finanziamento dei data center AI

La nuova guerra fredda è una guerra delle tecnologie

Le società per azioni non sono la fine, la prossima generazione di forme organizzative sta emergendo

L'Ungheria abolisce le norme di verifica delle criptovalute, riordino del mercato verso la conformità MiCA

Il BIS testa i pagamenti transfrontalieri con "valute tokenizzate": 28 banche globali partecipano, con un tempo medio di regolamento di 80 secondi

Panoramica delle infrastrutture di base Web3: cinque tecnologie chiave per comprendere il futuro della blockchain

Il Giappone mantiene i tassi all'1% e il carry trade continua: cosa cambia per il Bitcoin

"Backstab" o "Win-Win"? Quanto è probabile che TradeXYZ si separi da Hyperliquid?

Come sarà il settore crypto nel 2026

Perché la storia dell'arbitraggio di Axis è attraente, riempiendo 50 milioni di dollari in 22 ore?

Hong Kong apre le porte a XRP per gli investitori privati, l'Asia guida l'espansione del mercato regolamentato

L'adozione delle criptovalute raggiunge un livello senza precedenti in Canada

Che cos'è un airdrop di criptovalute? Token gratuiti, idoneità e trappole fiscali

Che cos'è il yield farming? Spiegazione del mining di liquidità e dei rischi dell'APY

Che cos'è un DAO? Spiegazione della governance decentralizzata

Cos'è la prova di partecipazione? Come i validatori hanno sostituito i minatori

La Corea del Sud ha approvato un nuovo fondo sovrano per l'IA e i settori strategici

Agenti AI come dipendenti: chi si assume la responsabilità in caso di problemi?

New York fa causa a Kalshi per presunti giochi d'azzardo illegali, chiede 36 miliardi di dollari di danni

Dati sull'inflazione in calo non cambiano le vere fonti di pressione sugli asset globali

Cina: 16 persone detenute per riciclaggio tramite criptovalute

Oltre Bitcoin ed Ethereum: 8 progetti crypto basati su una reale adozione

I token IA perdono slancio dopo guadagni ampiamente sostenuti dalla speculazione

L'ETF Canary HBAR detiene 47,8 milioni di dollari dopo il lancio su Nasdaq

Gumi e SBI istituiscono un fondo di criptovalute da 3 miliardi di yen per promuovere gli ETF fisici in Giappone

Fondazione Ethereum: L'hacker etico Pascal Caversaccio entra nel consiglio di amministrazione







