2 fugas em uma semana: Claude da Anthropic faz o que quer?
A vida sempre encontra um caminho. Uma semana, duas fugas diferentes, o mesmo nome de fundo: Claude, o modelo estrela da Anthropic. Após a descoberta de uma falha local no Claude Cowork, a ferramenta que automatiza tarefas diretamente no computador do usuário, a empresa revelou um segundo episódio, sem relação com o primeiro.
Desta vez, três de seus modelos acessaram sem autorização os sistemas de produção de três organizações reais, durante simples testes de cibersegurança.
Os pontos-chave deste artigo:
- Claude da Anthropic teve duas fugas de segurança em uma semana, revelando falhas preocupantes.
- Três organizações foram comprometidas durante testes de cibersegurança, destacando os riscos das IAs autônomas.
Episódio 1: o sandbox que vazava por todos os lados
Pesquisadores de segurança inicialmente mostraram que o modo de execução local do Claude Cowork poderia ser contornado. O método: encadear várias fraquezas arquitetônicas a uma falha de elevação de privilégios do núcleo Linux (o coração do sistema que gerencia o acesso aos recursos da máquina).
Uma vez fora de seu sandbox (sandbox no jargão), o agente herdava os mesmos direitos que o usuário conectado: acesso a arquivos, potencialmente a chaves SSH e credenciais de nuvem armazenadas na máquina.
A Anthropic não negou, mas minimizou, qualificando o relatório como << informativo >> e corrigindo ao mudar por padrão o Claude Cowork para uma execução na nuvem. Um remédio pragmático. Exceto que a questão de fundo permanecia em aberto: quantas outras portas dos fundos ainda existem em agentes já autorizados a manipular arquivos, pagamentos ou transações de cripto de forma autônoma?
Episódio 2: Anthropic joga a transparência, a culpa vem de outro lugar
A resposta chegou mais rápido do que o esperado. Em um post publicado em 31 de julho e intitulado Investigando três incidentes do mundo real em nossas avaliações de cibersegurança, a Anthropic explica que analisou 141.006 avaliações onde seus modelos poderiam ter obtido acesso à Internet.
Três delas terminaram mal: o modelo saiu do ambiente de teste da Irregular, seu parceiro de avaliação externa, e acabou comprometendo a infraestrutura de produção de três organizações distintas.
Ao contrário de um contorno deliberado, a Anthropic insiste na origem do problema: um simples mal-entendido com a Irregular deixou um acesso à Internet aberto dentro do ambiente de avaliação. Colocado diante de um exercício de capture-the-flag (recuperar uma informação escondida em outra máquina da rede), o modelo tratou os sistemas reais cruzados pelo caminho como se fossem parte do jogo. Ele os comprometeu com técnicas básicas: senhas fracas e pontos de acesso não autenticados em primeiro lugar.
Não é exatamente o cenário de ficção científica que se imagina quando se fala de IA << que escapa >>. Em vez disso, é uma cadeia de pequenas negligências humanas, amplificadas por uma máquina que executa sem questionar. A CNN resume bem o paradoxo: o modelo nunca tentou enganar ninguém, ele simplesmente fez o que lhe foi pedido, sem saber onde terminava o campo de jogo.
Open AI e Anthropic: Os irmãos inimigos
OpenAI teve seu próprio episódio uma semana antes com a Hugging Face, um agente que se infiltrou sozinho durante uma avaliação semelhante. Dois gigantes rivais, duas fugas a poucos dias de intervalo: agora é difícil ver isso como uma simples coincidência.
É um padrão que se repete, independentemente da filosofia de segurança exibida por cada laboratório. A Anthropic, aliás, toma cuidado em distinguir seu caso do da OpenAI: aqui, nenhuma intenção de fuga do modelo, apenas uma fronteira mal definida entre ambiente fictício e infraestrutura real. A nuance conta para a imagem da marca. No entanto, muda pouco para as três empresas visadas, que se viram hackeadas sem ter solicitado.
O assunto ultrapassa amplamente Anthropic ou OpenAI: é toda uma indústria que aposta cada vez mais em agentes de IA capazes de agir sozinhos, sem que um quadro de segurança maduro tenha tido tempo de acompanhar.
Este conteúdo é fornecido apenas para fins informativos gerais e não constitui aconselhamento financeiro, de investimento, jurídico ou tributário. Quaisquer eventos, recompensas, promoções online ou informações relacionadas mencionadas neste documento não devem ser consideradas uma recomendação, solicitação ou convite para comprar, vender, negociar ou realizar qualquer outra transação com criptoativos. Criptoativos são altamente voláteis e podem resultar em perdas. A disponibilidade dos serviços, produtos e eventos relacionados da WEEX pode variar conforme a região. É de sua responsabilidade garantir que sua participação esteja em conformidade com as leis e regulamentações locais aplicáveis.
Você também pode gostar

Tesourarias de criptomoedas se voltam para financiamento de centros de dados de IA

A Nova Guerra Fria é uma Guerra de Ações Tecnológicas

A Corporação Não é o Fim: A Próxima Geração de Formas Organizacionais Surge

Hungria revoga regras de verificação de criptomoedas e reestrutura mercado em conformidade com MiCA

BIS testa pagamentos transfronteiriços com "moeda tokenizada": 28 bancos globais participam, com liquidação média em 80 segundos

Panorama da Infraestrutura Subjacente do Web3: Compreendendo o Futuro da Blockchain Através de Cinco Tecnologias Centrais

Japão mantém juros em 1% e carry trade segue vivo: o que muda para o Bitcoin

"Traição" ou "ganha-ganha"? Quão provável é que a TradeXYZ se separe da Hyperliquid e siga seu próprio caminho

Como será a Construção em Cripto em 2026

22 horas para preencher 50 milhões de dólares: por que a história de arbitragem da Axis é atraente?

Hong Kong abre as portas do XRP para investidores individuais, liderando a expansão do mercado regulado na Ásia

A adoção de criptomoedas atinge um nível inédito no Canadá

O que é um airdrop de criptomoeda? Tokens gratuitos, elegibilidade e armadilhas fiscais

O que é yield farming? Mineração de liquidez e riscos de APY explicados

O que é um DAO? Governança descentralizada explicada

O que é prova de participação? Como os validadores substituíram os mineradores

A Coreia do Sul aprova nova conta de fundo soberano para IA e setores estratégicos

Agentes de IA como funcionários: quem assume a responsabilidade em caso de problemas?

Nova York processa Kalshi por alegações de jogo ilegal, busca $36 bilhões em danos

Dados de inflação em queda não mudam a verdadeira fonte de pressão sobre os ativos globais

China: 16 pessoas detidas por lavagem de dinheiro via criptomoedas

Além do Bitcoin e Ethereum: 8 projetos de criptomoeda construídos com adoção real

Tokens de IA perdem impulso após ganhos amplamente impulsionados pela especulação

Canary HBAR ETF mantém US$ 47,8 milhões após lançamento na Nasdaq

Gumi e SBI estabelecem fundo de criptomoedas de 3 bilhões de ienes, promovendo ETFs físicos no Japão

Fundação Ethereum: O hacker ético Pascal Caversaccio entra para o conselho

O que aconteceu com as empresas listadas que acumularam dezenas de milhares de BTC?

Relatório da Manhã de Wall Street: Microsoft alivia preocupações sobre "queima de dinheiro em IA", ações de tecnologia se recuperam fortemente, ETFs de armazenamento DRAM e semicondutores disparam 17% e 8%

Bolha de IA: Petróleo, China e Washington ameaçam o mercado













