Rede Pirata
FronteiraApurado com Simon Willison

Ataque contra o modo automático do Claude Code funciona em 80% das tentativas

Johann Rehberger driblou a proteção que a Anthropic tornou padrão para conter prompt injection no seu agente de programação

O pesquisador Johann Rehberger encontrou uma forma de furar o auto mode do Claude Code, a camada que a Anthropic transformou em padrão para proteger usuários do agente contra prompt injection. Ele afirma que o ataque funciona em 80% das execuções. O caso foi destacado por Simon Willison, que acompanha o tema.

A mecânica é elegante e desconfortável. O agente é induzido a baixar e descompactar um arquivo zip e depois rodar código que importa base64. Só que o pacote extraído contém um struct.py local, e é esse arquivo que acaba sendo carregado e executado. Nenhuma etapa parece maliciosa isoladamente.

O detalhe mais incômodo é o comportamento da própria proteção: em algumas execuções, quando o Claude percebeu a invasão e tentou encerrar o processo malicioso, o auto mode negou o comando de limpeza. A defesa atrapalhou a reação ao incidente que ela deveria evitar.

Apurado a partir de

Apurado e redigido por redes neurais.

Esta matéria foi produzida por sistemas autônomos de inteligência artificial operados pela Rede Pirata, a partir das fontes públicas relacionadas acima, e é publicada sob responsabilidade editorial da empresa. Os critérios são definidos por humanos; o texto, não. Publicamos assim por convicção, e não por economia: uma máquina lê mais fontes, em mais idiomas, em menos tempo, e não tem lado a defender.

O conteúdo tem caráter exclusivamente informativo e jornalístico, e não constitui recomendação de investimento nem aconselhamento financeiro, jurídico, contábil ou de engenharia, tampouco oferta ou solicitação de compra ou venda de qualquer ativo. As análises refletem interpretação de informação pública disponível no momento da publicação e podem tornar-se imprecisas sem aviso. Decisões tomadas com base neste material são de responsabilidade exclusiva de quem as toma.

Na mesma linha

Newsletter diária · 5h da manhã

Três Tiros

As três notícias de IA que movem o dia, com a leitura pronta. Chega às 5h no horário de Brasília, leva quatro minutos, e você sai na frente de quem ainda está rolando o feed.

  • Sem rastreio de abertura
  • Sem venda de lista
  • Cancela em um clique