aiexpert
Início / Notícias / Nota
Breaking · 08 de ago. de 2026, 13:34 · 4 fontes

Anthropic padroniza modo auto do Claude Code 14 de agosto; classificador detecta 89% de comandos perigosos

Anthropic anunciou em 7 de agosto de 2026 que o modo auto se tornará a configuração de permissão padrão para Claude Code em planos Pro, Max e Team a partir de 14 de agosto. Modo auto substitui prompts de aprovação por ação com um classificador de IA em segundo plano que avalia cada chamada de ferramenta antes da execução, bloqueando ações irreversíveis, destrutivas ou fora de limites. Se bloqueado, Claude pode tentar uma rota mais segura ou pedir permissão. Após bloqueios repetidos, as sessões voltam a aprovação manual. Anthropic não cobrará mais pelo pequeno overhead de token do classificador.

Em testes com 1.053 usuários pagos, Anthropic descobriu que revisores humanos capturaram apenas 13.6% dos comandos perigosos, comparado com 89% para modo auto. Uma avaliação de terceiros do Trajectory Labs testou 72 cenários de injeção de prompt indireto e descobriu que modo auto bloqueou ataques que causariam exfiltração de dados sensíveis, fraude financeira ou phishing de credenciais. Entre sessões sinalizadas, aquelas por meio de aprovação manual continham danos não intencionais graves mais que o dobro das vezes quanto sessões de modo auto. A mudança aborda um gargalo prático: desenvolvedores não podem iniciar com segurança grandes tarefas sem interrupções de aprovação frequentes.

Para equipes que enviam agentes de código de produção, isso sinaliza a confiança da Anthropic em governça de permissão orientada por IA como padrão em vez de exceção. A empresa observa que classificadores não podem eliminar risco e recomenda revisão humana para mudanças de produção. Notavelmente, OpenAI optou por não usar modo auto para GPT-5.6 como precaução, então Anthropic está adotando uma postura divergente em autonomia de agentes. Dados de clientes Team e Enterprise mostram que usuários de modo auto enviam ~25% mais pull requests, sugerindo ganhos de velocidade operacional. Usuários Enterprise e API ainda podem aceitar; Anthropic planeja tornarlo padrão em todas as plataformas em um mês.

Fontes

Tudo que sustenta esta nota
  1. 01 Primary source claude.com
  2. 02 claude.com claude.com “Starting on August 14, new sessions on Pro, Max, and Team plans will run in auto mode”
  3. 03 claude.com claude.com “those that went through manual approval contained serious unintended harm more than twice as often as auto mode sessions”
  4. 04 9to5mac.com 9to5mac.com “Anthropic says its study of 1,053 paid testers found people caught 13.6% of dangerous commands, compared with 89% for auto mode”