article

Claude Mythos lidera índice de ciberarma da Booz Allen

3 min de leitura

🎬 Assista esta matéria

A consultoria Booz Allen Hamilton publicou em 3 de setembro de 2026 a primeira edição do Cyber Weapon Index, um ranking que mede não o quanto um modelo de IA sabe sobre segurança, mas o quanto ele consegue de fato invadir. Foram 18 modelos testados contra uma rede corporativa real: nove americanos e nove chineses.

O Claude Mythos, da Anthropic, ficou em primeiro com 80 pontos. Foi o único a percorrer sozinho a cadeia completa de ataque — encontrar a falha, entrar na rede e chegar a controle de administrador, sem ajuda humana no meio do caminho. O segundo colocado, o Grok-4.5 da xAI, marcou 49. O GPT-5.6 Sol, da OpenAI, ficou com 46.

Mythos é a linha de acesso restrito da Anthropic, liberada apenas para organizações verificadas de cibersegurança e de ciências da vida. Por baixo, é o mesmo modelo do Fable 5.1, mas sem parte das travas de produção — exatamente o tipo de configuração que o índice se propôs a medir.

O achado que incomoda mais que o ranking

A conclusão que a Booz Allen destaca não é quem venceu, e sim o que aconteceu quando o teste mudou de peça. O Claude Sonnet 5 ficou em 15º lugar, com 13 pontos. Acoplado a um “attack harness” — software de andaime que conecta o modelo a ferramentas de invasão e organiza o fluxo de exploração —, o mesmo Sonnet 5 fechou 67 dos 80 pontos de distância até o topo.

Ou seja: um modelo barato e amplamente disponível, embrulhado no scaffolding certo, chega perto da capacidade de ponta. “O modelo não é mais a unidade de risco. O sistema é”, registra o relatório. A consultoria acrescenta que combinações plenamente capazes provavelmente já existem fora do escopo testado.

Houve um contraponto relevante. Contra vulnerabilidades genuinamente inéditas em código de produção, os nove modelos de fronteira zeraram. Só o Mythos identificou e explorou falhas desse tipo — o que, na leitura da consultoria, é também uma vantagem defensiva concreta para quem tem acesso a ele.

Prazo de seis meses

A Booz Allen projeta que a maioria dos modelos avaliados alcance o nível do Mythos em cerca de seis meses e classifica como iminentes os ataques automatizados conduzidos por crime organizado e por atores estatais.

A recomendação vai na direção regulatória: prazos setoriais obrigatórios para que a infraestrutura crítica dos Estados Unidos comprove resiliência a ataques conduzidos por IA, além de investimento em sistemas ofensivos e defensivos próprios.

O relatório saiu na mesma semana em que a OpenAI classificou seu GPT-6 Astra como risco “Crítico” em cibersegurança e travou a geração de exploits na versão pública do modelo.

Fontes: The Register, The Next Web, SC Media

🎙️ Gostou? Receba só o que te interessa, todo dia

Escolha seus temas e receba um briefing diário em áudio e texto, de graça, no WhatsApp ou e-mail.

Montar meu briefing grátis