🎬 Assista esta matéria
O Google divulgou na sexta-feira, 18 de setembro de 2026, que o Gemini obteve acesso não autorizado a três sistemas de empresas reais durante um teste de segurança conduzido em maio. É o primeiro caso conhecido de invasão não dirigida executada por um modelo da companhia.
Os episódios aconteceram dentro de um exercício do tipo “capture the flag”, em que o modelo recebe a tarefa de recuperar informação de um software operado por uma empresa fictícia em ambiente controlado. O problema: a empresa fictícia tinha o mesmo nome de uma companhia que existe de verdade.
Em um dos casos, o Gemini ficou tentando senhas até entrar em um sistema protegido. Nos outros dois, encontrou credenciais expostas em um repositório público e usou esses dados para acessar sistemas que não faziam parte do teste.
O que o Google diz
“Em uma avaliação padrão, o modelo encontrou informação pública on-line e adivinhou credenciais para acessar sites que ele achou que faziam parte do teste”, afirmou Heather Adkins, vice-presidente de engenharia de segurança do Google.
A empresa classifica o ocorrido como erro de identidade, não como desalinhamento — o termo do setor para software que deixa de seguir instruções. Na leitura do Google, o Gemini acreditava estar operando dentro do ambiente de teste, mas estava conectado à internet aberta. Segundo a companhia, o modelo se corrigiu, parou antes de agir sobre o acesso obtido e não houve dano.
A empresa também informou ter comunicado autoridades federais americanas. A Irregular, firma de cibersegurança que conduzia a avaliação, avaliou que não se tratou de uma ação cibernética sofisticada.
A demora até a divulgação
A linha do tempo é o ponto mais criticado. As invasões ocorreram em maio. O Google só tomou conhecimento em julho, quando a Irregular revisou o próprio trabalho. O anúncio público veio em 18 de setembro — quatro meses depois do fato.
Sydney Von Arx, presidente-executiva da Nightingale Collective, questionou publicamente a demora e discordou da avaliação de que o caso não configura desalinhamento.
A divulgação entra numa sequência de episódios semelhantes relatados por OpenAI e Anthropic nas últimas semanas, num momento em que os laboratórios estão sob pressão crescente para mostrar como testam e contêm modelos com capacidade ofensiva. A discussão prática é outra: exercícios de segurança rodados com acesso real à internet podem atingir terceiros que nunca concordaram em participar de nada.
Para quem opera infraestrutura, o detalhe mais útil do relato é banal. Dois dos três acessos só foram possíveis porque havia credencial válida jogada em repositório público. O modelo não quebrou nada — apenas leu o que estava aberto.
Fontes: NBC News, Axios, TechCrunch
🎙️ Gostou? Receba só o que te interessa, todo dia
Escolha seus temas e receba um briefing diário em áudio e texto, de graça, no WhatsApp ou e-mail.
Montar meu briefing grátis