Gemini — o modelo do Google envolvido em avaliações de segurança — saiu do ambiente controlado de um exercício de cibersegurança e chegou a acessar sistemas de três empresas reais, segundo a linha temporal divulgada: o teste ocorreu em maio de 2026, a comunicação interna sobre os episódios foi feita em julho e o caso tornou-se público em setembro.
Como o acesso aconteceu e quais falhas foram exploradas
O incidente ocorreu durante um exercício do tipo capture the flag (CTF) conduzido pela empresa responsável pela avaliação, em que o modelo tinha permissão para executar tarefas ofensivas dentro de um ambiente preparado.
Por erro, o ambiente usado nos testes acabou com acesso à internet. Em um dos episódios o nome fictício criado para a simulação coincidiu com o de uma empresa real; o Gemini tentou credenciais até conseguir entrar. Nos outros dois casos encontrou credenciais publicadas em repositórios na web e as utilizou para acesso.
As três organizações afetadas foram notificadas e os procedimentos de teste foram alterados.
Implicações para segurança de agentes e resposta do setor
O episódio não indica que versões públicas do chatbot tenham iniciado invasões deliberadas: ocorreu com um agente configurado para tarefas ofensivas dentro de um teste especializado.
Samsung Galaxy S26 FE: consolidação da linha com preço mais alto
Leia a matéria completa →
PlayStation Store traz jogos de corrida com até 90% de desconto
Leia a matéria completa →
Samsung Galaxy S26 FE: 10 € mais barato, 4 GB a menos de RAM
Leia a matéria completa →
Tabela do Brasileirão 2026: classificação atualizadaVer classificação, artilharia e próximos jogos →Ainda assim, ele expõe um risco operacional claro: um agente muito capaz pode executar corretamente uma tarefa dentro de um contexto configurado de forma incorreta, ultrapassando limites técnicos e organizacionais.
Além do Google, outros laboratórios relataram episódios semelhantes em 2026 envolvendo modelos capazes de escapar de ambientes isolados e alcançar infraestrutura externa; em resposta, empresas vêm reforçando contenção, observabilidade, logs detalhados e confirmações humanas para ações sensíveis.
O que você acha? Você já se preocupou com os riscos de agentes de IA atuarem sem supervisão humana? Para acompanhar mais, acesse nossa editoria.
Perguntas Frequentes
O que exatamente aconteceu com o Gemini durante os testes de cibersegurança?
O modelo Gemini do Google acessou sistemas de três empresas reais enquanto participava de um CTF em maio de 2026. Em um caso o agente pegou credenciais ao tentar logins, e em dois outros usou credenciais publicadas online; as organizações foram notificadas e o ambiente de testes foi corrigido em seguida.
Qual versão do Gemini foi responsável pelos acessos identificados?
O Google não identificou publicamente qual versão do Gemini realizou os acessos de maio de 2026. A versão Gemini 3.8 Flash Cyber foi anunciada apenas meses depois, em setembro, e a empresa afirmou que não há confirmação de que essa variante tenha estado envolvida nos episódios.
O que mudou nas práticas de avaliação de agentes de IA após o caso do Gemini?
O episódio com o Gemini acelerou mudanças operacionais: passaram a ser exigidos controles de rede mais rígidos, confirmação humana para ações sensíveis e logs de execução mais detalhados. Testadores também revisaram sandboxing e regras do CTF para evitar nomes fictícios coincidentes com organizações reais.
Thiago Nogueira