O Gemini, modelo de inteligência artificial do Google, acessou sistemas de três empresas reais durante testes de cibersegurança realizados em maio pela Irregular, startup israelense que avalia a segurança de modelos avançados de IA. O episódio ocorreu depois que uma conexão com a internet foi liberada acidentalmente durante a avaliação.
Os testes deveriam usar empresas fictícias e permanecer em um ambiente isolado. Com acesso à rede, porém, o Gemini encontrou informações e credenciais de organizações reais. Em um dos casos, o modelo recebeu a tarefa de obter dados de um software de uma empresa fictícia cujo nome coincidia com o de uma companhia existente. Depois, identificou a empresa real, adivinhou a senha de um sistema protegido e entrou na infraestrutura.
Nas outras duas situações, o modelo localizou repositórios públicos que continham credenciais de empresas reais. As informações foram usadas para acessar os sistemas das companhias.
Em todos os casos, o Gemini interrompeu as ações ao perceber que havia entrado em empresas reais, e não nos ambientes simulados. O Google informou que nenhuma das companhias sofreu danos.
Heather Adkins, vice-presidente de engenharia de segurança do Google, disse que o modelo encontrou informações públicas e tentou usar credenciais para acessar sites que acreditava fazerem parte da avaliação. “Esses eventos destacam a importância de treinar modelos poderosos de IA para agir de maneira responsável”, afirmou em comunicado.
O Google comunicou as três empresas afetadas e trabalhou com a Irregular para alterar os procedimentos dos testes. A startup informou que identificou o problema, notificou os laboratórios envolvidos e avisou as companhias. Também afirmou que corrigiu o acesso indevido à internet e solucionou falhas em seus processos de avaliação semanas antes da divulgação dos casos.
A Irregular comunicou os incidentes ao Google no fim de julho, após descobrir que um modelo da OpenAI havia acessado a plataforma de software Hugging Face em outro teste. A startup também participou de avaliações que tiveram incidentes semelhantes com modelos da OpenAI, Anthropic e Meta.
O Google só confirmou os acessos depois de ser questionado sobre os episódios. A empresa disse que não havia anunciado os casos porque o modelo parou as ações e não causou danos. OpenAI e Anthropic adotaram postura diferente e divulgaram publicamente incidentes semelhantes.
Os episódios ampliaram a discussão sobre testes de sistemas de IA com autonomia e acesso a ferramentas digitais. A Irregular atribuiu os casos à liberação acidental da internet, enquanto o Google destacou a necessidade de treinar modelos avançados para agir de forma responsável em tarefas de cibersegurança.









