Três pesquisadores indianos da startup de cibersegurança Hacktron AI usaram modelos Claude, da Anthropic, para explorar falhas e acessar contas de funcionários da OpenAI e um repositório privado de código da empresa no GitHub. A OpenAI pagou US$ 6.500 pela descoberta, valor apresentado como cerca de R$ 33 mil.
A equipe era formada por Harsh Jaiswal, Mohan Pedhapati e Rahul Maini. O trabalho custou menos de US$ 3 mil em tokens de inteligência artificial. Os pesquisadores afirmam que não examinaram o código sensível e abriram apenas o pull request 1186742, considerado inofensivo, para comprovar que o acesso ao repositório era possível.
A entrada ocorreu por meio de uma falha do tipo heap buffer overflow na libheif, biblioteca de código aberto usada pelo Discourse para processar imagens nos formatos HEIC e HEIF. Os servidores do fórum utilizavam uma versão desatualizada e vulnerável da biblioteca.
A análise do pipeline de imagens começou em 23 de julho. Um dia depois, a equipe tinha um exploit funcional, mas ele dependia da desativação da proteção ASLR, que randomiza endereços de memória. Isso dificultava a reprodução do ataque em um cenário real.
O Claude Opus 4.8 tentou superar essa barreira em várias sessões, sem sucesso. Na noite de 24 de julho, após o lançamento do Opus 5, o novo modelo conseguiu ajudar os pesquisadores a contornar a proteção e avançar na exploração.
Com acesso à conta de ChatGPT e Codex de um funcionário da OpenAI, o grupo chegou ao repositório interno chamado Monorepo. A equipe de pesquisadores disse que o processo levou poucos dias de trabalho do agente de inteligência artificial e algumas horas de atuação humana.
Pesquisa mais ampla
A invasão fez parte do projeto HEIF Heist, criado pela Hacktron AI para investigar vulnerabilidades na maneira como diferentes softwares e serviços processam arquivos de imagem. Segundo os pesquisadores, a mesma técnica identificou falhas em Slack, Zoom e Meta.
O projeto durou dois meses, envolveu três pesquisadores e teve custo total inferior a US$ 3 mil em tokens de inteligência artificial. No relatório, a equipe afirmou que a IA está reduzindo o tempo necessário para trabalhos que antes exigiam uma equipe bem financiada e meses de esforço.
O caso integra uma sequência de incidentes de segurança envolvendo OpenAI e Anthropic, divulgados publicamente pelas próprias empresas. As duas companhias defendem a criação de salvaguardas para que os riscos de novos modelos possam ser revisados por humanos antes da chegada dessas tecnologias ao público.








