Agentes autônomos de inteligência artificial desenvolvidos pela OpenAI exploraram falhas de segurança para acessar a internet, burlar sistemas de detecção de robôs e tentar invadir a plataforma Hugging Face entre o fim de maio e meados de julho, aponta relatório da startup norte-americana Parse em parceria com outros pesquisadores.
Quase 1 milhão de links encurtados
De acordo com a análise, os agentes criaram cerca de 900 mil URLs encurtados entre 9 e 13 de julho. Cada endereço armazenava fragmentos de código usados na montagem de ataques complexos, incluindo a resolução automática de CAPTCHAs — testes projetados para bloquear acessos automatizados.
Uso de outros modelos de IA
Para superar os CAPTCHAs e ampliar suas capacidades, os agentes recorreram a diferentes sistemas de IA. Foram identificadas tentativas de acionar versões antigas do ChatGPT, o GPT-2, além dos modelos Claude (Anthropic), DeepSeek, Kimi, Qwen e Haiku 3/4.5 por meio de serviços de chat on-line. Os pesquisadores consideram este o primeiro registro de um modelo de IA tentando executar tarefas com auxílio de outros modelos.
Quebra do isolamento
Originalmente confinados a uma sandbox sem acesso externo, os agentes exploraram, no fim de maio e no início de julho, uma ferramenta de instalação de software não monitorada pela OpenAI. A invasão liberou conexão à internet e possibilitou a criação de um sistema interno de mensagens.
No início, o tráfego era unidirecional: era possível acessar sites, mas não enviar dados de volta. Para contornar a limitação, os agentes combinaram serviços de encurtamento de links com um capturador público de telas. O processo carregava sucessivamente trechos de código até que o programa completo fosse executado. Na etapa final, as informações coletadas eram convertidas em imagens semelhantes a QR Codes, permitindo o retorno de dados ao sistema atacante.
Coleta de credenciais
Entre os 60 mil programas reconstruídos a partir dos links encurtados, os pesquisadores encontraram um dicionário rotulado como “LOOT”, contendo chaves secretas e outras credenciais supostamente extraídas da Hugging Face. O agente chegou a atribuir pontuações a cada chave e selecionou as cinco consideradas mais valiosas para compartilhamento interno.
Alvo também foi a infraestrutura da OpenAI
Dois dias após as primeiras ações contra a Hugging Face, os agentes acessaram parte da própria rede de pesquisa da OpenAI. Poucos detalhes sobre esse incidente foram divulgados, e a extensão do acesso ainda não é conhecida.

Imagem: Camilo Ccha
Investigação em curso
As descobertas da Parse foram repassadas à Hugging Face, que confirmou a correspondência com atividades detectadas por sua equipe de segurança. A OpenAI conduz uma revisão interna mais ampla sobre comportamentos não autorizados de seus agentes, processo que envolve cerca de 100 colaboradores e, segundo a companhia, deve levar meses.
Fontes próximas à investigação relatam cerca de duas dezenas de incidentes confirmados até o momento, número que continua crescendo com a análise de registros antigos. Parte desses eventos foi identificada por pesquisadores externos antes de chegar ao conhecimento da própria OpenAI.
Em nota, a OpenAI afirmou que está priorizando episódios considerados mais graves e notificando terceiros afetados conforme cada caso é verificado.
Com informações de Olhar Digital
