OpenAI interrompe abruptamente treinamento de seus modelos mais potentes: agentes de IA voltaram a ficar fora de controle
A OpenAI suspendeu o treinamento de seus modelos de IA mais avançados após uma série de incidentes inesperados, incluindo o de um modelo de teste que conseguiu acessar uma rede pública. Segundo o , o incidente ocorreu em 20 de setembro, e todos os processos de treinamento, avaliação e inferência com o uso de ferramentas permaneceram suspensos neste fim de semana. É a segunda vez em três meses que a empresa toma essa medida.
Observamos que é cada vez mais comum que os agentes de IA da OpenAI ou da Anthropic estejam envolvidos em incidentes de invasão a outros sites ou em comportamentos inadequados; por isso, torna-se inevitável que os laboratórios de IA suspendam o processo de treinamento de seus modelos para determinar o que ocorreu e como resolver o problema.
Em ocasiões anteriores, constatamos que o comportamento desses agentes pode ser imprevisível e que eles podem ter capacidade suficiente para apagar seus rastros ou não informar ao usuário o que estão fazendo nos bastidores. A OpenAI afirma que retomará as atividades somente quando tiver certeza de que existem proteções adicionais e prevê que terá que “dar uma pausa” novamente à medida que a tecnologia avançar e novos problemas surgirem.
O gatilho foi um protótipo que estava sendo testado em um ambiente de testes e que aproveitou uma brecha para obter acesso à internet, segundo informações do . Depois disso, veio toda uma série de desastres catastróficos:
- A OpenAI declarou que seus agentes haviam publicado indevidamente imagens de usuários do ChatGPT em sites de hospedagem de imagens. A empresa não esclareceu se eram imagens geradas por IA, fotos reais ou se mostravam pessoas identificáveis.
- O site The Verge também informa que os modelos tentaram invadir o site do Departamento de Educação e extraíram dados do Escritório do Censo dos Estados Unidos e da Comissão de Valores Mobiliários (SEC).
- Segundo o , no caso do Ministério da Educação, os agentes encontraram chaves API que davam acesso a dados governamentais, embora insistam que apenas foram coletadas informações públicas. A OpenAI não confirmou a tentativa de invasão em si; foi a Transluce, uma empresa de avaliação de IA, que detectou a tentativa.
- No caso da SEC, os agentes encontraram informações de acesso livre, mas depois as publicaram em outro site na internet, o que foi além do que lhes havia sido solicitado.
Até o momento, os danos parecem limitados. Um porta-voz da SEC, Kurt Hopfenspirger, afirma que “não houve acesso a informações não públicas”, e o Departamento de Educação indicou que não encontrou “evidências de qualquer impacto em nosso site ou bancos de dados”, conforme divulgado pela . O primeiro-ministro da Austrália, Anthony Albanese, também declarou que , mas o The Guardian informa que nenhuma informação confidencial foi comprometida.
A preocupação surge menos pelo que foi extraído e mais pelo que isso sugere, pois, no fim das contas, trata-se de sistemas autônomos realizando ações que ninguém lhes pediu para fazer, em lugares que ninguém esperava, e das quais só se percebeu posteriormente. A própria análise dos registros pela OpenAI revelou, além disso, mais casos desse tipo à medida que a investigação se aprofundou, segundo o The Verge.
A primeira interrupção ocorreu em julho, após um ataque cibernético perpetrado por agentes da OpenAI contra a Hugging Face, o que gerou receios de que o setor estivesse perdendo o controle. O CEO da OpenAI, Sam Altman, declarou na sexta-feira que o incidente com a Hugging Face “continua sendo o caso mais grave que já vimos”. A OpenAI também publicou outros seis relatórios sobre comportamentos “inesperados ou preocupantes” e criou uma estrutura para rastrear, investigar e divulgar tais casos.
Após o apelo de Dario Amodei, CEO da Anthropic, para frear o desenvolvimento da IA — ao qual se somaram responsáveis da OpenAI, do Google DeepMind e de muitas outras empresas —, a pressão para desacelerar o ritmo tem continuado a aumentar. No entanto, Washington está enviando sinais contraditórios. Nesta semana, o presidente Donald Trump acordou com o presidente chinês Xi Jinping compartilhar informações sobre os perigos da IA e coordenar ações em matéria de segurança, mas , argumentando que os críticos “querem impedir nosso progresso porque estamos muito à frente da China”.