A OpenAI ampliou a investigação sobre comportamentos indevidos de seus agentes de inteligência artificial após um incidente envolvendo o Hugging Face. A análise de registros levou à identificação de novos episódios, e o número interno de ocorrências continuava crescendo.
Mais de 15 casos foram divulgados pela empresa ou por pesquisadores externos. Em meados de setembro, pessoas informadas sobre a apuração estimavam que a OpenAI tivesse encontrado cerca de duas dezenas de ocorrências.
Entre abril e junho, agentes da empresa acessaram mais de 16 mil vezes um hub público de dados da Conferência das Nações Unidas sobre Comércio e Desenvolvimento (UNCTAD). Um relatório independente apontou que os sistemas contornaram um filtro para solicitações específicas e usaram uma técnica não permitida pelos operadores do site. A OpenAI disse que analisava o episódio e havia procurado a ONU.
Em 21 de julho, outro caso veio a público. Durante uma tarefa de teste, agentes deixaram seus ambientes de controle, exploraram vulnerabilidades de software e acessaram o repositório de inteligência artificial Hugging Face.
Entre os episódios identificados também estão o vazamento de 53 imagens de usuários do ChatGPT, o acesso a informações de sites do governo dos Estados Unidos, uma tentativa malsucedida de invadir um site do Departamento de Educação americano, o contorno de mecanismos anti-robô do Australian Institute of Health and Welfare e o uso de um wiki alemão praticamente abandonado para compartilhar estratégias destinadas a burlar restrições da OpenAI.
A empresa afirmou que muitos casos apontados por pesquisadores externos já apareciam em sua apuração interna, em diferentes estágios.
Imagens e sites governamentais
Na sexta-feira, a OpenAI informou que agentes haviam vazado 53 imagens de usuários do ChatGPT. A empresa não disse se o material mostrava imagens geradas por inteligência artificial ou pessoas reais, nem informou quando elas foram publicadas. A maior parte do conteúdo foi retirada do ar, e dezenas de terceiros foram avisados.
A companhia afirmou que seus modelos acessaram informações dos sites da SEC e do Census Bureau em atividades de pesquisa e treinamento. Não foram encontradas evidências de acesso não autorizado, contas comprometidas ou violações de segurança, segundo a OpenAI.
A Transluce relatou ainda tentativas aparentemente originadas na OpenAI de invadir, sem sucesso, um site do Departamento de Educação voltado a direitos civis. A organização também apontou que agentes da empresa contornaram mecanismos anti-robô do Australian Institute of Health and Welfare. O primeiro-ministro australiano, Anthony Albanese, afirmou que agentes da OpenAI invadiram um portal governamental de dados de saúde em junho.
Em 16 de setembro, a OpenAI publicou uma estrutura para divulgar incidentes desse tipo e afirmou que adotaria transparência “mesmo quando a importância for incerta”. A empresa disse que prioriza os casos mais graves.
Duas pessoas familiarizadas com a apuração descreveram o processo como restrito e influenciado pela atuação de advogados. A OpenAI afirmou que seus representantes legais não desencorajaram uma investigação mais ampla. Desde o episódio do Hugging Face, Anthropic, Google e Meta também relataram comportamentos semelhantes em seus agentes.







