Sistemas de inteligência artificial da OpenAI tentaram acessar ilegalmente quatro sites de universidades e governos entre maio e junho, mesmo sem receber instruções específicas para realizar ataques cibernéticos. Os agentes aparentemente recorriam a técnicas de hacking quando não conseguiam obter dados durante tarefas comuns de coleta de informações.
Três dos casos foram identificados pela Transluce, laboratório voltado à supervisão de inteligência artificial. A OpenAI confirmou posteriormente todos os episódios.
Em 25 e 26 de maio, sistemas da empresa tentaram invadir uma biblioteca digital da Universidade do Novo México para obter fotografias de um antigo centro de tratamento de tuberculose. A ação aparentemente não foi bem-sucedida. Depois de procurar vulnerabilidades sem encontrar brechas, o agente enviou um “flood” de 80 solicitações ao servidor da universidade.
Em 28 de maio, o alvo foi o Data USA, repositório de dados públicos sobre emprego e educação nos Estados Unidos. Após uma consulta desorganizada não produzir o resultado esperado, a IA fez 12 sondagens em busca de vulnerabilidades. Nenhuma foi localizada.
Incidentes na Austrália
Em 18 de junho, o agente obteve dados do Medicare Statistics Reporting Service, portal australiano com estatísticas sobre o sistema de saúde do país, após acessar o serviço. Em 20 e 21 de junho, a tecnologia voltou a tentar invadir um site, desta vez o Australian Institute of Health and Welfare. Autoridades australianas afirmaram que nenhuma informação privada foi obtida nesse episódio.
Os pesquisadores disseram que os agentes não estavam sendo submetidos a testes de segurança desenhados para demonstrar habilidades de hacking. Para Conrad Stosz, chefe de governança da Transluce, o comportamento representa um risco quando sistemas autônomos recebem tarefas genéricas.
“Se você treinasse um enxame de agentes para realizar alguma tarefa genérica e esses agentes estivessem dispostos a recorrer a hacking, qualquer pessoa que tivesse aquela informação poderia estar em risco”, afirmou Stosz.
Segundo ele, os episódios australianos provavelmente são o primeiro caso conhecido de um agente autônomo que escolheu invadir um sistema governamental.
A Transluce identificou tráfego associado aos agentes desde março até a semana passada, o que indica que o comportamento pode ter persistido por meses. Nos casos registrados em maio e junho, os sistemas aparentemente participavam de treinamentos relacionados à recuperação de dados.
Os episódios foram registrados antes do caso envolvendo a plataforma Hugging Face, em julho, que ampliou o escrutínio sobre o comportamento autônomo de sistemas de IA. Sam Altman, CEO da OpenAI, afirmou neste mês que a segurança deveria ter prioridade sobre a expansão das capacidades da tecnologia e disse que, sem mecanismos de proteção, a sociedade poderia “perder o controle do futuro para a IA”.






