A Anthropic passou a enfrentar uma onda de manifestações internas sobre os riscos do desenvolvimento acelerado de inteligência artificial depois que o pesquisador Jacob Coxon anunciou sua saída da empresa. Funcionários e pesquisadores afirmam que modelos cada vez mais avançados podem representar ameaças em escala planetária e, em um dos alertas, aparece a possibilidade de extinção humana na próxima década.
Coxon disse que a Anthropic e a OpenAI, empresa onde trabalhou anteriormente, não estariam desenvolvendo modelos de IA de forma responsável. Na avaliação dele, as companhias estariam “apostando com nossas vidas”. A declaração levou colegas da Anthropic a publicar avaliações próprias sobre os riscos da tecnologia.
Divergências dentro da empresa
Anna Wang, que atua na área de segurança de Inteligência Artificial Geral na Anthropic e trabalhou anteriormente no Google DeepMind, afirmou que muitos funcionários defendem uma desaceleração do desenvolvimento. O objetivo seria formular um plano para reduzir os riscos associados a modelos avançados.
“Não existe ainda um plano científico viável para resolver os riscos de uma IA que se autoaperfeiçoa recursivamente”, escreveu Wang.
Drake Thomas afirmou respeitar a decisão de Coxon de não participar da criação de modelos caso eles possam representar riscos em escala planetária. Para ele, a evolução da tecnologia ocorre sem o nível de segurança desejado para uma superinteligência artificial.
Evan Hubinger, que se identifica como líder da divisão de alinhamento da Anthropic, disse que Coxon está correto e que a indústria não consegue acompanhar o potencial catastrófico da IA. Hubinger escreveu: “Nós realmente acreditamos que a IA poderia matar todos os humanos!”. Ele afirmou estimar pessoalmente em mais de 10% a probabilidade de isso ocorrer na próxima década.
Samuel Marks, outro pesquisador de segurança da Anthropic, disse que desenvolvedores acreditam na possibilidade de a IA provocar a extinção humana ou consequências igualmente graves nos próximos anos. Segundo Marks, a preocupação tende a ser maior entre funcionários mais seniores.
Ceticismo e riscos imediatos
Elon Musk reagiu aos alertas no X. Primeiro, escreveu que o episódio parecia uma armação. Depois, afirmou que poderia se tratar de uma “psyop”, expressão usada para descrever uma operação psicológica destinada a influenciar a percepção pública.
Musk respondeu a Parker Thayer, pesquisador do grupo conservador Capital Research. Thayer levantou, sem apresentar evidências, a hipótese de que a declaração de Coxon integrasse uma operação de relações públicas financiada para obter apoio a regras mais rígidas para a IA. Coxon rebateu Musk com uma selfie e disse ser uma pessoa real, com crenças reais.
A Anthropic defendeu sua estratégia de segurança e afirmou que sempre foi transparente sobre os benefícios e os riscos da IA. A empresa disse que seus modelos continuam sendo desenvolvidos com algumas das medidas de segurança mais fortes existentes na indústria.
O cientista Gary Marcus, porém, afirmou que as preocupações mais urgentes não dependem de uma superinteligência capaz de exterminar a humanidade. Ele citou patógenos produzidos com auxílio de IA, guerras iniciadas ou agravadas por desinformação e ataques contra infraestruturas críticas. Marcus disse não ter visto sinais de que esses riscos estejam sob controle.
No mesmo dia em que os alertas ganharam força, a Anthropic divulgou um relatório sobre o desmantelamento de uma operação que tentava construir uma arma biológica usando seus modelos. O caso não mostra que uma IA autônoma tenha criado uma arma por conta própria, mas indica que modelos disponíveis hoje podem ser usados em tentativas com potencial de causar danos graves. A situação aproximou o debate sobre riscos futuros de sistemas superinteligentes das ameaças mais imediatas ligadas ao uso da IA atual.






