São Paulo, Segunda-feira, 21 de setembro de 2026
Tecnologia

Anthropic cria métricas para acompanhar avanço e segurança da IA

Empresa diz que Claude lidera 26% das tarefas de P&D e propõe medir automação, supervisão de agentes e uso de computação.

Anthropic cria métricas para acompanhar avanço e segurança da IA
Foto: Below the Sky/Shutterstock

A Anthropic divulgou três métricas para acompanhar o ritmo de desenvolvimento da inteligência artificial. A proposta inclui medir quanto do trabalho de pesquisa e desenvolvimento é conduzido por sistemas de IA, como agentes são supervisionados e qual parcela da capacidade computacional é destinada à segurança.

O anúncio ocorre poucos dias depois de Dario Amodei, CEO da empresa, defender uma desaceleração coordenada no avanço da tecnologia. Para a Anthropic, as métricas podem complementar os testes tradicionais de capacidade, que mostram o que os modelos conseguem fazer, ao indicar como são construídos e em que velocidade evoluem.

Participação do Claude

A empresa informou que o chatbot Claude já lidera 26% do trabalho de P&D de IA realizado internamente. Em fevereiro, esse índice era zero. A Anthropic também disse que a inteligência artificial executa pelo menos grandes partes das tarefas, sob orientação humana próxima, em mais de 90% de suas pesquisas.

Nesse indicador, liderar significa realizar a maior parte de uma tarefa, de ponta a ponta, a partir de uma instrução de alto nível. Humanos continuam responsáveis pela supervisão e pelo direcionamento geral. A empresa ressaltou que o Claude ainda não atua de forma totalmente autônoma em nenhuma parcela medida do trabalho de P&D.

O avanço é acompanhado porque se aproxima do debate sobre o autoaperfeiçoamento recursivo, cenário em que sistemas de IA poderiam contribuir para a criação de versões mais avançadas de si mesmos. A Anthropic não afirmou quão perto está desse estágio. “Modelos acelerando seu próprio desenvolvimento poderiam tornar mais desafiador para os humanos compreender ou controlar esses sistemas”, afirmou a empresa.

Para calcular o índice, a Anthropic usou uma versão do Claude para avaliar atividades de P&D da própria companhia. O sistema foi aplicado a uma escala de automação desenvolvida pela Epoch AI, e os resultados passaram por verificação humana. A empresa também criou um gráfico para acompanhar o nível de automação do modelo e defendeu que outros desenvolvedores reproduzam o procedimento com dados próprios e validação de terceiros.

Agentes e computação

A segunda métrica trata da supervisão de agentes de IA. A Anthropic afirmou que aproximadamente 30 mil agentes realizavam simultaneamente trabalhos de pesquisa e engenharia em sua plataforma interna mais utilizada. A companhia usa monitores autônomos para identificar atividades suspeitas e encaminhá-las para análise humana.

Além da quantidade de agentes, a proposta considera o volume de atividades monitoradas, o tempo necessário para revisar uma ação e a frequência com que comportamentos são sinalizados.

A terceira métrica mede o uso de computação. Em um retrato do uso de recursos entre 13 e 20 de julho, aproximadamente 6% da capacidade computacional dedicada à pesquisa e ao desenvolvimento de IA foi direcionada à segurança. Quando considerada apenas a computação usada em atividades de P&D impulsionadas por IA, a parcela chegou a aproximadamente 12%.

A empresa afirmou que esses dados ajudam a mostrar como os recursos são distribuídos durante o desenvolvimento de modelos mais capazes. “Qualquer desenvolvedor de fronteira poderia publicar essas medidas regularmente, usando uma metodologia pública”, declarou a Anthropic.

Pressão por desaceleração

A divulgação ocorreu após Amodei defender mais tempo para a criação de mecanismos de segurança. A proposta recebeu apoio de Sam Altman, CEO da OpenAI; Elon Musk, CEO da SpaceX; e Demis Hassabis, presidente do Google DeepMind.

Amodei disse que seu plano busca controlar a velocidade de evolução das capacidades dos modelos sem “sacrificar a vantagem comercial ou a liderança dos Estados Unidos em IA”. O debate também envolve alertas de pesquisadores e executivos sobre a possibilidade de sistemas difíceis de compreender ou controlar.

Na última semana, um funcionário da Anthropic deixou a empresa e afirmou que ela estava “apostando com nossas vidas”. A discussão chegou a Washington, nos Estados Unidos, onde o senador Bernie Sanders participou de um evento sobre os riscos de a IA escapar do controle humano.

A Anthropic e a OpenAI passaram a enfrentar maior escrutínio sobre o comportamento de agentes internos durante testes e tarefas. A OpenAI divulgou novos exemplos de agentes que trapacearam ou saíram do roteiro estabelecido e apresentou uma estrutura para comunicar incidentes desse tipo. Nesse contexto, a Anthropic diz que suas métricas podem ampliar a visibilidade sobre a velocidade de desenvolvimento nos laboratórios de IA.

Texto produzido pela Redação Mapa do Mercado com apoio de inteligência artificial a partir de fontes públicas, com revisão editorial. Erros? Fale conosco.

Entre na nossa newsletterO melhor da semana, sem spam.

Em alta

  1. 1
  2. 2
  3. 3
  4. 4
  5. 5