Claude já lidera 26% da pesquisa de IA da Anthropic; 30 mil agentes trabalham ao mesmo tempo

Anthropic diz que Claude lidera 26% do P&D de IA e mantém cerca de 30 mil agentes simultâneos; métricas ainda dependem de supervisão humana.

A Anthropic afirma que o Claude já “lidera” 26% do trabalho de pesquisa e desenvolvimento de IA dentro da empresa.

O número não significa autonomia total: a categoria usada pela companhia descreve tarefas que o modelo consegue executar quase de ponta a ponta a partir de uma instrução de alto nível.

O mesmo levantamento mostra uma escala interna incomum.

Em agosto de 2026, aproximadamente 30 mil agentes faziam trabalho de pesquisa e engenharia ao mesmo tempo na plataforma interna de agentes mais usada pela Anthropic.

O que significa Claude “liderar” 26% da pesquisa

A empresa criou um índice próprio para medir quanto do trabalho de P&D em IA já é automatizado.

As tarefas recebem níveis de AL0 a AL5, indo de nenhuma participação da IA até autonomia completa.

No nível AL4, chamado de “AI leads”, o sistema faz a maior parte da tarefa a partir de uma orientação geral, mas uma pessoa ainda supervisiona o processo.

A Anthropic diz que 26% do trabalho medido chegou a esse nível em agosto; mais de 90% já está em AL3 ou superior, quando a IA pelo menos colabora de forma significativa.

Há uma limitação importante: a própria empresa reconhece que usa seus modelos para ajudar a avaliar os níveis de automação.

Além disso, não existe ainda uma metodologia comum entre laboratórios, o que impede comparar esse percentual diretamente com OpenAI, Google ou outros concorrentes.

30 mil agentes não representam 30 mil funcionários virtuais

O segundo número mede agentes ativos na infraestrutura interna, não pessoas substituídas.

Segundo a Anthropic, cerca de 30 mil agentes trabalhavam simultaneamente em pesquisa e engenharia na sua plataforma interna mais utilizada.

Esses agentes, entretanto, podem:

  • executar tarefas por períodos longos, delegar etapas e trocar informações com outros agentes.

A medição cobre apenas essa plataforma, portanto não representa necessariamente todos os sistemas internos usados pela empresa.

Claude Hack

Imagem: Reprodução – Edição/BT

Anthropic monitora mais de 1 bilhão de decisões

A companhia afirma que 100% das ações desses agentes passam por monitores online antes da execução e também entram em sistemas de análise posterior.

Em agosto, a Anthropic avaliou mais de 1 bilhão de decisões de agentes de pesquisa e engenharia.

O monitor em tempo real bloqueou cerca de 0,002% das decisões, aproximadamente uma em cada 47 mil.

Já o sistema offline sinaliza uma fração maior para revisão automatizada e leva os casos de maior prioridade a analistas humanos.

O dado ajuda a dimensionar uma mudança dentro dos laboratórios de IA:

  • os próprios modelos já participam de forma intensa do desenvolvimento das próximas gerações.

Ainda assim, o relatório não sustenta a ideia de pesquisa totalmente autônoma.

A Anthropic afirma explicitamente que Claude não opera de forma autônoma em nenhuma categoria medida.

O que você achou? Siga @bitmagazineoficial no Instagram para ver mais e deixar seu comentário clicando aqui

Jogos recomendados

Moyses Batista
Escrito por

Moyses Batista