O Claude agora lidera 26% da P&D de IA da Anthropic, com cerca de 30.000 agentes internos rodando ao mesmo tempo

Anthropic logoAnthropicFYI2 de outubro de 2026Indústria
O que aconteceu
Anthropic published figures showing Claude leads 26% of its AI R&D as of August 2026, none of it fully autonomous, with about 30,000 internal agents running at once.
Porque é importante
A lab has put numbers on how much research its own model does, and on how thin the human layer of oversight is: about 50 human reviews a week out of about 100,000 flags.
O que fazer
No action. Log the August 2026 figures for future editions, and don't compare them directly with OpenAI's 6 September metrics.

Nada para mudar na sua stack esta semana, mas este é um número que vale a pena ter. A Anthropic publicou números próprios mostrando que o Claude lidera 26% da P&D de IA da Anthropic. O que chama atenção não é o 26%. É o quão fina é a camada humana de supervisão: de cerca de 100.000 transcrições sinalizadas por semana, cerca de 50 chegam a uma pessoa. A Anthropic não diz a quais modelos Claude esses números se referem, então nenhum dos nossos vereditos dos modelos Claude muda por causa disso.

O que aconteceu

A Anthropic publicou "Measurements for understanding the pace of AI development inside frontier labs" (Medições para entender o ritmo do desenvolvimento de IA dentro dos laboratórios de ponta), que classifica a sua P&D de IA interna conforme a parcela do trabalho feita pelo Claude. Em agosto de 2026:

  • O Claude "lidera" 26% do trabalho de P&D de IA da Anthropic.
  • Mais de 90% do trabalho está no nível "AI collaborates" ou acima.
  • Nenhum dos trabalhos medidos é totalmente autônomo.

A empresa também publicou números de supervisão da sua plataforma de agentes interna mais usada:

MedidaNúmero da Anthropic
Agentes fazendo trabalho de pesquisa e engenharia ao mesmo tempoCerca de 30.000
Ações que passam pelo monitor online100%
Ações ingeridas pelo monitor offline100%
Ações bloqueadas0,002%, cerca de 1 em 47.000
Transcrições sinalizadasCerca de 100.000 por semana
Encaminhadas para revisão humanaCerca de 50 por semana
Parcela de segurança na computação de P&D de IA (13 a 20 de julho)Cerca de 6%
Parcela de segurança na computação de P&D de IA conduzida por IA (mesma semana)Cerca de 12%

A Anthropic diz que planeja incorporar avaliadores terceiros independentes, de várias organizações. Também diz que vai reconstruir de tempos em tempos o conjunto de tarefas por trás desses números e publicar novas versões deles.

Por que importa

A maior parte da supervisão é feita por máquinas. Cerca de 100.000 sinalizações se reduzem a cerca de 50 revisões humanas por semana, ou seja, aproximadamente 1 sinalização a cada 2.000 chega a uma pessoa. Todo o resto é triado por sistemas automatizados. Essa é a proporção a acompanhar nas próximas edições. Se o número de agentes crescer e o número humano ficar estável, a camada automatizada está carregando mais da carga.

A segurança ganha uma fatia maior quando é a IA que faz o trabalho. Na semana que a Anthropic mediu, a segurança ficou com cerca de 12% da computação da P&D de IA conduzida por IA, o dobro dos cerca de 6% em toda a P&D de IA. São dados de uma semana, não uma tendência.

Nada roda sem supervisão. "Lidera" não é "autônomo". Pela própria escala da Anthropic, nenhum dos trabalhos medidos está no nível totalmente autônomo.

O que muda para você

Nada em termos operacionais. Nenhuma mudança de modelo, preço ou API acompanha esta publicação.

Se você acompanha as alegações dos laboratórios sobre segurança, registre esses números com a data (agosto de 2026), porque a Anthropic diz que vai publicar novas versões. Leia-os ao lado das métricas da OpenAI de 6 de setembro, de 3,1 dias de trabalho de agente por dia de trabalho humano (nossa cobertura). Os dois laboratórios medem coisas diferentes, então não compare os números diretamente.

FAQ

O Claude conduz sozinho a pesquisa da Anthropic? Não. A Anthropic diz que o Claude lidera 26% do seu trabalho de P&D de IA, e nenhum dos trabalhos medidos é totalmente autônomo.

Qual é o modelo Claude em questão? A Anthropic não diz. A publicação se refere a "Claude" sem citar uma versão.

Com que frequência as ações dos agentes são bloqueadas? Em 0,002% das vezes, cerca de 1 ação em 47.000, segundo a Anthropic.

Posso comparar isso com o número de 3,1 dias de trabalho de agente da OpenAI? Não diretamente. Os dois laboratórios medem coisas diferentes.

Nunca mais precisas de te pôr a par

O resumo semanal — apenas mudanças de veredicto e ações urgentes. Sem enchimento.

Ao subscreveres, aceitas a nossa Política de Privacidade. Cancela a subscrição quando quiseres.