Claude ya lidera el 26% de la I+D de IA de Anthropic, con unos 30.000 agentes internos funcionando a la vez
- Qué pasó
- Anthropic published figures showing Claude leads 26% of its AI R&D as of August 2026, none of it fully autonomous, with about 30,000 internal agents running at once.
- Por qué importa
- A lab has put numbers on how much research its own model does, and on how thin the human layer of oversight is: about 50 human reviews a week out of about 100,000 flags.
- Qué hacer
- No action. Log the August 2026 figures for future editions, and don't compare them directly with OpenAI's 6 September metrics.
Esta semana no hay nada que cambiar en tu stack, pero es una cifra que conviene tener. Anthropic ha publicado sus propias cifras, según las cuales Claude lidera el 26% de la I+D de IA de Anthropic. Lo llamativo no es el 26%, sino lo reducida que es la capa humana de supervisión: de unas 100.000 transcripciones marcadas cada semana, unas 50 llegan a una persona. Anthropic no dice a qué modelo de Claude corresponden estas cifras, así que ninguno de nuestros veredictos sobre los modelos de Claude cambia por esto.
Qué ocurrió
Anthropic publicó "Measurements for understanding the pace of AI development inside frontier labs", que califica su I+D de IA interna según cuánto del trabajo hace Claude. A agosto de 2026:
- Claude "lidera" el 26% del trabajo de I+D de IA de Anthropic.
- Más del 90% del trabajo está en "AI collaborates" (la IA colabora) o por encima.
- Ninguna parte del trabajo medido es totalmente autónoma.
También publicó cifras de supervisión de su plataforma de agentes internos más usada:
| Medida | Cifra de Anthropic |
|---|---|
| Agentes que hacen trabajo de investigación e ingeniería a la vez | Unos 30.000 |
| Acciones que pasan por el monitor en línea | 100% |
| Acciones incorporadas al monitor fuera de línea | 100% |
| Acciones bloqueadas | 0,002%, aproximadamente 1 de cada 47.000 |
| Transcripciones marcadas | Unas 100.000 a la semana |
| Escaladas a revisión humana | Unas 50 a la semana |
| Proporción del cómputo de I+D de IA dedicada a seguridad (13 al 20 de julio) | Alrededor del 6% |
| Proporción del cómputo de I+D de IA impulsada por IA dedicada a seguridad (misma semana) | Alrededor del 12% |
Anthropic dice que planea incorporar evaluadores independientes de terceros procedentes de varias organizaciones. También dice que reconstruirá cada cierto tiempo el conjunto de tareas en que se basan estas cifras y publicará nuevas versiones.
Por qué importa
Las máquinas hacen la mayor parte de la supervisión. Unas 100.000 alertas se reducen a unas 50 revisiones humanas a la semana, es decir, aproximadamente 1 alerta de cada 2.000 llega a una persona. Todo lo demás lo filtran sistemas automatizados. Esa proporción es la que hay que vigilar en futuras ediciones. Si el número de agentes crece y la cifra humana se mantiene estable, la capa automatizada está asumiendo más carga.
La seguridad recibe una parte mayor cuando es la IA quien hace el trabajo. En la semana que midió Anthropic, la seguridad se llevó cerca del 12% del cómputo de la I+D de IA impulsada por IA, el doble del 6% aproximado de toda la I+D de IA. Son datos de una sola semana, no una tendencia.
Nada funciona sin supervisión. "Lidera" no es "autónomo". Según la propia escala de Anthropic, ninguna parte del trabajo medido está en el nivel totalmente autónomo.
Qué cambia para ti
Nada a nivel operativo. Esta publicación no trae ningún cambio de modelo, de precio ni de API.
Si haces seguimiento de las afirmaciones de seguridad de los laboratorios, registra estas cifras con su fecha (agosto de 2026), porque Anthropic dice que publicará nuevas versiones. Léelas junto a las métricas de OpenAI del 6 de septiembre, de 3,1 jornadas de trabajo de agente por jornada de trabajo humana (nuestra cobertura). Los dos laboratorios miden cosas distintas, así que no compares las cifras directamente.
FAQ
¿Claude dirige por sí solo la investigación de Anthropic? No. Anthropic dice que Claude lidera el 26% de su trabajo de I+D de IA, y que ninguna parte del trabajo medido es totalmente autónoma.
¿De qué modelo de Claude se trata? Anthropic no lo dice. La publicación se refiere a "Claude" sin nombrar ninguna versión.
¿Con qué frecuencia se bloquean las acciones de los agentes? El 0,002% de las veces, aproximadamente 1 acción de cada 47.000, según Anthropic.
¿Puedo comparar esto con la cifra de 3,1 jornadas de trabajo de agente de OpenAI? No directamente. Los dos laboratorios miden cosas distintas.
No vuelvas a tener que ponerte al día
El resumen semanal — solo cambios de veredicto y acciones urgentes. Sin relleno.