Claude leitet jetzt 26 % der KI-F&E von Anthropic, rund 30.000 interne Agenten laufen gleichzeitig

Anthropic logoAnthropicFYI2. Oktober 2026Branche
Was ist passiert
Anthropic published figures showing Claude leads 26% of its AI R&D as of August 2026, none of it fully autonomous, with about 30,000 internal agents running at once.
Warum es wichtig ist
A lab has put numbers on how much research its own model does, and on how thin the human layer of oversight is: about 50 human reviews a week out of about 100,000 flags.
Was zu tun ist
No action. Log the August 2026 figures for future editions, and don't compare them directly with OpenAI's 6 September metrics.

In Ihrem Stack ändert sich diese Woche nichts, aber diese Zahl sollten Sie kennen. Anthropic hat eigene Zahlen veröffentlicht, wonach Claude 26 % der KI-F&E von Anthropic leitet. Auffällig ist nicht die 26 %, sondern wie dünn die menschliche Aufsichtsschicht ist: Von etwa 100.000 markierten Transkripten pro Woche erreichen rund 50 einen Menschen. Anthropic sagt nicht, welches Claude-Modell diese Zahlen abdecken, daher ändert sich keines unserer Urteile zu Claude-Modellen deswegen.

Was passiert ist

Anthropic hat „Measurements for understanding the pace of AI development inside frontier labs“ veröffentlicht, eine Publikation, die die interne KI-F&E danach einstuft, wie viel der Arbeit Claude erledigt. Stand August 2026:

  • Claude „leads“ (leitet) 26 % der KI-F&E-Arbeit von Anthropic.
  • Mehr als 90 % der Arbeit liegen bei „AI collaborates“ (KI arbeitet mit) oder darüber.
  • Keine der gemessenen Arbeiten ist vollständig autonom.

Außerdem hat Anthropic Aufsichtszahlen für die am häufigsten genutzte interne Agentenplattform veröffentlicht:

KennzahlAngabe von Anthropic
Agenten, die gleichzeitig Forschungs- und Engineering-Arbeit erledigenRund 30.000
Aktionen, die den Online-Monitor durchlaufen100 %
Aktionen, die der Offline-Monitor erfasst100 %
Blockierte Aktionen0,002 %, etwa 1 von 47.000
Markierte TranskripteRund 100.000 pro Woche
An die menschliche Prüfung eskaliertRund 50 pro Woche
Sicherheitsanteil am Compute für KI-F&E (13. bis 20. Juli)Rund 6 %
Sicherheitsanteil am Compute für KI-getriebene KI-F&E (gleiche Woche)Rund 12 %

Anthropic plant eigenen Angaben zufolge, unabhängige externe Evaluatoren aus mehreren Organisationen einzubinden. Anthropic sagt außerdem, dass es das Aufgabenset hinter diesen Zahlen von Zeit zu Zeit neu aufbauen und neue Versionen davon veröffentlichen will.

Warum es wichtig ist

Den Großteil der Aufsicht übernehmen Maschinen. Aus rund 100.000 Markierungen werden etwa 50 menschliche Prüfungen pro Woche, also erreicht rund 1 von 2.000 Markierungen einen Menschen. Alles andere sortieren automatisierte Systeme vor. Dieses Verhältnis sollte man in künftigen Ausgaben im Auge behalten. Wächst die Zahl der Agenten und bleibt die Zahl der menschlichen Prüfungen gleich, trägt die automatisierte Schicht einen größeren Teil der Last.

Sicherheit bekommt einen größeren Anteil, wenn die KI die Arbeit erledigt. In der von Anthropic gemessenen Woche entfielen rund 12 % des Computes für KI-getriebene KI-F&E auf Sicherheit, doppelt so viel wie die rund 6 % über die gesamte KI-F&E. Das sind Daten aus einer einzigen Woche, kein Trend.

Nichts läuft unbeaufsichtigt. „Leads“ heißt nicht „autonom“. Nach Anthropics eigener Skala liegt keine der gemessenen Arbeiten auf der Stufe „vollständig autonom“.

Was sich für Sie ändert

Operativ nichts. Mit dieser Veröffentlichung kommt keine Änderung bei Modell, Preis oder API.

Wenn Sie die Sicherheitsangaben von Labs verfolgen, halten Sie diese Zahlen mit Datum (August 2026) fest, denn Anthropic will neue Versionen veröffentlichen. Lesen Sie sie neben den Kennzahlen von OpenAI vom 6. September, die 3,1 Agenten-Arbeitstage pro menschlichem Arbeitstag nennen (unsere Berichterstattung). Die beiden Labs messen unterschiedliche Dinge, vergleichen Sie die Zahlen also nicht direkt.

FAQ

Führt Claude die Forschung von Anthropic eigenständig durch? Nein. Laut Anthropic leitet Claude 26 % der KI-F&E-Arbeit, und keine der gemessenen Arbeiten ist vollständig autonom.

Um welches Claude-Modell handelt es sich? Anthropic sagt es nicht. Die Veröffentlichung spricht von „Claude“, ohne eine Version zu nennen.

Wie oft werden Agentenaktionen blockiert? Laut Anthropic in 0,002 % der Fälle, etwa 1 von 47.000 Aktionen.

Kann ich das mit dem Wert von 3,1 Agenten-Arbeitstagen von OpenAI vergleichen? Nicht direkt. Die beiden Labs messen unterschiedliche Dinge.

Nie wieder etwas verpassen

Das wöchentliche Delta — nur Urteilsänderungen und dringende Punkte. Kein Füllmaterial.

Mit dem Abonnieren stimmst du unserer Datenschutzerklärung zu. Jederzeit abbestellbar.