Anthropic mesure la part de son développement d’IA déjà menée par Claude

Visualisation officielle des indicateurs publiés par Anthropic sur le développement de l’IA
Anthropic propose trois familles d’indicateurs pour suivre le rythme du développement de l’IA. Visuel officiel Anthropic.

Anthropic publie une première série d’indicateurs pour mesurer la place prise par l’intelligence artificielle dans son propre développement. Selon l’entreprise, Claude dirige déjà 26 % des tâches de recherche et développement liées aux modèles, tandis que plus de 90 % de ce travail implique au moins une collaboration entre humains et IA.

Le rapport de l’Anthropic Institute cherche à rendre observable un phénomène encore peu documenté : l’utilisation de modèles avancés pour concevoir leurs successeurs. L’entreprise distingue six niveaux, de l’absence d’IA à l’autonomie complète. En août 2026, Claude n’atteignait le niveau maximal dans aucune catégorie mesurée. Il pouvait cependant accomplir l’essentiel d’une tâche à partir d’une consigne générale dans un peu plus d’un quart des activités étudiées.

Environ 30 000 agents actifs simultanément

Anthropic mesure aussi la supervision de ses agents internes. Sur sa plateforme de recherche et d’ingénierie la plus utilisée, environ 30 000 agents travaillent simultanément. L’entreprise affirme que toutes leurs actions passent par un contrôle automatique avant exécution et sont également analysées après coup.

Sur plus d’un milliard de décisions examinées en août, 0,002 % ont été bloquées par le dispositif en temps réel, soit environ une sur 47 000. Le contrôle différé fait remonter près de 100 000 transcriptions chaque semaine. Après plusieurs filtres automatiques, une cinquantaine de cas prioritaires sont transmis à des humains. Anthropic précise que ces chiffres ne couvrent que sa plateforme interne principale, pas l’ensemble de ses outils.

Le calcul consacré à la sécurité devient un indicateur

La troisième mesure concerne l’allocation de puissance informatique. Sur une semaine observée en juillet, environ 6 % du calcul consacré à la R&D en IA servait à des travaux classés comme relevant de la sécurité. Cette part montait à 12 % pour le calcul utilisé dans la R&D elle-même pilotée par l’IA. Anthropic reconnaît que la frontière entre recherche de capacités et recherche de sécurité reste difficile à tracer.

Le groupe propose que les laboratoires publient régulièrement ces trois familles de données : niveau d’automatisation de la R&D, couverture et délai des contrôles, puis répartition du calcul. Il prévoit de donner à des évaluateurs indépendants un accès comparable à celui de ses équipes internes de gestion des risques.

Des chiffres utiles, mais encore autoévalués

Cette transparence apporte des ordres de grandeur rares sur le fonctionnement d’un laboratoire de pointe. Elle ne constitue toutefois pas encore un standard commun. Anthropic a construit son propre index, utilise notamment Claude pour analyser les tâches et publie des résultats difficiles à comparer avec ceux d’autres acteurs. La prochaine étape sera donc la vérification par des tiers et l’adoption de définitions partagées.

Le briefing RoboActu

L’essentiel de la robotique, une fois par semaine.

Une sélection courte des annonces, usages et robots à suivre.

Continuer sur ce sujet

Comparer les robots