À retenir
À retenir
- Anthropic a publié le R&D Automation Index le 17 septembre 2026, sur sa page Anthropic Institute.
- Claude « mène » 26 % des tâches de R&D internes d'Anthropic, contre moins de 1 % en février 2026.
- 0 % des tâches mesurées sont totalement autonomes (niveau AL5) ; plus de 90 % restent au moins collaboratives (AL3 ou plus).
- La mesure repose sur environ 15 000 tâches extraites par un agent Claude et évaluées par un second modèle Claude jouant le rôle de juge.
- Anthropic reconnaît que ce juge Claude ne concorde avec l'auto évaluation humaine que 59 % du temps.
- L'index a été publié 5 jours après l'essai « We Must Pace the Frontier » de Dario Amodei, appelant à ralentir la course à l'IA.
- Deux autres métriques ont été publiées le même jour : Agent Oversight (1+ milliard de décisions) et Safety Compute (12 % du calcul de R&D IA alloué à la sécurité).
Réponse rapide
Le 17 septembre 2026, Anthropic a publié le « R&D Automation Index », l'une de trois métriques internes présentées dans un document intitulé « Measurements for understanding the pace of AI development inside frontier labs », sur son site Anthropic Institute. Le chiffre central : Claude « mène » 26 % des tâches de recherche et développement internes d'Anthropic (données collectées en juillet 2026, présentées comme d'août 2026), contre moins de 1 % en février 2026. « Mener » correspond au niveau AL4 d'une échelle d'automatisation allant de AL0 à AL5 : Claude complète la majorité d'une tâche de bout en bout à partir d'une consigne de haut niveau, sous supervision humaine. Anthropic précise explicitement que 0 % des tâches mesurées atteignent le niveau AL5, l'autonomie totale, et que plus de 90 % des tâches se situent au moins au niveau AL3 (« collabore »).
Verdict en 30 secondes
Studeria le dit sans détour : ce chiffre de 26 % est réel et impressionnant en progression, mais ce n'est ni une preuve d'autonomie totale de l'IA, ni un benchmark indépendant. C'est un instantané interne, mesuré et jugé par des modèles Claude eux mêmes, qu'Anthropic reconnaît sujet à ses propres angles morts. Pour un professionnel en reconversion, le signal à retenir n'est pas « l'IA remplace les chercheurs », c'est que le travail humain sur les tâches de R&D se déplace déjà massivement vers la supervision, la formulation de consignes de haut niveau et le contrôle qualité. Se former à travailler avec un agent IA plutôt qu'à sa place devient la compétence qui compte.
Qu'est ce que le R&D Automation Index d'Anthropic ?
Le R&D Automation Index est l'une des trois métriques publiées par Anthropic le 17 septembre 2026 dans un document intitulé « Measurements for understanding the pace of AI development inside frontier labs », sur la page Anthropic Institute. Les deux autres métriques publiées le même jour sont l'« Agent Oversight » (plus d'1 milliard de décisions prises par environ 30 000 agents internes, dont seulement 0,002 % bloquées par les moniteurs automatiques et une cinquantaine escaladées à des humains) et le « Safety Compute » (6 % du calcul total de R&D, et 12 % du calcul de R&D piloté par IA alloué spécifiquement à la sécurité, sur la semaine du 13 au 20 juillet 2026).
Comment Anthropic mesure t il que Claude « mène » 26 % de sa R&D ?
La méthodologie repose sur une échelle d'automatisation en 6 niveaux, de AL0 à AL5. Le niveau AL4, celui que recouvre le mot « mène », signifie que Claude complète la majorité d'une tâche de bout en bout à partir d'une consigne de haut niveau, avec un humain qui supervise. Concrètement, un agent Claude a extrait environ 15 000 tâches à partir de Slack et de la documentation interne d'Anthropic, en échantillonnant chaque semaine 20 % du personnel de R&D durant le mois de juillet 2026, puis a consolidé ces tâches en 542 catégories. Un second modèle Claude, jouant le rôle de « juge », a ensuite noté le niveau d'automatisation de chaque tâche, pondéré par le temps passé. Anthropic reconnaît elle même une limite importante de fiabilité : ce juge Claude ne concorde avec l'auto évaluation des employés humains que 59 % du temps, sachant que l'accord entre deux évaluateurs humains n'est lui même que de 35 %.
| Métrique | Valeur | Période mesurée |
|---|---|---|
| R&D Automation Index | Claude mène 26 % des tâches (contre moins de 1 % en février 2026) | Données de juillet 2026, présentées comme d'août 2026 |
| Agent Oversight | 1+ milliard de décisions, 0,002 % bloquées par les moniteurs | Non précisée dans le document |
| Safety Compute | 12 % du calcul de R&D piloté par IA alloué à la sécurité | Semaine du 13 au 20 juillet 2026 |
Ce chiffre de 26 % veut il dire que l'IA remplace déjà les chercheurs d'Anthropic ?
Non, et Anthropic le précise explicitement dans son propre document : 0 % des tâches mesurées se situent au niveau AL5, l'autonomie complète sans supervision humaine. Plus de 90 % des tâches se situent au moins au niveau AL3, c'est a dire que Claude « collabore » avec un humain plutôt qu'il ne travaille seul. Le chiffre de 26 % mesure donc une part croissante de tâches où Claude prend l'initiative et produit l'essentiel du travail, pas une part de postes ou de chercheurs remplacés. Anthropic reconnaît par ailleurs une limite méthodologique de taille dans son propre document : « The judge is a Claude model rating Claude's work, which could share the model's blind spots », c'est a dire que le modèle qui évalue le travail de Claude partage potentiellement les mêmes angles morts que le modèle évalué. Le site d'analyse Forkast qualifie d'ailleurs cet index de « a proprietary snapshot, not an industry benchmark », un instantané propriétaire et non un étalon reconnu par l'industrie.
Pourquoi ce chiffre arrive t il 5 jours après l'appel d'Anthropic à ralentir la course à l'IA ?
Le 12 septembre 2026, soit 5 jours avant la publication du R&D Automation Index, le PDG d'Anthropic Dario Amodei a publié un essai intitulé « We Must Pace the Frontier », appelant à un ralentissement délibéré de la course entre laboratoires d'IA de pointe. Comme le souligne Forkast, cette chronologie crée une tension visible entre un discours public de prudence et la publication, quelques jours plus tard, d'un chiffre qui illustre une accélération rapide et mesurable de l'automatisation interne de la R&D par Anthropic elle même. Cette tension n'invalide pas les chiffres publiés, mais elle éclaire le contexte dans lequel Anthropic a choisi de les rendre publics.
Quel choix selon votre profil face à l'automatisation de la R&D par l'IA ?
Ce que révèle le R&D Automation Index d'Anthropic n'a pas la même portée selon votre situation professionnelle.
Professionnels en évolution ou reconversion. C'est le public le plus directement concerné : une progression de moins de 1 % à 26 % en 7 mois, même mesurée en interne par Anthropic, montre que les compétences de supervision, de formulation de consignes et de contrôle qualité d'un travail produit par IA deviennent centrales, y compris dans des métiers de recherche et développement traditionnellement jugés difficiles à automatiser.
Indépendants et experts. Comprendre précisément ce que mesure un index comme celui ci, et savoir en expliquer les limites méthodologiques à des clients, permet de se positionner comme une voix nuancée dans un débat souvent binaire entre remplacement total et scepticisme excessif.
TPE et PME. L'exemple d'Anthropic reste peu transposable tel quel à une petite structure, mais il illustre une tendance de fond : documenter précisément quelles tâches un agent IA peut mener seul, avec supervision, dans son propre contexte, plutôt que de se fier à des chiffres sectoriels globaux.
ETI et grands groupes. La méthodologie d'Anthropic, avec ses limites assumées de fiabilité, offre un exemple concret de ce qu'implique la mise en place d'un suivi interne sérieux de l'automatisation par IA : échantillonnage, catégorisation des tâches, et reconnaissance explicite des biais de mesure.
Studeria accompagne les salariés et professionnels en reconversion qui veulent comprendre concrètement ce que l'automatisation croissante de tâches complexes par l'IA change pour leur métier, au delà des chiffres spectaculaires relayés dans la presse. Apprendre à superviser, cadrer et vérifier le travail d'un agent IA devient une compétence transférable, y compris dans des métiers qui semblaient jusque là éloignés de l'intelligence artificielle générative.
Combien l'IA peut vous faire gagner cette année ?
Estimez en deux minutes le temps et le budget récupérables sur vos tâches répétitives.
Je calcule mon gain IAPièges à éviter en lisant ce type d'index d'automatisation IA
Premier piège : confondre « Claude mène 26 % des tâches » avec « l'IA remplace 26 % des chercheurs », alors qu'Anthropic précise que 0 % des tâches mesurées sont totalement autonomes et que plus de 90 % restent au moins collaboratives. Deuxième piège : traiter ce chiffre comme un étalon industriel comparable d'un laboratoire à l'autre, alors qu'il s'agit d'une mesure interne, avec une méthodologie et des catégories propres à Anthropic, que Forkast qualifie lui même d'instantané propriétaire. Troisième piège : ignorer la limite de fiabilité qu'Anthropic reconnaît elle même, à savoir qu'un modèle Claude évalue le travail d'un autre modèle Claude, avec un accord de seulement 59 % avec l'auto évaluation humaine.
Ce que Studeria retient
Le R&D Automation Index d'Anthropic documente, avec une transparence méthodologique inhabituelle pour ce type de communication, une progression réelle et rapide de l'automatisation de tâches de recherche et développement par Claude. Mais Anthropic elle même encadre ce chiffre de limites claires : aucune tâche mesurée n'est totalement autonome, et le processus d'évaluation partage potentiellement les angles morts du modèle évalué. Studeria recommande à tout professionnel qui s'interroge sur l'avenir de son métier face à l'IA de lire ce type d'index en détail, au delà du chiffre choc repris dans les titres, pour comprendre précisément ce qui est mesuré et ce qui ne l'est pas.
Pour aller plus loin
Sur le blog Studeria : l'incubateur IA Studeria pour salariés en reconversion, notre article sur le simulateur Anthropic sur l'emploi et l'IA en 2030, et notre formation IA en entreprise. Sources externes : le document officiel Anthropic Institute, 17 septembre 2026 et l'analyse de Forkast, 21 septembre 2026.
FAQ article
Qu'est ce que le R&D Automation Index d'Anthropic ?
Que signifie exactement « Claude mène 26 % de la R&D » ?
Comment Anthropic a t il mesuré ce chiffre de 26 % ?
Ce chiffre de 26 % est il fiable ?
Pourquoi Anthropic publie t elle ce chiffre juste après un appel à ralentir la course à l'IA ?
Ce chiffre signifie t il que les chercheurs d'Anthropic vont perdre leur emploi ?
Que doit retenir un professionnel en reconversion de cet index ?
4,9/5
Boostez vos compétences
+5000 apprenants formés
Nos parcours s’adaptent à vos objectifs, à votre rythme et à votre niveau.

4,7/5
sur 171 avis

+200 entreprises formées à l’IA
De la startup au grand groupe, nos parcours sont pensées pour déployer des solutions performantes avec l’IA .

Prêt à te former ?
Trois parcours selon ton objectif : apprendre, te certifier, ou lancer ton activité.
Parcours Incubateur IA
Comprenez l’IA, gagnez du temps au quotidien et valorisez votre profil professionnel
Parcours Accélérateur IA
Implémentez l’IA grâce à un accompagnement stratégique et opérationnel pour structurer, automatiser et scaler votre business
Parcours Implémentation & Agent IA
TPE, PME, ETI : Un parcours stratégique pour former vos équipes et implémenter les bons outils IA dans votre entreprise.
Du dimanche 5 avril au jeudi 9 avril 2026
Le sommet IA 2026
Cinq soirées de démonstrations live, de conseils actionnables et d'échanges avec certains des entrepreneurs et experts les plus influents de France, le tout sans écrire une seule ligne de code.

Du dimanche 28 Juin au jeudi 2 Juillet 2026
Le sommet IA 2026
Cinq soirées de démonstrations live, de conseils actionnables et d'échanges avec certains des entrepreneurs et experts les plus influents de France, le tout sans écrire une seule ligne de code.









