Accueil · Bloc 4 Les agents · T4.3
Quand l'IA exécute : code et actions agentiques
Ce que les outils de code agentique savent vraiment faire, et ce qu'une rare mesure indépendante dit de leur impact réel sur la productivité.
L'essentiel
- L'assistance au code par IA précède l'ère « agentique ». GitHub Copilot, lancé en préversion technique le 29/06/2021 puis passé en disponibilité générale le 21/06/2022, proposait à l'origine des complétions de code ligne à ligne — pas encore un système agissant de façon autonome sur un projet entier (GitHub Blog, TechCrunch).
- Le basculement vers l'agentique proprement dit est récent et daté. GitHub a fait passer son « Agent Mode » en disponibilité générale dans VS Code en 04/2025, puis étendu à JetBrains, Eclipse et Xcode en 07/2025 : l'outil peut itérer sur son propre résultat, corriger des erreurs détectées automatiquement et exécuter des commandes de terminal, selon GitHub (GitHub Blog, « The agent awakens »).
- Anthropic a suivi une trajectoire comparable avec Claude Code : sorti en version bêta le 24/02/2025 (aux côtés de Claude 3.7 Sonnet) puis en disponibilité générale le 22/05/2025, c'est un outil en ligne de commande qui lit les fichiers d'un projet, propose des modifications, exécute des tests et peut mener des tâches en plusieurs étapes avec une autonomie croissante, selon Anthropic (claude.com/product/claude-code).
- L'expression « vibe coding » — décrivant une pratique où le développeur délègue largement l'écriture du code à l'IA, jusqu'à ne plus lire chaque ligne produite — a été inventée par Andrej Karpathy (ancien ingénieur fondateur d'OpenAI) dans une publication du 02/02/2025 ; le terme a suffisamment marqué l'année pour être désigné mot de l'année 2025 par le Collins Dictionary (CNN, 06/11/2025).
- Le standard technique qui permet à ces outils de se connecter de façon uniforme à des sources de données et systèmes externes (fichiers, bases de données, API) est le Model Context Protocol (MCP), ouvert par Anthropic le 25/11/2024 ; selon Anthropic, il a été adopté en l'espace d'un an par OpenAI, Google DeepMind et Microsoft — une adoption multi-éditeurs également relayée par plusieurs observateurs indépendants du secteur, qui en font aujourd'hui le standard de facto le plus cité pour l'interopérabilité des outils agentiques.
- Sur l'adoption (famille périssable (e), chiffres communiqués par l'éditeur lui-même, à traiter comme tels) : Microsoft aurait indiqué environ 20 millions d'utilisateurs cumulés de GitHub Copilot en 07/2025, et environ 4,7 millions d'abonnés payants lors d'un point trimestriel fin janvier 2026 (progression d'environ 75 % sur un an) à vérifier.
- Sur le financement (famille (c), extrêmement volatile — donné ici comme illustration de cette volatilité plus que comme repère stable) : Anysphere, société éditrice de l'éditeur de code Cursor, est passée d'une valorisation de 9,9 Md$ le 05/06/2025 (plus de 500 M$ de revenu annualisé, selon TechCrunch) à 29,3 Md$ lors d'une levée de 2,3 Md$ annoncée le 13/11/2025 (CNBC) — un triplement en cinq mois. Toute valorisation trouvée en dehors de cette recherche doit être revérifiée avant citation : ce type de donnée se périme en semaines.
- Sur la progression des capacités (mesure indépendante datée, palier 3) : dans une étude publiée le 19/03/2025, l'organisation de recherche indépendante METR a mesuré, sur des tâches majoritairement de code, que la durée de tâche qu'un agent IA réussit à un taux de succès de 50 % double environ tous les 7 mois sur la période 2019-2024, et environ tous les 4 mois sur la période 2024-2025 — une mesure de progression des capacités, pas une mesure de fiabilité en contexte réel (METR, 19/03/2025).
- Sur la productivité en contexte réel précisément — le point le plus disputé —, METR a publié le 10/07/2025 un essai contrôlé randomisé : 16 développeurs open source expérimentés (environ 5 ans d'ancienneté moyenne sur les dépôts testés), sur 246 tâches réelles de leurs propres dépôts matures, ont mis 19 % de temps EN PLUS pour accomplir ces tâches lorsqu'ils étaient autorisés à utiliser des outils IA (majoritairement Cursor avec Claude 3.5/3.7 Sonnet) — alors que ces mêmes développeurs estimaient après coup avoir été 20 % plus rapides grâce à l'IA : un écart documenté entre perception et mesure (METR, 10/07/2025).
- METR elle-même relativise aujourd'hui ce résultat sans le retirer : dans un billet du 24/02/2026, l'organisation indique juger probable que les développeurs soient désormais davantage aidés par les outils IA qu'au moment de l'étude (début 2025), notamment du fait d'une adoption croissante d'outils agentiques (Claude Code, Codex) au cours de 2025 — sans toutefois avoir republié, à la date de rédaction, une mesure contrôlée équivalente pour le confirmer (METR, 24/02/2026).
- Conséquence pour cette matière : aucun chiffre de « taux de succès » ou de « gain de productivité » sur le code agentique ne doit être repris sans sa date ET sans préciser s'il vient de l'éditeur du produit (source intéressée) ou d'une mesure indépendante — et depuis quand cette mesure indépendante elle-même n'a pas été rejouée.
Sur la seule mesure contrôlée indépendante recensée, les développeurs se sont sentis plus rapides avec l'IA — alors que le temps réellement passé sur leurs tâches a augmenté. Un rappel : le ressenti n'est pas une mesure.
Repères clés
| Donnée | Valeur | Date | Source |
|---|---|---|---|
| GitHub Copilot — préversion technique / disponibilité générale | 29/06/2021 / 21/06/2022 | 2021-2022 | GitHub Blog, TechCrunch |
| GitHub Copilot — Agent Mode en disponibilité générale (VS Code) | 04/2025 | 2025 | GitHub Blog |
| Claude Code — bêta / disponibilité générale | 24/02/2025 / 22/05/2025 | 2025 | Anthropic |
| Terme « vibe coding » (Karpathy) | 02/02/2025 | 2025 | X (publication originale) |
| « Vibe coding », mot de l'année Collins Dictionary | 2025 | 06/11/2025 | CNN |
| Model Context Protocol — ouvert par Anthropic | 25/11/2024 | 2024 | anthropic.com |
| Anysphere (Cursor) — valorisation | 9,9 Md$ → 29,3 Md$ | 05/06/2025 → 13/11/2025 | TechCrunch, CNBC |
| METR — horizon de tâche réussie, doublement | ~7 mois (2019-2024) → ~4 mois (2024-2025) | 19/03/2025 | metr.org |
| METR — essai contrôlé développeurs expérimentés | -19 % de vitesse mesurée / +20 % perçue | 10/07/2025 | metr.org |
Idées reçues
- « L'IA rend systématiquement les développeurs plus rapides » — Contredit par la seule mesure contrôlée indépendante recensée dans cette recherche : ralentissement de 19 % mesuré chez des développeurs expérimentés sur leurs propres projets matures (METR, 10/07/2025) — à ne pas généraliser non plus : échantillon réduit (16 développeurs, 246 tâches), et METR elle-même juge probable une évolution depuis.
- « Les chiffres d'adoption communiqués par un éditeur mesurent la qualité de l'outil » — Non : ils mesurent l'adoption commerciale (utilisateurs, abonnés), pas la fiabilité ni le gain de productivité réel — les deux ne sont pas la même chose dans les sources rassemblées ici.
- « Le code produit par un agent IA n'a plus besoin d'être relu » — C'est la définition même du « vibe coding » telle que décrite par son inventeur, présentée par lui comme une pratique assumée pour du code expérimental ou jetable — pas une recommandation d'usage professionnel généralisé, et cette matière n'en formule aucune.
- « Un chiffre de valorisation d'une entreprise de ce secteur est stable dans le temps » — Faux : la valorisation d'Anysphere (Cursor) a triplé en cinq mois sur la seule période mesurée ici (05/06/2025 → 13/11/2025) — un cas d'école de donnée famille (c), à revérifier avant toute réutilisation.
Questions fréquentes de débutants
Réponds mentalement avant d'ouvrir : c'est l'effort de rappel qui ancre, pas la relecture.
Un agent de code peut-il vraiment corriger ses propres erreurs sans aide ?
Certains outils (par exemple GitHub Copilot Agent Mode, décrit par GitHub comme capable de « self-healing ») sont conçus pour itérer automatiquement sur une erreur détectée, mais il s'agit d'une capacité annoncée par l'éditeur, pas d'une garantie universelle — à vérifier tâche par tâche.
MCP, c'est un produit ou un standard ?
Un standard ouvert (protocole de communication), pas un produit commercial : n'importe quel éditeur peut l'implémenter, ce qui explique son adoption par plusieurs concurrents en l'espace d'un an.
Le 'vibe coding' est-il la même chose qu'un usage professionnel d'agent de code ?
Non : le terme, tel qu'employé par son inventeur, décrit une pratique où le développeur ne relit plus le code produit ; les usages professionnels documentés ici (Copilot en entreprise, Claude Code) reposent au contraire sur des étapes de test et de validation.
Pourquoi une étude dit que l'IA ralentit les développeurs alors que le discours ambiant dit l'inverse ?
Parce qu'il s'agit de la seule mesure contrôlée indépendante recensée dans cette recherche : les autres chiffres circulant sur le sujet proviennent le plus souvent des éditeurs eux-mêmes ou de déclarations spontanées, deux sources qui tendent structurellement à sous-estimer les frictions réelles.
Plutôt que de câbler chaque outil un par un à chaque source de données, un standard ouvert laisse un agent se brancher de la même façon sur des fichiers, des bases de données ou des API.
Pièges & points de vigilance
- Distinguer systématiquement un chiffre d'adoption (combien de personnes utilisent l'outil) d'un chiffre de performance (l'outil fonctionne-t-il bien) — les deux sont fréquemment confondus dans la communication commerciale.
- Un chiffre de valorisation ou de levée de fonds d'une entreprise de ce secteur périme en quelques semaines : ne jamais le citer sans date précise, ni le présenter comme à jour.
- La seule mesure indépendante contrôlée disponible dans cette recherche (METR, 10/07/2025) porte sur des développeurs déjà experts de leur propre code, sur des tâches réelles en dépôt mature, avec des outils disponibles entre février et juin 2025 : elle ne dit rien d'un débutant, d'un projet neuf, ni des outils sortis après cette fenêtre — bornes rappelées par METR elle-même.
- « Self-healing », « autonome », « agentique » sont des mots choisis par les équipes marketing des éditeurs : vérifier la fonctionnalité technique précise décrite derrière le mot avant de le reprendre tel quel.
- Ce module est le plus mince du bloc côté corpus Tech Café (axe le plus étroit d'un bloc déjà resserré) — cohérent avec un sujet réellement récent : l'essentiel des jalons datés ci-dessus se concentre sur 2024-2026, pas un signe de sous-traitement éditorial.
Sources
- GitHub Blog — GitHub Copilot is generally available to all developers — 21/06/2022, consulté le 20/07/2026
- GitHub Blog — GitHub Copilot: The agent awakens — consulté le 20/07/2026
- Anthropic — Claude Code (page produit) — consulté le 20/07/2026
- Andrej Karpathy — publication originale « vibe coding » — 02/02/2025, consulté le 20/07/2026
- CNN — 'Vibe coding' named Collins Dictionary's Word of the Year — 06/11/2025, consulté le 20/07/2026
- Anthropic — Introducing the Model Context Protocol — 25/11/2024, consulté le 20/07/2026
- METR — Measuring AI Ability to Complete Long Tasks — 19/03/2025, consulté le 20/07/2026
- METR — Measuring the Impact of Early-2025 AI on Experienced Open-Source Developer Productivity — 10/07/2025, consulté le 20/07/2026
- METR — We are Changing our Developer Productivity Experiment Design — 24/02/2026, consulté le 20/07/2026
- TechCrunch — Cursor's Anysphere nabs $9.9B valuation, soars past $500M ARR — 05/06/2025, consulté le 20/07/2026
- CNBC — AI startup Cursor raises $2.3 billion funding round at $29.3 billion valuation — 13/11/2025, consulté le 20/07/2026