Enjeux techniques et humains de l'IA

Outils actuels / code

Code assisté par IA
du copilote aux agents

Panorama 2026 : agents, IDE, open source et vibe coding

En 2026, on ne demande plus à l'IA de compléter une ligne : on délègue à des agents des tâches de plusieurs heures, dans le terminal, l'IDE ou le cloud. L'essentiel du travail humain devient cadrer, relire et sécuriser. Ce panorama recense les outils et leurs prix (relevés en septembre 2026), les standards qui les rendent interchangeables, ce que mesurent vraiment les benchmarks et les études de productivité, et les nouveaux risques de sécurité.

Agents cloudTerminal & IDEVibe codingStandards ouvertsSécurité
Une développeuse au centre relit les pull requests remontées par plusieurs agents qui travaillent en parallèle (terminal, IDE, cloud, navigateur).
84 %
des développeurs utilisent l'IA
…ou prévoient de le faire, mais 46 % se méfient de son exactitude (Stack Overflow, juillet 2025).
17 h
Horizon de tâche des agents
Tâches réussies une fois sur deux, contre ~1 h début 2025 ; intervalle 8,5-55 h, mesure peu fiable au-delà de 16 h (METR, 2026).
58 %
Meilleur score Terminal-Bench 4.0
≈ 61 % sur SWE-bench Pro : les tests exigeants laissent encore de la marge (septembre 2026).
45 %
du code généré a une faille
Échantillons contenant une faille du Top 10 OWASP, plus de 100 modèles testés (Veracode, juillet 2025).
Claude CodeAnthropicCodexOpenAIDevin / Devin DesktopCognitionGemini CLI / JulesGoogleAmpAmpGitHub CopilotGitHub (Microsoft)CursorAnysphere (SpaceX)Google AntigravityGoogleKiroAWSJunieJetBrainsOpenCodeAnomalyClineClineOpenHandsOpenHandsMistral VibeMistral AI (France)ZedZed IndustriesLovableLovable (Suède)v0VercelBoltStackBlitzReplit AgentReplit
Du copilote à l'agent / 01

De la ligne suggérée au ticket délégué

Trois générations d'outils coexistent. Ce qui change à chaque étape : la durée de la tâche confiée et le moment où l'humain intervient.

Depuis 2026, on ne « chatte » plus seulement avec un agent dans son éditeur : on lui confie un ticket, qu'il traite seul dans une machine virtuelle, puis on reçoit une pull request à relire. GitHub (Copilot cloud agent, qui peut aussi lancer Claude ou Codex), OpenAI (Codex cloud), Google (Jules), Cursor (cloud agents), Devin, Amp et OpenHands proposent ce mode. Le développeur pilote plusieurs agents en parallèle, comme un chef d'équipe.
Historique

Complétion (2021-2023)

  • L'outil suggère la ligne ou le bloc suivant, à la manière du premier GitHub Copilot.
  • Toujours présente (complétion illimitée sur les plans payants de Copilot, « Tab » de Cursor), mais devenue une brique parmi d'autres.
  • L'humain écrit ; l'IA accélère la frappe.
Généralisé

Agent local (2025)

  • Dans le terminal ou l'IDE, l'agent lit le dépôt, planifie, modifie plusieurs fichiers, lance les tests et itère jusqu'à un résultat qui fonctionne.
  • Exemples : Claude Code, Codex CLI, Gemini CLI, Cursor, Cline, OpenCode.
  • L'humain suit la session et relit les modifications.
Nouveau

Agent cloud asynchrone (2026)

  • On délègue un ticket ; l'agent travaille seul dans une VM distante et rend une pull request.
  • Plusieurs agents tournent en parallèle sur plusieurs tickets (jusqu'à 10 sur Replit Pro, par exemple).
  • L'humain cadre la tâche en amont et relit en aval.
Supervision

Qui valide les actions ?

  • Permissions : l'agent demande l'accord de l'humain avant chaque commande sensible.
  • Mode « auto » : un classifieur valide les actions à la place de l'humain. Il est activé par défaut dans Claude Code depuis le 14 août 2026 (Pro, Max, Team).
  • Bac à sable : l'agent agit librement, mais dans un environnement isolé, sans secrets ni accès réseau large.
Frise horizontale de l'autonomie des outils de code : complétion de ligne (2021), chat (2023), agent dans l'IDE (2025), agent cloud asynchrone (2026) ; au-dessus, une courbe montante de la durée des tâches confiées, des minutes à une quinzaine d'heures.
La durée des tâches confiées aux agents s'allonge très vite ; la fiabilité, elle, progresse moins vite.
Catalogue / 02

Les outils qui comptent en 2026

Quatre familles, de l'agent en ligne de commande à l'app builder. Prix mensuels indicatifs en dollars, relevés en septembre 2026 : ils changent presque chaque mois.

▽ Agents de code (terminal et cloud) — 05 outils

Claude CodeAnthropic · fermé

Agent de référence, disponible dans le terminal, l'IDE, l'application de bureau, le web et Slack. Il lit un dépôt entier, modifie plusieurs fichiers, lance les tests, gère git et délègue à des sous-agents ; extensible par MCP et Agent Skills. Selon Anthropic, il signait environ 4 % des commits publics de GitHub en février 2026.

Inclus dans Pro 20 $, Max 100/200 $, Team 25/125 $ par siège ; ou APIconsulter →
CodexOpenAI · CLI open source + service

L'agent de code d'OpenAI, intégré à ChatGPT : application de bureau, web, CLI open source (Apache 2.0), extension IDE et exécution dans le cloud pour les tâches longues. Les variantes « -Codex » ont été retirées : Codex tourne sur GPT-5.6 et, en déploiement progressif depuis le 3 septembre 2026, sur GPT-6 Astra.

Inclus dans les offres ChatGPT (accès variable selon le plan) ; ou APIconsulter →
Devin / Devin DesktopCognition · fermé

« Ingénieur logiciel » autonome qui traite un ticket jusqu'à la pull request, décliné en quatre surfaces : Desktop (l'ex-Windsurf, renommé le 2 juin 2026), Cloud, CLI et Review. Un tableau Kanban permet de suivre plusieurs agents à la fois.

Free ; Pro 20 $ ; Max 200 $ ; Teams 80 $ + 40 $/utilisateurconsulter →
Gemini CLI / JulesGoogle · CLI open source / agent cloud

Gemini CLI est l'agent de terminal open source de Google (Apache 2.0, ≈ 107 000 étoiles GitHub) : 60 requêtes/min et 1 000 requêtes/jour gratuites avec un compte Google, compatible Agent Skills. Jules, son pendant asynchrone, clone un dépôt GitHub dans une VM, propose un plan puis ouvre une pull request.

Gratuit (quotas) ; Jules : 15 tâches/jour, puis 100 (Pro) ou 300 (Ultra)consulter →
AmpAmp · fermé

Chaque tâche tourne dans une machine distante (« orb ») que l'on suit depuis le web, le terminal ou le téléphone, et que l'on peut partager à plusieurs. Gratuit depuis le 13 septembre 2026 si l'on apporte sa propre puissance de calcul et ses abonnements.

Gratuit avec ses propres calculs et clés ; sinon à l'usageconsulter →

▽ IDE et assistants intégrés — 05 outils

GitHub CopilotGitHub (Microsoft) · fermé

Présent dans presque tous les IDE (VS Code, Visual Studio, JetBrains, Neovim…). Son agent cloud prend un ticket et ouvre une pull request, et peut aussi lancer Claude ou Codex. Depuis le 1er juin 2026, tous les plans sont facturés en « GitHub AI Credits » (1 crédit = 0,01 $) ; la complétion reste illimitée sur les plans payants.

Free ; Pro 10 $ ; Pro+ 39 $ ; Max 100 $ (crédits IA) ; Business / Enterpriseconsulter →
CursorAnysphere (SpaceX) · fermé

L'IDE IA le plus répandu : complétion prédictive, mode agent, agents cloud en parallèle. Racheté par SpaceX (annonce du 14 août 2026), il met en avant les modèles Grok (Grok 4.6, coentraîné) tout en gardant l'accès aux modèles tiers, un point à peser pour la confidentialité et la souveraineté.

Hobby gratuit ; Pro 20 $ ; Pro+ 60 $ ; Ultra 200 $ ; Teams 40 $/utilisateurconsulter →
Google AntigravityGoogle · fermé

Lancé le 20 novembre 2025 avec Gemini 3 : un gestionnaire d'agents qui travaillent en parallèle et produisent des « artefacts » vérifiables (captures d'écran, enregistrements du navigateur). Modèles Gemini 3.x, Claude Sonnet/Opus 4.6 et gpt-oss-120b ; offre Organisation via Google Cloud.

Gratuit (quotas hebdomadaires) ; limites étendues avec Google AI Pro / Ultraconsulter →
KiroAWS · fermé

IDE et CLI agentiques d'AWS, centrés sur le « développement piloté par les spécifications » : l'agent rédige d'abord les exigences, la conception et les tâches, puis code. Successeur d'Amazon Q Developer, dont les plugins IDE s'arrêtent le 30 avril 2027.

Free ; Pro 20 $ ; Pro+ 40 $ ; Pro Max 100 $ ; Power 200 $consulter →
JunieJetBrains · fermé, multi-modèles

Agent de JetBrains bâti sur le moteur d'IntelliJ, disponible dans les IDE JetBrains, en CLI et en CI (GitHub Actions, GitLab). Plus de dix modèles au choix, dont Claude, Gemini, GPT-6 Astra et Grok, ou sa propre clé d'API.

Inclus dans JetBrains AI Pro (≈ 8,33 $ en annuel) et AI Ultimate (25 $)consulter →

▽ Open source et agnostiques du modèle — 05 outils

OpenCodeAnomaly · open source (MIT)

L'agent de terminal open source le plus suivi (≈ 208 000 étoiles GitHub), compatible avec la plupart des fournisseurs de modèles et avec les Agent Skills. Il a pris la place de référence qu'occupait Aider.

Gratuit (modèles à l'usage)consulter →
ClineCline · open source

Extension VS Code, application de bureau, CLI et SDK : l'agent lit et écrit les fichiers, exécute des commandes et se connecte aux serveurs MCP, avec le modèle de son choix, y compris local.

Gratuit (modèles à l'usage)consulter →
OpenHandsOpenHands · open source

Ex-OpenDevin : plateforme d'agents logiciels auto-hébergeable, désormais tournée vers les agents cloud à grande échelle (v1.20, 17 septembre 2026). Le dépôt a migré vers l'organisation GitHub « OpenHands ».

Gratuit (auto-hébergé) ; offre cloud payanteconsulter →
Mistral VibeMistral AI (France) · open source

Assistant de code en ligne de commande (Apache 2.0) qui s'appuie sur les modèles de Mistral. Une option européenne pour les organisations attentives à la souveraineté ; ses performances ne figurent pas encore dans les classements publics consultés.

Gratuit (API Mistral à l'usage)consulter →
ZedZed Industries · éditeur open source

Éditeur écrit en Rust, rapide et collaboratif, qui accueille les agents externes (Claude Agent, Codex CLI) via le protocole ACP. L'offre gratuite inclut 2 000 prédictions et l'usage illimité de ses propres clés ou agents externes.

Gratuit ; Pro 10 $ ; Business 30 $/siègeconsulter →

▽ Encart : un secteur qui se concentre

En un an, rachats, fermetures et fins de support ont redessiné la carte. Choisir un outil, c'est aussi choisir un fournisseur de modèles, une juridiction et une politique de données.
  1. Juillet 2025Rachat

    Cognition rachète Windsurf

    Accord signé le 14 juillet 2025, quelques jours après le recrutement des dirigeants de Windsurf par Google (licence de 2,4 Md$). Montant non communiqué (la presse l'estime autour de 250 M$). Windsurf est devenu « Devin Desktop » le 2 juin 2026.
  2. Mai 2026Fermeture

    Roo Code ferme

    L'extension VS Code, le Cloud et le Router de Roo Code ont fermé le 15 mai 2026 ; l'équipe développe désormais Roomote, un agent cloud. Un signe du recul des extensions IDE face aux agents cloud.
  3. 2026Rachat

    Continue rejoint Cursor

    L'extension open source Continue a été rachetée par Cursor. Le code reste disponible, mais n'est plus développé (dernier commit le 20 juillet 2026).
  4. Août 2026Rachat

    SpaceX rachète Cursor

    Annonce du 14 août 2026, après un partenariat noué en avril. Cursor met désormais en avant les modèles Grok (Grok 4.6, 12 août 2026), tout en gardant les modèles tiers.
  5. Avril 2027Fin de support

    Amazon Q Developer s'efface

    AWS arrêtera le support des plugins IDE Amazon Q Developer (ex-CodeWhisperer) le 30 avril 2027 et oriente ses clients vers Kiro.
  6. ContrepointSouveraineté

    l'option européenne

    Face à des outils presque tous américains, Mistral Vibe (Mistral AI, France) et les agents open source branchés sur des modèles hébergés en Europe ou en local offrent une alternative, à évaluer sur ses propres cas d'usage.
Standards / 03

MCP, AGENTS.md, Skills : des briques communes

Pourquoi les outils deviennent en partie interchangeables.

Trois briques ouvertes structurent désormais l'écosystème : MCP relie l'agent aux outils et aux données, AGENTS.md décrit un dépôt pour les agents, les Agent Skills apportent des savoir-faire chargés à la demande. Une même configuration suit donc le développeur d'un agent à l'autre. Depuis le 9 décembre 2025, MCP, AGENTS.md et l'agent open source goose (créé par Block) sont gérés par l'Agentic AI Foundation, au sein de la Linux Foundation.
Outils & données

MCP (Model Context Protocol)

  • Protocole ouvert qui branche l'agent sur des outils et des sources de données : tickets, bases, navigateur, services internes.
  • Plus de 10 000 serveurs publiés fin 2025.
  • Chaque serveur est aussi une entrée à contrôler (voir Sécurité).
Contexte du dépôt

AGENTS.md

  • Fichier à la racine du dépôt qui explique aux agents comment le projet fonctionne : conventions, commandes de build et de test, règles à respecter.
  • Pris en charge par de nombreux agents, quel que soit l'éditeur.
Savoir-faire

Agent Skills (SKILL.md)

  • Dossiers d'instructions et de scripts chargés seulement quand la tâche en a besoin.
  • Format créé par Anthropic, adopté par Codex, Copilot, Cursor, Gemini CLI, Kiro, Junie et OpenCode.
Orchestration

Sous-agents et ACP

  • Un agent principal délègue des sous-tâches à des sous-agents spécialisés (exploration, tests, revue), chacun avec son propre contexte.
  • Le protocole ACP permet à un éditeur comme Zed d'accueillir des agents externes (Claude Agent, Codex CLI).
Mesurer / 04

Lire les benchmarks avec recul

Le score vedette de 2024 est saturé. Les indicateurs utiles en 2026 sont plus durs, et ils montrent qu'il reste de la marge.

SWE-bench Verified, longtemps cité, est saturé et contaminé. Les références actuelles sont SWE-bench Pro, Terminal-Bench 4.0 et l'horizon de tâches de METR.

▽ Les indicateurs de 2026

06 indicateurs

SWE-bench Verified

Saturé
Environ 500 vrais tickets GitHub (Python) validés par des humains, lancé mi-2024 avec OpenAI : les meilleurs systèmes passaient de 33 à 49 % cette année-là. Record : 93,9 % pour Claude Mythos Preview (avril 2026), un modèle non commercialisé. OpenAI a cessé de l'utiliser le 23 février 2026 : 59,4 % des échecs audités venaient de tests défectueux, et des modèles récitaient des correctifs mémorisés.

SWE-bench Pro

Référence
1 865 tâches dans 41 dépôts, dont des dépôts privés, multi-fichiers et multi-langages, conçues pour rester discriminantes. Meilleur score public : ≈ 61 % (classement Scale, septembre 2026).

Terminal-Bench 4.0

Référence
Des tâches réelles à accomplir en ligne de commande (Stanford et Laude Institute). Meilleurs scores : ≈ 58 %, pour GPT-6 Astra et Claude Fable 5.1 (septembre 2026).

Horizon de tâches (METR)

Tendance
La durée (chez un expert humain) des tâches qu'un agent réussit une fois sur deux : ~1 h pour Claude 3.7 Sonnet début 2025, ~17 h pour Claude Mythos Preview en avril 2026 (intervalle de 8,5 à 55 h). METR prévient que ses mesures au-delà de 16 h ne sont pas fiables.

Modèle ou harnais ?

À nuancer
Un score mesure la combinaison d'un modèle et d'un harnais agentique, l'outil qui lit le dépôt, exécute et itère. Le même modèle obtient des scores différents selon l'agent qui le pilote.

Ce que les scores ne disent pas

Regard critique
Lisibilité, sécurité, maintenabilité, respect de l'architecture existante : aucun benchmark ne les mesure bien. La contamination des données d'entraînement et la sur-optimisation restent des biais à surveiller.
Productivité réelle / 05

Ce que disent les études contrôlées

L'adoption est massive, mais le gain mesuré reste modeste et la confiance, faible.

Les chiffres d'adoption sont massifs, mais les mesures contrôlées sont beaucoup plus prudentes.
01Essai contrôlé

METR 2025 : plus lents qu'ils ne le pensaient

Essai randomisé sur 16 développeurs expérimentés et 246 tâches, dans leurs propres dépôts : avec les outils d'IA du début 2025, ils ont mis 19 % de temps en plus, alors qu'ils pensaient avoir gagné 20 %.
02Essai contrôlé

METR 2026 : le signe s'inverse

Suite publiée le 24 février 2026 (57 développeurs, plus de 800 tâches) : l'estimation penche vers un gain de 4 à 18 % de temps, mais l'intervalle de confiance inclut encore zéro. METR juge sa mesure biaisée à la baisse, car des développeurs refusent désormais de travailler sans IA.
03Enquête

DORA 2025 : l'IA amplifie

Environ 5 000 répondants (Google) : 90 % utilisent l'IA et plus de 80 % se disent plus productifs. Le débit de livraison progresse, mais la stabilité recule : l'IA amplifie les pratiques en place, bonnes comme mauvaises.
04Enquête

Stack Overflow 2025 : adoption sans confiance

84 % utilisent ou comptent utiliser l'IA (76 % en 2024) et 51 % des professionnels s'en servent chaque jour. Mais 46 % se méfient de l'exactitude des réponses (33 % leur font confiance), 66 % pestent contre des solutions « presque justes » et 72 % n'utilisent pas le vibe coding au travail.
Le vis-à-vis / 06

Déléguer plus, vérifier mieux

Ce que les agents apportent, face à ce qui doit rester sous contrôle.

✓Ce que les agents apportent

  • Déléguer des tâches entières

    Corrections de bugs, migrations, tests, documentation : l'agent planifie, modifie, teste et itère ; le développeur relit.

  • Travailler en parallèle

    Plusieurs agents cloud avancent sur plusieurs tickets à la fois ; le développeur répartit le travail et arbitre.

  • Explorer et apprendre

    Comprendre une base de code inconnue, découvrir une approche, prototyper en quelques minutes.

  • Ouvrir la création

    Les app builders permettent à des non-spécialistes de produire prototypes et outils internes.

  • Des outils interchangeables

    MCP, AGENTS.md et les Agent Skills limitent l'enfermement chez un éditeur.

!Ce qui doit rester sous contrôle

  • Le coût à l'usage

    Le modèle « abonnement + crédits » domine ; les tâches longues consomment vite. Les budgets se pilotent comme une ressource de calcul.

  • La dépendance fournisseur

    Marché concentré (Cognition, SpaceX-Cursor, grands clouds) : juridiction, confidentialité du code et pérennité de l'outil sont à évaluer.

  • Le coût de vérification

    Les solutions « presque justes » déplacent le temps gagné vers la relecture et les tests.

  • Les compétences

    Déléguer sans comprendre fragilise l'équipe, surtout les profils juniors.

  • La sécurité et la propriété intellectuelle

    Injection de prompt, dépendances piégées, code vulnérable ; origine et licence du code généré à tracer.

Sécurité / 07

L'agent, nouvelle surface d'attaque

Un agent lit des contenus non fiables et peut exécuter des commandes : les incidents de 2025-2026 montrent pourquoi relire, tester et isoler n'est pas optionnel.

Les agents de code lisent des contenus non fiables (tickets, pages web, dépendances, serveurs MCP) et peuvent exécuter des commandes, lire des secrets et pousser du code. Chaque entrée devient un vecteur d'attaque possible.
01Attaque

Injection de prompt

Novembre 2025 : une instruction cachée dans une page web a conduit Antigravity à exfiltrer des identifiants AWS. Mars 2026 : un ticket GitHub piégé a détourné le bot de tri de Cline (« Clinejection ») jusqu'à la publication d'une version npm malveillante.
02Attaque

Chaîne d'approvisionnement

Juillet 2025 : une version piégée de l'extension Amazon Q Developer pour VS Code (1.84.0) embarquait un prompt destructeur (AWS bulletin AWS-2025-015). Août 2025 : le paquet Nx compromis (« s1ngularity ») a tenté de faire chercher des secrets par les CLI d'IA installées sur les postes.
03Qualité

Code vulnérable

Selon Veracode (juillet 2025, plus de 100 modèles testés), 45 % des échantillons de code générés introduisent une faille du Top 10 OWASP, et les modèles récents ne font pas mieux que les anciens.
04Qualité

Paquets inventés (slopsquatting)

Les LLM inventent des noms de paquets : au moins 5,2 % des suggestions pour les modèles commerciaux et 21,7 % pour les modèles ouverts (USENIX Security 2025). Des attaquants enregistrent ces noms pour y placer du code malveillant.
05Incident

Incidents de vibe coding

Des applications Lovable mal configurées ont exposé leurs bases de données (CVE-2025-48757, contestée par l'éditeur). En juillet 2025, l'agent de Replit a supprimé la base de production d'un utilisateur pendant un gel du code.
06Supervision

Le mode « auto » en question

Laisser un classifieur valider les actions réduit la fatigue d'approbation, mais des démonstrations de contournement du mode « auto » de Claude Code ont été publiées fin août 2026. Un tel mode ne remplace pas un bac à sable.
Schéma de la surface d'attaque d'un agent de code : au centre l'agent ; à gauche ses entrées non fiables (ticket, page web, dépendance npm, serveur MCP) ; à droite ses sorties sensibles (shell, secrets, git push) ; entre les deux, trois garde-fous (bac à sable, permissions, revue humaine).
Entrées non fiables, sorties sensibles : les garde-fous se placent entre les deux.

▽ À retenir

Relire, tester, isoler : les garde-fous

  1. 01Faire tourner l'agent dans un bac à sable (conteneur ou VM) plutôt que sur le poste de travail.
  2. 02Restreindre le réseau et n'autoriser que les domaines nécessaires.
  3. 03Isoler les secrets : pas de clés de production accessibles à l'agent.
  4. 04Accorder des permissions minimales et limiter les serveurs MCP à des sources de confiance.
  5. 05Vérifier l'existence et la réputation de chaque dépendance ajoutée.
  6. 06Exiger une revue humaine, des tests et une analyse de sécurité avant toute fusion.
Archive / 08

Ce qui a été dépassé

Des repères de 2021-2025 encore cités, mais dépassés, fermés ou rachetés.

▽ Concepts précédents (archive)

Complétion de ligne (2021-2023). Le paradigme historique : l'outil suggère la ligne ou le bloc suivant, à la manière du premier GitHub Copilot. Toujours présent, il n'est plus qu'une brique face aux modes agentiques.

Éditeurs « Canvas ». ChatGPT Canvas et les espaces d'édition intégrés aux chatbots servaient au prototypage ponctuel. ChatGPT Canvas a été retiré en mai 2026 ; ces usages passent désormais par les agents et les app builders.

CodeWhisperer → Amazon Q Developer → Kiro. L'assistant de code d'AWS, lancé sous le nom CodeWhisperer, est devenu Amazon Q Developer, dont les plugins IDE ne seront plus supportés après le 30 avril 2027. AWS oriente vers Kiro.

Windsurf. L'IDE de Codeium, racheté par Cognition en juillet 2025, est devenu Devin Desktop le 2 juin 2026.

Aider. Pionnier de la programmation en binôme dans le terminal (édition multi-fichiers couplée à git), toujours utilisable, mais quasi à l'arrêt : dernière version v0.86.0 le 9 août 2025. OpenCode a pris sa place de référence open source.

Roo Code et Continue. Deux extensions open source très utilisées en 2025 : Roo Code a fermé le 15 mai 2026 (l'équipe développe Roomote, un agent cloud) ; Continue a été racheté par Cursor et n'est plus développé.

Tabnine. Pionnier de la complétion par IA, toujours actif et compatible avec les Agent Skills. Il reste pertinent pour les besoins de confidentialité et de déploiement sur site, mais pèse peu face aux agents.

Statistiques 2023 (Stack Overflow). En 2023, environ 70 % des développeurs utilisaient ou prévoyaient d'utiliser l'IA. Parmi les utilisateurs d'outils d'IA de développement, 54,8 % utilisaient GitHub Copilot ; parmi les outils de recherche IA, ChatGPT était cité par 83 %. En 2025, l'adoption atteint 84 %, mais seuls 3 % des développeurs font « très confiance » aux réponses.

Références / 09

Sources et références

  1. [01]Stack Overflow – Developer Survey 2025, section IA
  2. [02]Stack Overflow – Developer Survey 2023, section IA
  3. [03]METR – Task-Completion Time Horizons of Frontier AI Models (mai 2026)
  4. [04]METR – Impact of Early-2025 AI on Experienced Open-Source Developer Productivity (juil. 2025)
  5. [05]METR – Mise à jour de l'étude de productivité (24 févr. 2026)
  6. [06]Google Cloud – Announcing the 2025 DORA report
  7. [07]Terminal-Bench 4.0 – classement (Stanford / Laude Institute)
  8. [08]Deng et al. – SWE-Bench Pro (arXiv 2509.16941)
  9. [09]Scale AI – Classement SWE-bench Pro (public)
  10. [10]OpenAI – Why SWE-bench Verified no longer measures frontier coding capabilities
  11. [11]Anthropic – Project Glasswing / Claude Mythos Preview (avr. 2026)
  12. [12]Anthropic – Claude 3.5 Sonnet et computer use (oct. 2024)
  13. [13]Claude – Claude Code
  14. [14]Claude – Tarifs
  15. [15]Claude – Auto mode par défaut dans Claude Code
  16. [16]Anthropic – Série G (Claude Code, ~4 % des commits publics GitHub, févr. 2026)
  17. [17]OpenAI – Modèles Codex
  18. [18]9to5Mac – GPT-6 Astra dans ChatGPT et Codex (4 sept. 2026)
  19. [19]GitHub Changelog – Updates to GitHub Copilot billing and plans (1er juin 2026)
  20. [20]GitHub – Offres Copilot
  21. [21]Cursor – Tarifs
  22. [22]Cursor – Cursor is now a part of SpaceX (14 août 2026)
  23. [23]Continue – Continue has joined Cursor
  24. [24]Devin – Windsurf is now Devin Desktop (2 juin 2026)
  25. [25]Devin – Tarifs
  26. [26]CNBC – Cognition to buy AI startup Windsurf (14 juil. 2025)
  27. [27]Google Developers Blog – Build with Google Antigravity (20 nov. 2025)
  28. [28]Google – Gemini CLI (dépôt GitHub)
  29. [29]Google – Jules
  30. [30]Kiro – Tarifs
  31. [31]AWS – Amazon Q Developer (fin du support des plugins IDE)
  32. [32]JetBrains – Junie
  33. [33]OpenCode (dépôt GitHub)
  34. [34]Amp – Manuel
  35. [35]Cline
  36. [36]OpenHands – Releases
  37. [37]Zed – Tarifs
  38. [38]Mistral AI – Mistral Vibe (dépôt GitHub)
  39. [39]The New Stack – Roo Code pivots to cloud-based agent
  40. [40]Aider – Releases GitHub
  41. [41]Lovable – Tarifs
  42. [42]v0 – Tarifs
  43. [43]Bolt – Tarifs
  44. [44]Replit – Tarifs
  45. [45]Linux Foundation – Formation of the Agentic AI Foundation (9 déc. 2025)
  46. [46]Agent Skills – standard ouvert et clients compatibles
  47. [47]Veracode – 2025 GenAI Code Security Report
  48. [48]Spracklen et al. – We Have a Package for You! (USENIX Security 2025)
  49. [49]Nx – s1ngularity postmortem (août 2025)
  50. [50]AWS – Security Bulletin AWS-2025-015 (Amazon Q Developer 1.84.0)
  51. [51]Adnan Khan – Clinejection (mars 2026)
  52. [52]Simon Willison – Google Antigravity exfiltrates data (nov. 2025)
  53. [53]Simon Willison – Breaking Claude Code Opus 5 auto mode (août 2026)
  54. [54]NVD – CVE-2025-48757 (Lovable)
  55. [55]Fortune – L'agent Replit supprime une base de production (juil. 2025)