← Toutes les actualités

Développement

Agents de code : Microsoft publie un guide pour comprendre leurs erreurs

Le guide AX de Microsoft propose une méthode pour évaluer les agents de programmation, comprendre leurs erreurs et tester des corrections à la source.

Par Rédaction AUVR Studio3 min de lecture
Ordinateur portable ThinkPad T14 sur un bureau, photographie d’illustration du travail informatique.

Microsoft a publié le 9 octobre 2026 l’AX Practitioner Playbook, un guide destiné aux équipes qui veulent comprendre comment les agents de programmation utilisent leurs technologies. L’objectif : repérer les erreurs, remonter à leur origine et tester des corrections dans la documentation ou les outils proposés aux agents. [1]

Comprendre les erreurs, pas seulement noter le code

Un résultat plausible ne prouve pas qu’un programme fonctionne. Microsoft recommande de vérifier l’exécution du code et de définir des critères adaptés au produit évalué. Le guide distingue notamment une extension absente, une extension disponible mais ignorée, et une extension utilisée incorrectement : ces situations n’appellent pas la même correction. [1]

La méthode s’adresse aux responsables de bibliothèques logicielles, d’API, de services et d’extensions. Elle n’impose pas un système d’évaluation particulier. Microsoft l’accompagne d’une compétence réutilisable, ou « skill », permettant d’interroger le contenu du guide. Ces ressources constituent une méthode de travail, pas une garantie de fiabilité de chaque réponse d’IA. [1]

Un exemple concret avec la plateforme Scope

Pour comprendre ce type d’évaluation, la documentation de Scope, le projet open source de Microsoft, présente un exemple de gestionnaire de tâches. On y vérifie séparément les fonctions demandées, la compilation et l’exécution des tests. Un test du comportement avec une saisie vide ne doit pas être considéré comme réussi si les tests n’ont même pas pu s’exécuter. [2]

Scope propose de conserver la configuration de l’agent dans des profils versionnés et d’examiner les étapes de son travail. On peut ainsi comparer un fonctionnement de référence avec une variante, par exemple l’ajout d’instructions spécialisées. Attention : la démonstration publique utilise des données fictives. Ses scores ne constituent ni un classement réel des agents ni des mesures de performance. Cette documentation apporte du contexte ; elle n’est pas présentée comme une nouvelle annonce du 9 octobre. [2]

Ce que les équipes peuvent en retenir

Un point de départ raisonnable consiste à choisir une tâche fréquente et bien délimitée : ajouter un formulaire, intégrer une API ou mettre à jour une dépendance. Avant de demander le travail à l’agent, l’équipe peut écrire ce qu’elle attend et les preuves nécessaires pour accepter le résultat. C’est une proposition pratique de la rédaction, non un résultat d’essai de ces outils.

L’enjeu est de conserver une trace explicable des décisions. Une belle réponse dans la conversation et une fonctionnalité réellement utilisable sont deux choses différentes. Le développeur reste responsable de la validation finale, notamment avant de déployer le code dans un service utilisé par ses clients.

Sources et références

[1] Microsoft — Annonce du guide AX, Waldek Mastykarz, 9 octobre 2026.

[2] Microsoft Scope — Fonctionnement et démonstration, documentation de contexte sans date affichée. Sources consultées le 10 octobre 2026.

Crédit photographique

Photo d’illustration d’archive : ThinkPad T14, Edvard10, 18 mai 2023. Cette photographie ne montre pas une démonstration du guide ou de Scope. Photographie originale sous CC0 1.0. Version redimensionnée à 1 280 × 960 pixels, sans recadrage ajouté.