L'agent suit un pipeline structuré en quatre grandes étapes, plutôt que de générer les tests immédiatement :
Le processus RPI se décompose donc en trois phases : Recherche, Planification et Implémentation .
L'agent effectue une forme légère de mutation testing et d'assurance qualité sur chaque test généré :
Cette approche garantit qu'un test "réussi" est réellement pertinent et détectable dans l'intégration continue (CI) . L'agent écrit des tests unitaires qui isolent le code testé et simulent (mockent) les services externes et autres dépendances .
L'agent est fourni sous forme du plugin dotnet-test dans le dépôt dotnet/skills sur GitHub, sous licence MIT . Il fonctionne avec :
Étant distribué comme une définition d'agent plutôt qu'un service hébergé, il s'exécute dans l'agent de codage que l'équipe utilise déjà, le code restant local et ne transitant pas par un service externe .
Sur le benchmark interne de Microsoft composé de 152 tâches, l'agent code-testing-generator a accompli 140 tâches (92,1 %) contre 120 tâches (78,9 %) pour GitHub Copilot standard . Cet écart de performance souligne l'avantage d'un agent spécialisé qui étudie le code avant de générer les tests, par opposition à une invite générique .