De agent volgt een vaste structuur in plaats van meteen tests te genereren :
Het RPI-proces bestaat uit drie stappen: Research, Plan en Implement .
De agent voert voor elke gegenereerde test een lichte vorm van mutatietesten en kwaliteitsborging uit :
Zo wordt gegarandeerd dat een test die 'slaagt' ook echt zinvol is en gevonden wordt in de CI-omgeving . De agent schrijft unit-tests die de te testen code isoleren en externe services en andere afhankelijkheden 'mocken' .
De agent wordt geleverd als de dotnet-test-plugin in de MIT-gelicentieerde dotnet/skills-repository op GitHub . Hij werkt met :
Omdat het een agentdefinitie is en geen gehoste service, draait hij in elke codeeragent die een team al gebruikt. De code blijft lokaal en gaat niet via een externe service .
Op Microsofts interne benchmark van 152 taken voltooide de code-testing-generator-agent 140 taken (92,1%) tegenover 120 taken (78,9%) voor standaard GitHub Copilot . Dit prestatieverschil onderstreept het voordeel van een gespecialiseerde agent die eerst de codebase onderzoekt voordat hij tests genereert, in plaats van te vertrouwen op een algemene prompt .