Agent nie generuje testów od razu – zamiast tego stosuje ustrukturyzowany potok :
Proces RPI składa się z trzech kroków: Research (badanie), Plan (planowanie) i Implement (implementacja) .
Agent wykonuje lekką formę testowania mutacyjnego i kontroli jakości nad każdym wygenerowanym testem :
Dzięki temu test, który „przechodzi”, jest faktycznie znaczący i wykrywalny w CI . Agent pisze testy jednostkowe, które izolują testowany kod i mockują usługi zewnętrzne oraz inne zależności .
Agent jest dostarczany jako wtyczka dotnet-test w repozytorium dotnet/skills na GitHubie, udostępnionym na licencji MIT . Działa z :
Ponieważ jest dostarczany jako definicja agenta, a nie usługa hostowana, działa wewnątrz dowolnego agenta kodującego, którego zespół już używa, a kod pozostaje lokalny, zamiast być przesyłany do zewnętrznej usługi .
W wewnętrznym teście Microsoftu na 152 zadaniach, agent code-testing-generator ukończył 140 zadań (92,1%), podczas gdy standardowy GitHub Copilot wykonał 120 zadań (78,9%) . Ta różnica w wydajności podkreśla przewagę wyspecjalizowanego agenta, który bada bazę kodu przed wygenerowaniem testów, zamiast polegać na ogólnym prompcie .