O agente segue um pipeline estruturado em vez de sair gerando testes de imediato :
O processo RPI tem três etapas: Pesquisa, Planejamento e Implementação .
O agente realiza uma forma leve de teste de mutação e garantia de qualidade em cada teste gerado :
Isso assegura que um teste "aprovado" seja realmente significativo e detectável na esteira de CI . O agente escreve testes unitários que isolam o código sob teste e simulam (mockam) serviços externos e outras dependências .
O agente é distribuído como o plugin dotnet-test dentro do repositório dotnet/skills no GitHub, sob licença MIT . Ele funciona com :
Por ser distribuído como uma definição de agente e não como um serviço hospedado, ele roda dentro do agente de codificação que a equipe já utiliza, mantendo o código local e sem precisar enviá-lo a um serviço externo .
No benchmark interno da Microsoft com 152 tarefas, o agente code-testing-generator concluiu 140 tarefas (92,1%) contra 120 tarefas (78,9%) do GitHub Copilot padrão . Essa diferença de desempenho destaca a vantagem de um agente especializado que pesquisa o código antes de gerar testes, em vez de depender de um prompt genérico .