ในการทดสอบภายในบริษัทกับโจทย์ 152 งาน agent ตัวนี้ทำสำเร็จถึง 140 งาน คิดเป็นอัตราความสำเร็จ 92.1% ซึ่งสูงกว่าการใช้ Copilot ปกติที่ทำได้ 120 งาน หรือ 78.9% อย่างไรก็ตาม ปัจจุบัน agent นี้เขียนได้เฉพาะ unit tests เท่านั้น ไม่รวมถึง integration tests, end-to-end tests, browser tests และ performance tests
agent นี้ทำงานผ่านขั้นตอนที่เป็นระบบ :
กระบวนการ RPI ประกอบด้วยสามขั้นตอน: ค้นคว้า (Research), วางแผน (Plan), และเขียน (Implement)
agent จะทำการกลายพันธุ์โค้ดแบบเบาและตรวจสอบคุณภาพกับทุกๆ เทสต์ที่สร้างขึ้น :
วิธีนี้ช่วยให้เทสต์ที่ "ผ่าน" นั้นมีความหมายและถูกค้นพบได้ใน CI agent นี้เขียน unit tests ที่แยกโค้ดที่กำลังทดสอบและ mock บริการภายนอกและ dependency อื่นๆ
agent นี้มาพร้อมในรูปแบบ dotnet-test plugin ที่อยู่ใน repository dotnet/skills บน GitHub ภายใต้สัญญาอนุญาต MIT รองรับ :
เนื่องจากเป็น agent definition ไม่ใช่ hosted service มันจึงทำงานภายใน coding agent ที่ทีมใช้อยู่แล้ว โดยโค้ดจะอยู่ภายในเครื่อง ไม่ต้องส่งผ่านบริการภายนอก
ในการทดสอบภายในของ Microsoft กับโจทย์ 152 งาน agent code-testing-generator ทำสำเร็จ 140 งาน (92.1%) ในขณะที่ GitHub Copilot ทั่วไปทำสำเร็จ 120 งาน (78.9%) ช่องว่างของประสิทธิภาพนี้ชี้ให้เห็นถึงข้อได้เปรียบของ agent ที่ถูกออกแบบมาเฉพาะทาง ซึ่งค้นคว้า codebase ก่อนที่จะสร้างเทสต์ แทนที่จะพึ่งพา prompt ทั่วไป