ASSERT (Adaptive Spec driven Scoring for Evaluation and Regression Testing) är ett ramverk med öppen källkod som förvandlar beteenderegler skrivna på vanlig svenska till körbara, poängsatta testsviter som fångar polic... Ramverket genererar utmanande scenarier, loggar varje verktygsanrop och levererar poängsatta dia...

Create a landscape editorial hero image for this Studio Global article: What is Microsoft's ASSERT framework, announced at Build 2026, and how does it convert natural-language AI behavior policies into structured. Article summary: Here is a concise answer based on the official Microsoft sources and trusted reporting.. Topic tags: general, general web. Reference image context from search candidates: Reference image 1: visual subject "# Build agents you can trust across any framework with open evals and a control standard. The gap is concrete: written policies do not translate into working runtime controls, eval" source context "Build agents you can trust across any framework with open evals ..." Reference image 2: visual subject "# Microsoft is making AI behavior testing easier for developers. Microsoft has released ASSERT, an open-source framework that turns plain-language AI behavior re
Vad händer om din AI-agent, som du precis byggt för kundsupport, plötsligt godkänner en återbetalning på 50 000 kronor utan att fråga en chef? För många utvecklingsteam är detta en reell mardröm. Traditionella AI-tester mäter ofta allmänna saker som hjälpsamhet eller språkligt flyt, men de missar helt om agenten följer just din verksamhets specifika regler och säkerhetskrav. Den 2 juni 2026 presenterade Microsoft sitt svar på problemet vid utvecklarkonferensen Build: det öppna ramverket ASSERT (Adaptive Spec-driven Scoring for Evaluation and Regression Testing) .
Tanken är genialt enkel. Istället för att programmera hundratals specialtester beskriver utvecklaren förväntat och förbjudet beteende på vanlig svenska – en "beteendespecifikation". ASSERT använder sedan AI för att omvandla texten till en komplett, automatiserad testsvit. På samma sätt som en revisor letar efter avvikelser i bokföringen skapar ramverket aktivt utmanande testfall för att provocera fram brott mot just dina regler .
Processen från tanke till utvärdering sker i en femstegsraket:
Det som skiljer ASSERT från traditionella utvärderingsverktyg är fokuset på just din verksamhets unika regler. En AI-agent kan få toppbetyg i generella tester för sanningsenlighet, men på samma gång skicka kunders personnummer till en extern tjänst. Det är den typen av beteende ASSERT är byggt för att fånga upp. Microsoft betonar att ramverket är säkerhetscentrerat och att utvärderingsmetodiken validerats specifikt för säkerhetsbedömning .
ASSERT lanseras tillsammans med Agent Control Specification (ACS), ett annat open source-projekt från Microsoft. ACS låter team definiera portabla policyfiler som specificerar vad en agent får och inte får göra, när mänskligt godkännande krävs och vilken information som måste loggas .
Den tänkta arbetsflödet är integrerat: utvecklare kör först ASSERT för att hitta brister. Därefter implementerar de körningskontroller med ACS. Slutligen körs ASSERT igen för att mäta förbättringen med konkreta före- och eftermätningar . Slingan – specificera, utvärdera, kontrollera, omvärdera – ger utvecklingsteam en repeterbar process för att härda agentbaserade system innan de når verkliga användare.
Ett praktiskt exempel: en utvecklare kan specificera regeln "Denna dokumentforskningsagent får inte skicka e-post till personer utanför företaget, får bara dela konfidentiell information med personer i ledningsgruppen, och måste ge koncisa sammanfattningar med tidigare sammanhang." ASSERT genererar då automatiskt motsvarande utmanande testfall, kör dem och flaggar eventuella policyöverträdelser med ett poängsatt resultatkort och fullständig spårbarhet .
ASSERT är öppen källkod och finns på github.com/responsibleai/ASSERT. Vid lanseringen fick det stöd från communityn, bland annat från CrewAI, Arize AI, LiteLLM, Pipecat och Pydantic .
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
ASSERT (Adaptive Spec driven Scoring for Evaluation and Regression Testing) är ett ramverk med öppen källkod som förvandlar beteenderegler skrivna på vanlig svenska till körbara, poängsatta testsviter som fångar polic...
ASSERT (Adaptive Spec driven Scoring for Evaluation and Regression Testing) är ett ramverk med öppen källkod som förvandlar beteenderegler skrivna på vanlig svenska till körbara, poängsatta testsviter som fångar polic... Ramverket genererar utmanande scenarier, loggar varje verktygsanrop och levererar poängsatta diagnostikrapporter – det fungerar med LangChain, CrewAI, AutoGen, OpenAI och andra stora ramverk.
Till skillnad från generiska riktmärken för hjälpsamhet eller toxicitet riktar ASSERT in sig på applikationsspecifika beteendegränser – och utvärderar om en agent följer exakta produktregler och begränsningar som utve...