Better Harness er Qoders open source værktøj til at gennemgå workflowet omkring kodeagenter – fra repository regler og test til leveringskontroller og sessioner. Rammen samler Harness Engineering, en evaluering af fem led i agentens arbejdsloop og en kørbar implementering på understøttede agentværter.
Research answer

Create a landscape editorial hero image for this Studio Global article: What is Alibaba Cloud Qoder’s Better Harness, open-sourced on GitHub on July 28, 2026, and how does its three-layer framework—covering Harne. Article summary: Better Harness is Qoder’s MIT-licensed, open-source reviewer and improvement loop for the environment around coding agents—not merely a benchmark of an agent’s answer on one task. It maps project setup and real agent act. Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
AI-kodeagenter bliver ikke kun gode af at have en stærk model. De afhænger også af rammerne omkring arbejdet: instruktioner i repositoryet, adgangsregler, scripts, tests, reviewkrav og den viden, et team bevarer fra tidligere opgaver.
Det er dét miljø, Qoder kalder en harness. Better Harness er et open source-projekt, der gennemgår denne arbejdsgang omkring en kodeagent frem for kun at bedømme et enkelt svar eller et enkelt kode-diff. Formålet er at finde dokumenterede svagheder, foreslå en afgrænset udbedring og kontrollere resultatet ved en senere kørsel. 1
2
4
Qoder offentliggjorde projektet som open source på GitHub den 28. juli 2026, ifølge samtidig omtale. 5
En harness kan blandt andet bestå af repository-instruktioner, regler, skills, hooks, plugins, forbindelser, scripts, testkommandoer, releasekontroller og menneskelig review. 2
Derfor kan en agent godt skrive tilsyneladende fornuftig kode i et workflow, der stadig er skrøbeligt. Måske findes der en testkommando, men agenten får ingen klar besked om, hvornår den skal bruges. Måske ligger en regel i projektet, men agenten anvender den ikke. Eller måske forsvinder erfaringen fra en fejlet opgave, når sessionen slutter.
Better Harness forsøger at flytte samtalen fra “findes konfigurationen?” til “blev den brugt, og er der belæg for, at den virkede?” 1
4
5
Qoder beskriver Better Harness som en ramme med tre lag, der forbinder konkrete ingeniørpraksisser med en evalueringsmodel og en implementering, der kan køres i projekter. 5
Det første lag handler om de praktiske elementer, som former agentens arbejde: sessioner og CLI-mønstre, observerbarhed, regler, skills, MCP-konfiguration, hukommelse, hooks og automatisering. 5
I praksis er det spørgsmål som:
Første skridt er at kortlægge den eksisterende harness: mål, kontekst, indgange til udførelse, feedbacksløjfer, leveringsmekanismer og opsamling af læring. 1
Det andet lag vurderer fem sammenhængende dele af leveringen: opgaveforståelse, kontrolleret udførelse, validering af ændringer, pålidelig levering og opsamling af læring. 1
4
Det er en mere operationel test end blot at se på kodeoutputtet: Kan workflowet igen og igen føre til ændringer, der er forståelige, kontrollerede, validerede, leverbare og informeret af tidligere arbejde?
Modellen skal pege på brud i kæden – eksempelvis en manglende mekanisme, en integration der ikke hænger sammen, et trin som aldrig blev kørt, eller manglende dokumentation for resultatet. 1
Det tredje lag skal sikre, at principperne ikke kun ender som dokumentation. Better Harness kører via en kodeagent, indsamler projekt- og, hvor det understøttes, sessionsdata og leverer prioriterede næste skridt med mulighed for efterfølgende kontrol. 4
Qoders aktuelle projektmateriale omtaler ti værtsadaptere. Ved lanceringen blev blandt andre Claude Code, Codex, Qoder og Cursor nævnt som understøttede miljøer. 5
6
Understøttelsen kan ændre sig, så en konkret integration bør altid tjekkes i den aktuelle adapterdokumentation. De foreliggende kilder dokumenterer ikke understøttelse af OpenClaw.
Et centralt element i Better Harness er, at indsamling af data adskilles fra den samlede vurdering. Qoder oplyser, at hovedforløbet først samler rå data og derefter sender dem til tre uafhængige underagenter med skrivebeskyttet adgang, før resultaterne kombineres. 1
De tre perspektiver er:
Skellet er vigtigt. Projekt- og konfigurationsdata kan vise, at en funktion er til rådighed. Sessionsdata kan i højere grad vise, om den blev brugt relevant i en konkret opgave. 1
4
Det måske mest nyttige princip er, at et artefakts blotte eksistens ikke er dokumentation for effektivitet.
Et repository kan have en automatisk testpakke. Det viser en potentiel kapacitet, men ikke i sig selv, at agenten kørte de relevante tests efter en ændring, fortolkede resultatet korrekt eller undgik at levere en fejl. Det samme gælder regler, hooks, skills og godkendelsesporte. 1
5
Derfor skal fundene holde beviskæden synlig. Understøttede mangler bliver til prioriterede findings med effekt, forventet resultat, afgrænset udbedring og acceptkriterier. Manglende beviser bliver stående som manglende beviser i stedet for at blive omsat til en sikker score. 4
6
Et brugbart fund bør dermed gøre fire ting klare:
Better Harness er tænkt som en iterativ proces:
Det kan vise, at et workflow har ændret sig, og om der nu findes stærkere belæg for vurderingen. Det beviser derimod ikke alene, at en bestemt rettelse har forbedret agentens præstation i ethvert projekt eller på enhver vært. Qoders materiale fremhæver observerede beviser og eksplicitte begrænsninger frem for at behandle ændrede scorer som kausalt bevis. 4
6
Omtalen ved lanceringen beskrev en første øvelse med 30 virkelige GitHub-projekter. 5 Det bør læses som en udforskende anvendelse af rammen – ikke som et kontrolleret bevis for, at Better Harness forbedrer alle kodeagenter eller alle repositories.
Den primære dokumentation understøtter værktøjets evidensmodel, struktur for findings og løkken med udbedring og ny måling. Men de foreliggende kilder giver ikke tilstrækkelige primære oplysninger til selvstændigt at vurdere udvælgelsen af de 30 projekter, scoringsmetoden eller samlede resultater. 1
4
Qoders bredere ambition er at gøre Harness Engineering til en slags kvalitetsinfrastruktur for AI-assisteret softwareudvikling: et fælles sprog for workflow-kontroller, synlige beviser, sammenlignelige leveringsdimensioner og gentagelige forbedringsforløb. 1
2
Better Harness er et konkret bud på den idé. Det giver teams en metode til at undersøge betingelserne omkring agentarbejde på tværs af understøttede værter, diskutere belæg frem for mavefornemmelser og afprøve, om en workflow-rettelse holder ved næste kørsel.
Værdien er ikke en garanti for bedre resultater efter enhver ændring. Værdien er en mere disciplineret måde at gøre agent-workflows gennemskuelige, gennemgåelige og efterprøvelige på. 4
6
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Better Harness er Qoders open source værktøj til at gennemgå workflowet omkring kodeagenter – fra repository regler og test til leveringskontroller og sessioner.
Better Harness er Qoders open source værktøj til at gennemgå workflowet omkring kodeagenter – fra repository regler og test til leveringskontroller og sessioner. Rammen samler Harness Engineering, en evaluering af fem led i agentens arbejdsloop og en kørbar implementering på understøttede agentværter.
Et testscript eller en regel tæller ikke som bevis på, at det virker: Better Harness skelner mellem, hvad der findes, og hvad der faktisk blev brugt og dokumenteret.