Dette er det viktigste skillet mellom Harness og en typisk AI-applikasjon. I et konvensjonelt produkt kan brukeren ofte konfigurere instruksjoner, verktøy og integrasjoner, mens selve kjøringsmodellen fortsatt styres av leverandøren. Harness forsøker å gjøre også dette laget konfigurerbart.
Utviklerforhåndsvisningen leveres med fire forhåndsinnstilte moduser. De representerer ulike kombinasjoner av funksjoner, og er mer å regne som startkonfigurasjoner enn som fire separate produkter.
Standard er det komplette kodeagentmiljøet. Her får modellen tilgang til filredigering, shell, søk, ferdigheter, planlegging, mål, underagenter og arbeidsflyter for generelle programvareoppgaver.
Code viser verktøyene gjennom et kodeorientert grensesnitt, slik at modellen kan kombinere flere operasjoner i et TypeScript-program. Det kan redusere behovet for mange enkeltstående verktøykall når oppgaven naturlig består av flere relaterte handlinger.
Minimal holder miljøet med vilje smalt: et vedvarende shell og et filredigeringsverktøy. Den begrensede utformingen er laget for mer kontrollerte modelevalueringer og for å undersøke hvordan en agent oppfører seg med færre innebygde funksjoner.
Creator er rettet mot utviklere som lager nye forhåndsinnstillinger. Modusen gir innsyn i runtime-en og gjør det mulig å eksperimentere med plugin-moduler i minnet.
Harness legger også stor vekt på sporbarhet. Øktdesignet registrerer det modellen ser og gjør i en hendelsesstrøm som bare kan utvides. Det omfatter systeminstruksjoner, resonnering, verktøykall og resultater, planlegging av underagenter og nye kontekstinnslag. Den samme historikken brukes til søk, avspilling, gjenopptakelse og forgrening av økter.
Dette kan gjøre agentens oppførsel enklere å feilsøke og gjenskape. Når en kjøring mislykkes, får utvikleren en mer komplett oversikt over konteksten og handlingene som ledet frem til feilen. Med forgrening kan man dessuten starte et nytt eksperiment fra et tidligere punkt, i stedet for å begynne helt på nytt.
Detaljerte logger skaper samtidig egne driftsutfordringer. De kan inneholde sensitive instrukser, kildekode, verktøyresultater, passord som ved et uhell ble eksponert for modellen eller andre private data. Før slike spor behandles som vanlige produksjonsdata, bør team definere regler for lagringstid, tilgangskontroll, sensurering og sandkasser.
DeepSeek Harness omtales ofte sammen med Claude Code og OpenAI Codex, men produktene befinner seg på ulike nivåer.
Claude Code og Codex er integrerte kodeagentprodukter som er laget for å gi en relativt komplett arbeidsflyt. Harness er en åpen runtime der verdien først og fremst ligger i sammensetning og kontroll. Modellen, verktøyene, lagringen, sandkassen, øktoppførselen og agentløkken er ment å kunne erstattes gjennom plugin-moduler, i stedet for å være fast bygget inn i ett leverandørstyrt produkt.
Det gir et ganske tydelig valg:
En mer åpen arkitektur betyr ikke automatisk at Harness er en bedre kodeassistent. Den relevante sammenligningen er mellom en utvidbar runtime og mer meningssterke, ferdig utformede produkter. Om fleksibiliteten er verdt den ekstra ingeniørjobben, blir avgjørende.
Prosjektet fikk uvanlig stor oppmerksomhet tidlig. Rapporter beskriver over 20 000 GitHub-stjerner etter omtrent én til halvannen time, mens senere rapporter plasserte repositoriet over 141 000 stjerner 17. august 2026.
Tallene er oppsiktsvekkende, men må tolkes med varsomhet. GitHub-stjerner måler oppmerksomhet, nysgjerrighet og bokmerking – ikke aktive installasjoner, vellykkede oppgaver, sikkerhet, stabilitet eller langsiktig kapasitet hos vedlikeholderne. Påstander om at Harness vokste raskere enn Grok-1 avhenger dessuten av hvordan prosjekter og tidsvinduer måles, og bør derfor omtales som rapporterte sammenligninger, ikke som endelige bransjerekorder.
Den mest solide konklusjonen er at mange utviklere viser interesse for en mer åpen agentstakk. Det følger ikke av stjernetallene alene at rammeverket allerede er klart for produksjon.
MIT-lisensen gjelder rammeverkskoden, men gjør ikke modellkjøring gratis. Agent-runtime-er kan sende systeminstrukser, verktøyresultater, regler og opparbeidet historikk på nytt i flere modellkall. Hvis rapporter om rundt 47 600 ukatchede input-tokens per interaksjon stemmer, kan kontekstmengden bli en vesentlig faktor for både kostnad og forsinkelse. Tallet er likevel ikke uavhengig bekreftet av de sterkeste kildene i materialet.
Modellleverandøren har også betydning. Lanseringen av DeepSeek V4-Pro ble fulgt av en overgang til topp- og lavtrafikkpriser i API-et. Rapporter oppgir en topppris på 3,96 dollar per million output-tokens, mot 0,87 dollar tidligere. Den faktiske prisen for en Harness-arbeidsflyt vil fortsatt avhenge av modellvalg, cache-treff, trimming av kontekst, hvor detaljerte verktøyresultatene er og hvor mange agentiterasjoner som kreves.
Stabilitet er en annen begrensning. DeepSeek omtaler Harness som en utviklerforhåndsvisning og advarer om at sentrale plugin-moduler og API-er vil fortsette å endre seg. Utviklere som tester løsningen bør derfor låse versjoner og plugin-avhengigheter, isolere eksperimenter, teste oppgraderinger før utrulling og ha en plan for tilbakerulling.
Rapporter om feil i tidlige tredjepartsplugin-moduler og mange plugin-forslag kan tyde på et økosystem som vokser raskt, men de konkrete tallene er ikke godt nok dokumentert her til å brukes som beslutningsgrunnlag. Den overordnede lærdommen er tydelig: Hvert ekstra utvidelsespunkt fører med seg mer arbeid med kompatibilitet og sikkerhet.
DeepSeek Harness er interessant fordi det behandler agent-runtime-en – ikke bare modellen – som et førsteklasses, åpent ingeniørlag. Plugin-systemet basert på Cordis og den append-only-baserte økthistorikken gir uvanlig høy kontroll over hvordan en agent resonnerer, handler, lagrer tilstand og kan inspiseres.
Det gjør Harness til en aktuell kandidat for forskere, infrastrukturteam og utviklere som trenger sammensettbare agentsystemer. For team som bare ønsker en pålitelig kodeassistent med minimalt oppsett, er løsningen mindre opplagt.
På kort sikt er Harness trolig ikke en direkte erstatning for Claude Code eller Codex. Det er snarere et åpent alternativ for team som vil bytte ferdig bekvemmelighet mot modellfrihet, innsyn og kontroll. Om det blir en varig plattform, vil avhenge av hvor stabile API-ene blir, kvaliteten på plugin-økosystemet, sikkerhetsgrensene, dokumentasjonen og hvor komplisert løsningen blir å drifte etter den første demonstrasjonen.