DeepSeek Harness v0.1.0 rc.8 publicerades den 19 augusti 2026 enligt projektets ändringslogg. De 14 ändringarna gör att kompatibla modeller kan ta emot bilder direkt och att kommandona /goal och /plan kan hantera text och bilder tillsammans.
Research answer

Create a landscape editorial hero image for this Studio Global article: What changed in DeepSeek Harness v0.1.0-rc.8, released on August 21, 2026 as its first major post-beta update after the August 13 public bet. Article summary: The release was published on August 19 UTC, although coverage around August 20–21 described it as the first major update following the August 13 public beta/open-source launch. Its main change was to make images first-cl. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
DeepSeek Harness v0.1.0-rc.8 är framför allt en uppgradering av orkestrering och inmatning – inte ett bevis på att alla DeepSeek-modeller plötsligt kan se. Versionen publicerades den 19 augusti 2026, sex dagar efter den offentliga betan och lanseringen som öppen källkod. En del rapportering daterade nyheten eller diskussionen till den 20–21 augusti. 9
16
De 14 ändringarna gör bilder användbara i agentens arbetsflöden och förbättrar samtidigt subagenter, terminalbeteende, verktygsanrop, lagring och kompatibilitet. 4
RC.8 lägger till en konfigurerbar väg för inbyggda bildförfrågningar i DeepSeek-adaptern. Om den valda modellen eller backend-tjänsten stöder bildinmatning kan Harness skicka bilden direkt till modellen, i stället för att behandla bilagan som något separat från uppgiften. 2
8
Bildstödet når flera centrala planeringskommandon:
/goal kan ta emot text och bilder i samma inmatning./plan kan ta emot text och bilder i samma inmatning.@-menyn kan hänvisa till lokala filer och tidigare sessioner medan arbetet fortsätter. För utvecklare innebär det att en skärmdump, en skiss av ett gränssnitt, ett diagram eller ett felmeddelande kan bli en del av målet och planen. Användaren behöver alltså inte alltid först beskriva bilden i text.
Den viktiga brasklappen är att RC.8 bygger transport- och orkestreringsvägen för bilder. Den ger inte automatiskt en textbaserad modell egen visuell förståelse. Tolkningen beror på vilken modell eller kompatibel backend som har konfigurerats. 8
9
Claude Code och Codex kan installeras som profilpaket vid behov i subagentsystemet. Codex får dessutom ett icke-interaktivt behörighetsläge och stöd för flera namngivna instanser. Det gör det möjligt att köra separat konfigurerade Codex-subagenter i samma arbetsflöde. 2
4
Windows PTY-terminaler får beständiga PowerShell-sessioner. Funktionen är aktiverad som standard i minimalprofilen, vilket innebär att efterföljande kommandon inte behöver skapa om hela skaltillståndet varje gång. 2
Uppdateringen förbättrar bland annat verktygsanrop med samtidiga web_search-körningar, väcker den överordnade uppgiften när en subagent har levererat en rapport och öppnar automatiskt en lokal webbläsare för dsh web. Prestandan förbättras också vid förgrening av stora sessioner och i SQLite-lagringen. 2
4
RC.8 åtgärdar förfrågningsfel som kan uppstå när en enskild bild är för stor eller när för många bilder har samlats i konversationshistoriken. Svarsprefix bevaras också om en strömmande respons avbryts och samtalet sedan fortsätter eller förgrenas.
Kompatibiliteten med anpassade OpenAI-kompatibla gateways förbättras dessutom, bland annat vid skillnader i förfrågningsformat och när inferensinnehåll saknas i svaret. 2
4
Sammantaget är detta alltså större än en enkel funktion för bilduppladdning. Bilder kan delta i planering, sessionshistorik och delegerat arbete, samtidigt som körmiljön blir tåligare i långa eller verktygstunga sessioner. 2
13
När den valda modellen inte deklarerar stöd för bildinmatning kan Harness använda verktyg för att omvandla bilden till strukturerade textbaserade ledtrådar. Den rapporterade processen kan innehålla OCR-text med koordinater, statistik över färgfördelning, skanning av utvalda pixelrader, bildens mått och information om färgläge. Därefter får textmodellen resonera utifrån dessa uppgifter. 1
2
Modellen tar alltså inte emot själva bildens visuella helhet på samma sätt som en inbyggd visionsmodell. Den arbetar i stället med mätningar och extraherade beskrivningar. Det är en användbar reservlösning, men också en förenklad och ibland informationsförlustbringande sådan.
Verktygslager-vision passar bäst för bilder där strukturen går att återskapa med text och mätbara signaler, till exempel:
I sådana fall kan OCR och riktad pixelanalys ofta fånga text, linjering, gränser, färger och andra relevanta signaler.
Metoden är betydligt svagare för vanliga fotografier, finmaskig objektigenkänning, visuell stil, subtila sammanhang och komplexa rumsliga relationer mellan objekt och miljö. OCR och ett begränsat urval av pixelstatistik kan inte på ett tillförlitligt sätt återskapa alla detaljer som krävs för den typen av uppgifter. 1
2
Den praktiska tumregeln är därför enkel: använd en modell med inbyggd vision för genuin bildförståelse. Använd verktygslager-vision för riktad informationsutvinning eller som reserv när huvudmodellen bara kan hantera text.
Det kan räcka för att läsa ut text, kontrollera dominerande färger, hitta enkla gränser eller verifiera pixelskillnader i ett gränssnitt. Resultatet bör däremot inte likställas med modellens egen visuella slutledning. 2
3
Redan före RC.8 hade communityn testat flera sätt att ge textbaserade Harness-agenter tillgång till visuella ledtrådar. Bland de rapporterade alternativen finns dsh-vision, dsh-vision-toolkit och modlens. Plugin-kataloger listar även lokala OCR-lösningar och olika pseudo-vision-bryggor. 10
23
Två exempel visar bredden i uppläggen:
dsh-vision-toolkit är inriktat på bland annat OCR av långa skärmdumpar, visuell förankring, återskapande av användargränssnitt och pixeljämförelser. Pluginsen kompletterar snarare än ersätter RC.8:s inbyggda bildväg. En kompatibel visionsmodell kan få bilden direkt, en plugin kan leverera specialiserade OCR-, layout- eller pixelverktyg, och en textmodell kan sedan resonera över bevismaterialet.
Den uppdelningen ger utvecklare ett val mellan rikare, inbyggd perception och mer avgränsade verktygsresultat som är lättare att inspektera.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
DeepSeek Harness v0.1.0 rc.8 publicerades den 19 augusti 2026 enligt projektets ändringslogg.
DeepSeek Harness v0.1.0 rc.8 publicerades den 19 augusti 2026 enligt projektets ändringslogg. De 14 ändringarna gör att kompatibla modeller kan ta emot bilder direkt och att kommandona /goal och /plan kan hantera text och bilder tillsammans.
Textmodeller utan inbyggt bildstöd kan få strukturerade ledtrådar från OCR, färgstatistik och pixelskanning.