DeepSeek Harness v0.1.0 rc.8 เผยแพร่เมื่อ 19 สิงหาคม 2026 ตามเวลา UTC ไม่ใช่วันที่ 21 สิงหาคม โดยมีไฮไลต์คือการส่งภาพเข้าเวิร์กโฟลว์ของเอเจนต์โดยตรงสำหรับโมเดลที่รองรับ ขณะที่โมเดลข้อความล้วนจะได้รับข้อมูลภาพที่แปลงเป... อัปเดตทั้ง 14 รายการเพิ่มอินพุตภาพและข้อความให้กับ /goal และ /plan, การอ้างอิงไฟล์หรือเซสชันผ่าน...
คำตอบการวิจัย

Create a landscape editorial hero image for this Studio Global article: What changed in DeepSeek Harness v0.1.0-rc.8, released on August 21, 2026 as its first major post-beta update after the August 13 public bet. Article summary: The release was published on August 19 UTC, although coverage around August 20–21 described it as the first major update following the August 13 public beta/open-source launch. Its main change was to make images first-cl. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
DeepSeek Harness v0.1.0-rc.8 เป็นการอัปเกรดด้านการจัดการอินพุตและการประสานงานเวิร์กโฟลว์ มากกว่าจะเป็นหลักฐานว่าโมเดล DeepSeek ทุกตัวสามารถ “มองเห็น” ได้ รุ่นนี้เผยแพร่เมื่อวันที่ 19 สิงหาคม 2026 หรือ 6 วันหลังการเปิดตัวรุ่นเบตาสาธารณะและโครงการโอเพนซอร์ส โดยรายงานข่าวและการพูดคุยบางส่วนลงวันที่ 20–21 สิงหาคม 9
16 การเปลี่ยนแปลงทั้ง 14 รายการครอบคลุมการใช้ภาพในเวิร์กโฟลว์ของเอเจนต์ ตลอดจน subagents, เทอร์มินัล, การเรียกใช้เครื่องมือ, การจัดเก็บข้อมูล และความเข้ากันได้กับระบบอื่น
4
RC.8 เพิ่มเส้นทางสำหรับส่งคำขอภาพแบบ native ใน DeepSeek model adapter ซึ่งสามารถเปิดใช้งานผ่านการตั้งค่าได้ หากโมเดลหรือแบ็กเอนด์ที่เลือกไว้รองรับอินพุตภาพ Harness จะส่งภาพเข้าโมเดลโดยตรง แทนการแยกไฟล์แนบออกจากโจทย์หลัก 2
8
ความสามารถนี้ถูกต่อเข้ากับคำสั่งวางแผนหลักของระบบด้วย ได้แก่
/goal รองรับอินพุตที่มีทั้งข้อความและภาพ/plan รองรับอินพุตที่มีทั้งข้อความและภาพ@ สามารถเรียกใช้ไฟล์ในเครื่องและเซสชันก่อนหน้าได้ระหว่างทำงาน ในทางปฏิบัติ นักพัฒนาจึงสามารถแนบภาพหน้าจอ ต้นแบบหน้าจอผู้ใช้ แผนผัง หรือภาพแสดงข้อผิดพลาดไปพร้อมกับเป้าหมายและแผนงานได้ ไม่ต้องเสียเวลาบรรยายสิ่งที่อยู่ในภาพด้วยข้อความทั้งหมด
อย่างไรก็ตาม ประเด็นที่ต้องแยกให้ออกคือ RC.8 เพิ่ม “ช่องทางขนส่งและการจัดการภาพ” ไม่ได้เปลี่ยนโมเดลข้อความล้วนให้มีความเข้าใจภาพขึ้นมาเอง การตีความภาพแบบ native ยังขึ้นอยู่กับโมเดลหรือแบ็กเอนด์ที่กำหนดค่าไว้ 8
9
Claude Code และ Codex สามารถติดตั้งเป็น profile bundle แบบเรียกใช้งานเมื่อต้องการภายในระบบ subagent ได้ ส่วน Codex ยังเพิ่มโหมดสิทธิ์การทำงานแบบไม่โต้ตอบกับผู้ใช้ และรองรับหลายอินสแตนซ์ที่ตั้งชื่อแยกกัน ทำให้สามารถเรียกใช้ Codex subagents หลายชุดที่มีการตั้งค่าแตกต่างกันในเวิร์กโฟลว์เดียว 2
4
เทอร์มินัล Windows PTY รองรับ PowerShell session แบบคงสถานะ โดยเปิดใช้งานเป็นค่าเริ่มต้นใน minimal preset คำสั่งที่รันต่อเนื่องกันจึงไม่จำเป็นต้องสร้างสถานะของเชลล์ใหม่ทุกครั้ง 2
รุ่นนี้ปรับปรุงการเรียกใช้เครื่องมือหลายส่วน เช่น การเรียก web_search พร้อมกัน การปลุกงานหลักให้ทำงานต่อเมื่อ subagent ส่งรายงานกลับมา การเปิดเบราว์เซอร์ในเครื่องโดยอัตโนมัติเมื่อใช้ dsh web รวมถึงการเพิ่มประสิทธิภาพของการ fork เซสชันขนาดใหญ่และการจัดเก็บข้อมูลด้วย SQLite 2
4
RC.8 แก้ข้อผิดพลาดของคำขอที่เกิดจากภาพเดี่ยวมีขนาดใหญ่เกินไป หรือมีภาพสะสมในประวัติการสนทนามากเกินไป นอกจากนี้ยังรักษาคำนำหน้าคำตอบไว้ได้เมื่อยกเลิกการตอบแบบสตรีมแล้วสนทนาต่อหรือ fork เซสชัน รวมถึงปรับปรุงการทำงานร่วมกับ custom gateway ที่เข้ากันได้กับ OpenAI API ซึ่งอาจมีรูปแบบคำขอแตกต่างกันหรือไม่ส่งคืนข้อมูล inference content 2
4
เมื่อรวมกันแล้ว การอัปเดตนี้จึงไม่ใช่เพียงฟีเจอร์อัปโหลดรูปภาพ แต่เป็นการทำให้ภาพมีบทบาทในขั้นตอนตั้งเป้าหมาย วางแผน เก็บประวัติเซสชัน และมอบหมายงาน ขณะเดียวกันรันไทม์ก็รับมือกับเซสชันยาวและงานที่ใช้เครื่องมือจำนวนมากได้ดีขึ้น 2
13
หากโมเดลที่เลือกไม่ได้ประกาศว่ารองรับอินพุตภาพ Harness สามารถใช้เครื่องมือแปลงภาพให้เป็นหลักฐานเชิงข้อความและข้อมูลแบบมีโครงสร้าง กระบวนการที่มีการรายงานไว้ประกอบด้วย OCR พร้อมพิกัดข้อความ สถิติอัตราส่วนสี การสแกนแถวพิกเซลบางส่วน ขนาดภาพ และข้อมูลเมทาดาทาเกี่ยวกับโหมดสี จากนั้นจึงส่งหลักฐานเหล่านี้ให้โมเดลข้อความใช้ประกอบการให้เหตุผล 1
2
โมเดลไม่ได้รับ “พื้นที่ภาพต้นฉบับ” ในแบบเดียวกับโมเดล vision ที่รองรับภาพโดยตรง แต่กำลังวิเคราะห์ผลการวัดและคำอธิบายที่ถูกสกัดออกมา จึงเป็นทางเลือกสำรองที่ใช้งานได้ แต่มีข้อมูลสูญหายระหว่างทาง
Tool-layer vision เหมาะกับภาพที่มีโครงสร้างและสามารถดึงข้อมูลออกมาได้ค่อนข้างชัดเจน เช่น
งานเหล่านี้มักอาศัยข้อความที่อ่านได้ ตำแหน่ง การจัดแนว ขอบเขต สี หรือสัญญาณอื่น ๆ ที่ OCR และการตรวจสอบพิกเซลแบบเจาะจงพอจะเก็บได้
แนวทางนี้มีข้อจำกัดชัดเจนเมื่อใช้กับภาพถ่าย การจำแนกวัตถุแบบละเอียด สไตล์ภาพ บริบทที่ละเอียดอ่อน หรือความสัมพันธ์ของวัตถุและฉากที่ซับซ้อน เพราะ OCR และสถิติจากพิกเซลบางส่วนไม่สามารถสร้างรายละเอียดทั้งหมดที่จำเป็นต่อการวิเคราะห์ประเภทนี้ได้อย่างน่าเชื่อถือ 1
2
หลักใช้งานจึงค่อนข้างตรงไปตรงมา: ใช้โมเดล native vision เมื่อต้องการ “เข้าใจภาพ” อย่างแท้จริง และใช้ tool-layer vision เพื่อดึงหลักฐานเฉพาะจุดหรือเป็นทางเลือกสำรองเมื่อโมเดลหลักเป็นข้อความล้วน วิธีนี้ช่วยอ่านข้อความ ตรวจสอบสีเด่น หาเส้นขอบเรียบง่าย หรือยืนยันความแตกต่างระดับพิกเซลของอินเทอร์เฟซได้ แต่ไม่ควรตีความว่าผลลัพธ์เทียบเท่าการให้โมเดล vision วิเคราะห์ภาพโดยตรง 2
3
ก่อนมีการรองรับแบบ native ใน RC.8 ชุมชนก็พัฒนาเครื่องมือหลายแนวทางเพื่อให้เอเจนต์ Harness ที่ใช้โมเดลข้อความล้วนเข้าถึงหลักฐานด้านภาพได้ ตัวเลือกที่มีการรายงาน ได้แก่ dsh-vision, dsh-vision-toolkit และ modlens รวมถึงปลั๊กอิน OCR ในเครื่องและบริดจ์ pseudo-vision อื่น ๆ 10
23
ตัวอย่างที่สะท้อนแนวทางการออกแบบมีดังนี้
dsh-vision-toolkit มุ่งเน้น OCR จากภาพหน้าจอยาว การระบุตำแหน่งองค์ประกอบ การสร้าง UI ขึ้นใหม่ และการเปรียบเทียบพิกเซล ปลั๊กอินเหล่านี้ทำงานเสริม ไม่ได้มาแทนที่เส้นทางส่งภาพแบบ native ของ RC.8 โมเดล vision ที่เข้ากันได้สามารถรับภาพโดยตรง ขณะที่ปลั๊กอินช่วยเพิ่มเครื่องมือเฉพาะทางด้าน OCR เลย์เอาต์ พิกเซล หรือโมเดลภายนอก ส่วนโมเดลข้อความล้วนก็สามารถให้เหตุผลจากหลักฐานที่ถูกสกัดออกมาได้ การแยกบทบาทเช่นนี้ทำให้นักพัฒนาเลือกได้ว่าจะใช้การรับรู้ภาพที่เข้มข้นจากโมเดลโดยตรง หรือใช้ผลลัพธ์จากเครื่องมือที่ตรวจสอบย้อนกลับได้ง่ายกว่า
Studio Global AI
หน้านี้รวมคำตอบที่ได้รับการสนับสนุนจากแหล่งที่มาซึ่งคุณสามารถดำเนินการต่อภายใน Studio Global
DeepSeek Harness v0.1.0 rc.8 เผยแพร่เมื่อ 19 สิงหาคม 2026 ตามเวลา UTC ไม่ใช่วันที่ 21 สิงหาคม โดยมีไฮไลต์คือการส่งภาพเข้าเวิร์กโฟลว์ของเอเจนต์โดยตรงสำหรับโมเดลที่รองรับ ขณะที่โมเดลข้อความล้วนจะได้รับข้อมูลภาพที่แปลงเป...
DeepSeek Harness v0.1.0 rc.8 เผยแพร่เมื่อ 19 สิงหาคม 2026 ตามเวลา UTC ไม่ใช่วันที่ 21 สิงหาคม โดยมีไฮไลต์คือการส่งภาพเข้าเวิร์กโฟลว์ของเอเจนต์โดยตรงสำหรับโมเดลที่รองรับ ขณะที่โมเดลข้อความล้วนจะได้รับข้อมูลภาพที่แปลงเป... อัปเดตทั้ง 14 รายการเพิ่มอินพุตภาพและข้อความให้กับ /goal และ /plan, การอ้างอิงไฟล์หรือเซสชันผ่านเมนู @, การติดตั้ง Claude Code และ Codex เป็น subagents, PowerShell session แบบคงสถานะบน Windows รวมถึงการปรับปรุง tool c...
วิธีที่เรียกว่า “tool layer vision” เหมาะกับภาพหน้าจอ สไลด์ ไดอะแกรม และภาพที่มีข้อความชัดเจน แต่ยังทดแทน native vision ไม่ได้เมื่อเป็นภาพถ่าย รายละเอียดวัตถุ บริบทละเอียดอ่อน หรือความสัมพันธ์เชิงพื้นที่ที่ซับซ้อน [1][2]