ในงานเปิดตัว Windows และ Surface ที่ซานฟรานซิสโกเมื่อวันที่ 7 ตุลาคม 2026 Microsoft วางภาพอนาคตของ Windows ไว้ภายใต้แนวคิด “Hybrid Intelligence” หรือการทำงานร่วมกันของ AI ในเครื่องกับ AI บนคลาวด์ พาวัน ดาวูลูรี ผู้บริหารด้าน Windows ระบุว่าเอเจนต์ควรทำงานในพีซีเมื่อเหมาะสม เชื่อมต่อคลาวด์เมื่อจำเป็น และอยู่ภายใต้การควบคุมด้านความปลอดภัยและการจัดการของ Windows
19
สาระสำคัญจึงไม่ใช่ว่า AI ทุกงานจะย้ายมาอยู่บนแล็ปท็อป แต่คือ Microsoft ต้องการให้ Windows จัดการโมเดลในเครื่องและโมเดลบนคลาวด์เป็นส่วนหนึ่งของระบบเดียวกัน
Windows จะผสาน AI ในเครื่องกับคลาวด์อย่างไร
โมเดลในพีซีอาจรับงานบางประเภทได้โดยตรง ส่วนงานที่ต้องใช้บริการบนคลาวด์ก็ยังส่งต่อไปได้ Microsoft เสนอแนวทางนี้เป็นฐานสำหรับฟีเจอร์ AI และเอเจนต์บน Windows ไม่ใช่สิ่งที่จะมาแทนบริการคลาวด์ทั้งหมด
19
เพื่อให้การรันโมเดลในเครื่องเข้าถึงได้ง่ายขึ้น Microsoft ระบุว่าจะเพิ่มการรองรับ llama.cpp ใน Windows ML ซึ่งเป็นระบบสำหรับรันโมเดลบน Windows การเปลี่ยนแปลงนี้อาจช่วยให้นักพัฒนานำโมเดลโอเพนซอร์สมาทดลองใช้ผ่านชุดฮาร์ดแวร์ที่ Windows รองรับได้สะดวกขึ้น
39
43
DeepSeek, Nemotron และโมเดลเขียนโค้ดของ Microsoft
Microsoft ยกตัวอย่างโมเดลที่เตรียมรองรับการใช้งานในเครื่อง ได้แก่ DeepSeek V4 Flash, Nemotron รุ่นใหม่จาก NVIDIA และ MAI Code 1.1 Flash ซึ่งเป็นโมเดลเขียนโค้ดของ Microsoft
33
ข้อมูลที่มีรายงานระบุว่า DeepSeek V4 Flash มีพารามิเตอร์รวม 284,000 ล้านตัว และใช้การควอนไทซ์ที่ 1.6 บิต เพื่อให้ใช้หน่วยความจำได้ราว 60 GB Microsoft บรรยายความสามารถของโมเดลว่า “ใกล้เคียงระดับแนวหน้า” แต่คำนี้เป็นคำกล่าวอ้างด้านประสิทธิภาพ ไม่ใช่ผลทดสอบอิสระที่ได้รับการยืนยันจากข้อมูลแหล่งข่าวที่มีอยู่
26
ส่วน Nemotron รุ่นใหม่ของ NVIDIA ถูกระบุว่ามีพารามิเตอร์มากกว่า 70,000 ล้านตัว และใช้การควอนไทซ์ 2 บิต เพื่อให้ใช้หน่วยความจำมากกว่า 20 GB เพียงเล็กน้อย รายงานเกี่ยวกับงานระบุเป้าหมายเปิดตัวไว้วันที่ 15 ตุลาคม แต่ควรเข้าใจว่าเป็นกำหนดการที่วางไว้ ไม่ใช่การยืนยันว่าโมเดลเปิดให้ใช้งานแล้ว
26
33
ตัวเลขหน่วยความจำยังชี้ให้เห็นว่าการบีบอัดโมเดลมีความสำคัญเพียงใด หากเก็บน้ำหนักของโมเดล 284,000 ล้านพารามิเตอร์ที่ 4 บิต จะต้องใช้พื้นที่ประมาณ 142 GB เฉพาะตัวน้ำหนัก และยังไม่รวมหน่วยความจำส่วนอื่นที่ใช้ขณะทำงาน การทำให้โมเดลอยู่ในกรอบประมาณ 60 GB จึงต้องอาศัยการควอนไทซ์ที่เข้มข้นกว่านั้น แหล่งข้อมูลที่มีอยู่ยังไม่ได้ยืนยันผลการทำงานของโมเดลเวอร์ชันบีบอัดนี้ผ่านการทดสอบอิสระ จึงควรรอตรวจสอบคำกล่าวอ้างด้านคุณภาพเพิ่มเติม
26
เลือกโมเดลให้เหมาะกับงาน และจำกัดสิทธิ์เอเจนต์
Microsoft ยังกล่าวถึงเครื่องมือที่ช่วยเชื่อมโมเดลเข้ากับงานแต่ละประเภท โดยแนวทาง HydraFusion ของ GitHub สามารถส่งงานไปยังโมเดลที่เหมาะสม และเปิดทางให้โมเดลที่ทำงานในเครื่องเป็นหนึ่งในตัวเลือกได้
39
สำหรับเอเจนต์ที่โต้ตอบกับพีซี Microsoft ประกาศ Execution Containers ซึ่งเป็นชั้นควบคุมที่ออกแบบมาเพื่อจำกัดสิ่งที่เอเจนต์เข้าถึงหรือทำได้ แนวคิดนี้เป็นส่วนหนึ่งของแผนเอเจนต์บน Windows เพราะยิ่งเอเจนต์ทำงานในเครื่องได้มากเท่าไร การกำหนดขอบเขตสิทธิ์ก็ยิ่งสำคัญ
34
RTX Spark นำ AI โมเดลใหญ่ขึ้นมาสู่พีซี
Microsoft เปิดพรีออเดอร์ Surface Laptop Ultra ซึ่งสร้างขึ้นบนฮาร์ดแวร์ NVIDIA RTX Spark ราคาเริ่มต้น 2,599 ดอลลาร์ และมีตัวเลือกหน่วยความจำแบบรวมสูงสุด 128 GB
18
31
ฮาร์ดแวร์ลักษณะนี้มีเป้าหมายเพื่อให้การรันโมเดลขนาดใหญ่ในเครื่องทำได้จริงมากขึ้น แต่ราคาและความต้องการหน่วยความจำก็สะท้อนข้อจำกัดสำคัญเช่นกัน: การใช้งานโมเดลขนาดใหญ่บนคอมพิวเตอร์ส่วนบุคคลอาจต้องใช้เครื่องที่มีหน่วยความจำสูงและมีราคาสูง ส่วนราคา DGX Spark ของ NVIDIA ก็ชี้ให้เห็นแรงกดดันด้านต้นทุนในทิศทางเดียวกัน โดยมีรายงานว่ารุ่น 128 GB ราคา 6,950 ดอลลาร์ และรุ่นใหม่ 64 GB ราคา 4,999 ดอลลาร์
3
สิ่งที่ประกาศยืนยันได้—and สิ่งที่ยังต้องรอดู
ทิศทางของ Microsoft ชัดเจน: Windows จะประสาน AI ในเครื่องกับ AI บนคลาวด์ เปิดทางให้ใช้โมเดลโอเพนซอร์สได้มากขึ้น และเพิ่มเครื่องมือควบคุมเอเจนต์ แต่การประกาศครั้งนี้ยังไม่ได้ยืนยันว่าโมเดลในเครื่องจะทำงานได้เทียบเท่าบริการคลาวด์ในทุกงาน ว่าประสิทธิภาพของโมเดลที่กล่าวถึงผ่านการตรวจสอบอิสระแล้ว หรือว่า AI บนอุปกรณ์จะทำให้ไม่ต้องพึ่งคลาวด์อีกต่อไป คำตอบขึ้นอยู่กับผลทดสอบจริง ความพร้อมของซอฟต์แวร์ และฮาร์ดแวร์ที่ผู้ใช้มี
ดังนั้น ในตอนนี้ “Hybrid Intelligence” ควรถูกมองว่าเป็นยุทธศาสตร์แพลตฟอร์มของ Microsoft: ใช้พีซีทำงาน AI ที่เหมาะสม และยังคงมีโมเดลบนคลาวด์เป็นส่วนหนึ่งของระบบ