Tại sự kiện ngày 7/10/2026, Microsoft giới thiệu “trí tuệ lai”: Windows phối hợp AI chạy trên PC với mô hình trên đám mây tùy theo nhu cầu. DeepSeek V4 Flash, Nemotron và hỗ trợ llama.cpp mở rộng lựa chọn mô hình AI chạy cục bộ; Microsoft cũng công bố công cụ định tuyến tác vụ và giới hạn quyền cho AI agent.
Đăng bởiBiên tập bằng GPT-6 LunaHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What did Microsoft announce at its Oct. 7 Windows and Surface event in San Francisco—its first laptop-focused event in more than two years—a. Article summary: At its October 7, 2026 Windows and Surface event in San Francisco, Microsoft presented “hybrid intelligence” as a way for Windows to run AI locally when practical and use the cloud when needed. Windows chief Pavan Davulu. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Tại sự kiện Windows và Surface ở San Francisco ngày 7/10/2026, Microsoft phác thảo một hướng đi mới cho Windows: AI không nhất thiết phải xử lý hoàn toàn trên đám mây. Theo Pavan Davuluri, lãnh đạo mảng Windows, các AI agent có thể chạy ngay trên PC khi phù hợp, chuyển lên đám mây khi cần và hoạt động trong phạm vi bảo mật, quản lý của Windows. Microsoft gọi cách kết hợp đó là “trí tuệ lai” (hybrid intelligence). 19
Điểm đáng chú ý không phải là mọi tác vụ AI sắp được chuyển hết về máy tính cá nhân. Thay vào đó, Microsoft muốn Windows điều phối mô hình chạy tại chỗ và mô hình trên đám mây như những phần của cùng một hệ thống.
Một số tác vụ có thể được xử lý bằng mô hình chạy trực tiếp trên PC, trong khi dịch vụ đám mây vẫn sẵn sàng cho những việc phù hợp hơn với chúng. Microsoft trình bày sự kết hợp này như nền tảng cho các tính năng AI và agent trên Windows, chứ không phải lời tuyên bố từ bỏ AI đám mây. 19
Để nhà phát triển dễ đưa thêm mô hình vào Windows, Microsoft cho biết sẽ hỗ trợ llama.cpp trong Windows ML, môi trường chạy mô hình của hãng. Hỗ trợ này có thể giúp chạy thêm các mô hình mã nguồn mở thông qua lớp phần cứng được Windows hỗ trợ. 39
43
Microsoft nêu tên một số mô hình hướng đến chạy cục bộ, gồm DeepSeek V4 Flash, một mô hình Nemotron sắp tới của Nvidia và MAI Code 1.1 Flash của Microsoft, tập trung vào lập trình. 33
Theo thông tin được công bố, DeepSeek V4 Flash có tổng cộng 284 tỷ tham số và được lượng tử hóa xuống 1,6 bit để chạy trong khoảng 60 GB bộ nhớ. Microsoft mô tả năng lực của mô hình là “gần với nhóm tiên phong” (near-frontier). Đây là tuyên bố về hiệu năng, chưa phải kết quả benchmark độc lập được xác nhận trong các nguồn hiện có. 26
Mô hình Nemotron sắp tới của Nvidia được mô tả có hơn 70 tỷ tham số, lượng tử hóa ở mức 2 bit để cần hơn 20 GB bộ nhớ một chút. Một số tin đưa ra ngày 15/10 là thời điểm dự kiến; không nên xem đó là xác nhận rằng mô hình đã được phát hành. 26
33
Các con số bộ nhớ cũng cho thấy vì sao việc nén mô hình quan trọng. Nếu lưu 284 tỷ tham số ở mức 4 bit, riêng phần trọng số đã cần khoảng 142 GB, chưa tính bộ nhớ cho quá trình vận hành. Cấu hình 60 GB được nêu cho DeepSeek dựa vào mức lượng tử hóa mạnh hơn nhiều. Các nguồn hiện có chưa cho thấy phiên bản nén cụ thể này đã được kiểm tra độc lập ra sao, vì vậy những tuyên bố về chất lượng vẫn cần được xác minh. 26
Microsoft cũng giới thiệu các công cụ giúp nối mô hình với từng loại công việc. HydraFusion của GitHub có thể chuyển tác vụ đến mô hình phù hợp, trong đó có cả mô hình chạy trên PC. 39
Với những agent có thể tương tác với máy tính, Microsoft công bố Execution Containers — lớp cô lập nhằm giới hạn dữ liệu agent được truy cập và việc agent có thể thực hiện. Đây là phần quan trọng trong câu chuyện AI agent trên Windows: năng lực chạy tại chỗ càng nhiều thì càng cần xác định rõ ranh giới quyền truy cập. 34
Microsoft mở đặt trước Surface Laptop Ultra, mẫu máy dùng phần cứng Nvidia RTX Spark, với giá khởi điểm 2.599 USD. Microsoft liệt kê các cấu hình có tối đa 128 GB bộ nhớ hợp nhất — loại bộ nhớ được dùng chung cho các thành phần xử lý — nhằm hỗ trợ chạy mô hình lớn hơn ngay trên máy. 18
31
Tuy nhiên, mức giá và yêu cầu bộ nhớ cũng cho thấy một giới hạn thực tế: chạy mô hình lớn trên máy cá nhân có thể cần hệ thống đắt tiền, nhiều bộ nhớ. Giá DGX Spark riêng của Nvidia phản ánh áp lực chi phí tương tự: các tin đưa mức 6.950 USD cho phiên bản 128 GB và 4.999 USD cho phiên bản 64 GB mới. 3
Hướng đi Microsoft đặt ra khá rõ: Windows sẽ phối hợp AI chạy tại chỗ với AI trên đám mây, tạo đường hỗ trợ thêm mô hình mở và bổ sung biện pháp kiểm soát agent. Nhưng thông báo này chưa chứng minh rằng mô hình chạy cục bộ có thể ngang bằng dịch vụ đám mây trong mọi tác vụ; hiệu năng được nêu đã được kiểm chứng độc lập; hay AI trên thiết bị sẽ khiến điện toán đám mây trở nên không cần thiết.
Câu trả lời sẽ phụ thuộc vào thử nghiệm thực tế, mức độ sẵn có của phần mềm và cấu hình phần cứng người dùng sở hữu. Trước mắt, “trí tuệ lai” nên được hiểu là chiến lược nền tảng của Microsoft: dùng PC cho những việc AI có thể xử lý phù hợp tại chỗ, đồng thời vẫn giữ mô hình đám mây trong cuộc chơi.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Tại sự kiện ngày 7/10/2026, Microsoft giới thiệu “trí tuệ lai”: Windows phối hợp AI chạy trên PC với mô hình trên đám mây tùy theo nhu cầu.
Tại sự kiện ngày 7/10/2026, Microsoft giới thiệu “trí tuệ lai”: Windows phối hợp AI chạy trên PC với mô hình trên đám mây tùy theo nhu cầu. DeepSeek V4 Flash, Nemotron và hỗ trợ llama.cpp mở rộng lựa chọn mô hình AI chạy cục bộ; Microsoft cũng công bố công cụ định tuyến tác vụ và giới hạn quyền cho AI agent.
Surface Laptop Ultra dùng phần cứng Nvidia RTX Spark, có giá khởi điểm 2.599 USD; chạy mô hình lớn tại chỗ vẫn đòi hỏi bộ nhớ đáng kể và phần cứng đắt tiền.
Tại sự kiện ngày 7/10/2026, Microsoft giới thiệu “trí tuệ lai”: Windows phối hợp AI chạy trên PC với mô hình trên đám mây tùy theo nhu cầu. DeepSeek V4 Flash, Nemotron và hỗ trợ llama.cpp mở rộng lựa chọn mô hình AI chạy cục bộ; Microsoft cũng công bố công cụ định tuyến tác vụ và giới hạn quyền cho AI agent.
Đăng bởiBiên tập bằng GPT-6 LunaHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What did Microsoft announce at its Oct. 7 Windows and Surface event in San Francisco—its first laptop-focused event in more than two years—a. Article summary: At its October 7, 2026 Windows and Surface event in San Francisco, Microsoft presented “hybrid intelligence” as a way for Windows to run AI locally when practical and use the cloud when needed. Windows chief Pavan Davulu. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Tại sự kiện Windows và Surface ở San Francisco ngày 7/10/2026, Microsoft phác thảo một hướng đi mới cho Windows: AI không nhất thiết phải xử lý hoàn toàn trên đám mây. Theo Pavan Davuluri, lãnh đạo mảng Windows, các AI agent có thể chạy ngay trên PC khi phù hợp, chuyển lên đám mây khi cần và hoạt động trong phạm vi bảo mật, quản lý của Windows. Microsoft gọi cách kết hợp đó là “trí tuệ lai” (hybrid intelligence). 19
Điểm đáng chú ý không phải là mọi tác vụ AI sắp được chuyển hết về máy tính cá nhân. Thay vào đó, Microsoft muốn Windows điều phối mô hình chạy tại chỗ và mô hình trên đám mây như những phần của cùng một hệ thống.
Một số tác vụ có thể được xử lý bằng mô hình chạy trực tiếp trên PC, trong khi dịch vụ đám mây vẫn sẵn sàng cho những việc phù hợp hơn với chúng. Microsoft trình bày sự kết hợp này như nền tảng cho các tính năng AI và agent trên Windows, chứ không phải lời tuyên bố từ bỏ AI đám mây. 19
Để nhà phát triển dễ đưa thêm mô hình vào Windows, Microsoft cho biết sẽ hỗ trợ llama.cpp trong Windows ML, môi trường chạy mô hình của hãng. Hỗ trợ này có thể giúp chạy thêm các mô hình mã nguồn mở thông qua lớp phần cứng được Windows hỗ trợ. 39
43
Microsoft nêu tên một số mô hình hướng đến chạy cục bộ, gồm DeepSeek V4 Flash, một mô hình Nemotron sắp tới của Nvidia và MAI Code 1.1 Flash của Microsoft, tập trung vào lập trình. 33
Theo thông tin được công bố, DeepSeek V4 Flash có tổng cộng 284 tỷ tham số và được lượng tử hóa xuống 1,6 bit để chạy trong khoảng 60 GB bộ nhớ. Microsoft mô tả năng lực của mô hình là “gần với nhóm tiên phong” (near-frontier). Đây là tuyên bố về hiệu năng, chưa phải kết quả benchmark độc lập được xác nhận trong các nguồn hiện có. 26
Mô hình Nemotron sắp tới của Nvidia được mô tả có hơn 70 tỷ tham số, lượng tử hóa ở mức 2 bit để cần hơn 20 GB bộ nhớ một chút. Một số tin đưa ra ngày 15/10 là thời điểm dự kiến; không nên xem đó là xác nhận rằng mô hình đã được phát hành. 26
33
Các con số bộ nhớ cũng cho thấy vì sao việc nén mô hình quan trọng. Nếu lưu 284 tỷ tham số ở mức 4 bit, riêng phần trọng số đã cần khoảng 142 GB, chưa tính bộ nhớ cho quá trình vận hành. Cấu hình 60 GB được nêu cho DeepSeek dựa vào mức lượng tử hóa mạnh hơn nhiều. Các nguồn hiện có chưa cho thấy phiên bản nén cụ thể này đã được kiểm tra độc lập ra sao, vì vậy những tuyên bố về chất lượng vẫn cần được xác minh. 26
Microsoft cũng giới thiệu các công cụ giúp nối mô hình với từng loại công việc. HydraFusion của GitHub có thể chuyển tác vụ đến mô hình phù hợp, trong đó có cả mô hình chạy trên PC. 39
Với những agent có thể tương tác với máy tính, Microsoft công bố Execution Containers — lớp cô lập nhằm giới hạn dữ liệu agent được truy cập và việc agent có thể thực hiện. Đây là phần quan trọng trong câu chuyện AI agent trên Windows: năng lực chạy tại chỗ càng nhiều thì càng cần xác định rõ ranh giới quyền truy cập. 34
Microsoft mở đặt trước Surface Laptop Ultra, mẫu máy dùng phần cứng Nvidia RTX Spark, với giá khởi điểm 2.599 USD. Microsoft liệt kê các cấu hình có tối đa 128 GB bộ nhớ hợp nhất — loại bộ nhớ được dùng chung cho các thành phần xử lý — nhằm hỗ trợ chạy mô hình lớn hơn ngay trên máy. 18
31
Tuy nhiên, mức giá và yêu cầu bộ nhớ cũng cho thấy một giới hạn thực tế: chạy mô hình lớn trên máy cá nhân có thể cần hệ thống đắt tiền, nhiều bộ nhớ. Giá DGX Spark riêng của Nvidia phản ánh áp lực chi phí tương tự: các tin đưa mức 6.950 USD cho phiên bản 128 GB và 4.999 USD cho phiên bản 64 GB mới. 3
Hướng đi Microsoft đặt ra khá rõ: Windows sẽ phối hợp AI chạy tại chỗ với AI trên đám mây, tạo đường hỗ trợ thêm mô hình mở và bổ sung biện pháp kiểm soát agent. Nhưng thông báo này chưa chứng minh rằng mô hình chạy cục bộ có thể ngang bằng dịch vụ đám mây trong mọi tác vụ; hiệu năng được nêu đã được kiểm chứng độc lập; hay AI trên thiết bị sẽ khiến điện toán đám mây trở nên không cần thiết.
Câu trả lời sẽ phụ thuộc vào thử nghiệm thực tế, mức độ sẵn có của phần mềm và cấu hình phần cứng người dùng sở hữu. Trước mắt, “trí tuệ lai” nên được hiểu là chiến lược nền tảng của Microsoft: dùng PC cho những việc AI có thể xử lý phù hợp tại chỗ, đồng thời vẫn giữ mô hình đám mây trong cuộc chơi.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Tại sự kiện ngày 7/10/2026, Microsoft giới thiệu “trí tuệ lai”: Windows phối hợp AI chạy trên PC với mô hình trên đám mây tùy theo nhu cầu.
Tại sự kiện ngày 7/10/2026, Microsoft giới thiệu “trí tuệ lai”: Windows phối hợp AI chạy trên PC với mô hình trên đám mây tùy theo nhu cầu. DeepSeek V4 Flash, Nemotron và hỗ trợ llama.cpp mở rộng lựa chọn mô hình AI chạy cục bộ; Microsoft cũng công bố công cụ định tuyến tác vụ và giới hạn quyền cho AI agent.
Surface Laptop Ultra dùng phần cứng Nvidia RTX Spark, có giá khởi điểm 2.599 USD; chạy mô hình lớn tại chỗ vẫn đòi hỏi bộ nhớ đáng kể và phần cứng đắt tiền.