MS는 빌드 2026에서 차세대 온디바이스 소형 언어 모델(SLM) 'Aion 1.0 인스트럭트'와 추론 및 도구 호출 특화 모델 'Aion 1.0 플랜'을 공개했다. 윈도우 AI API가 NPU를 넘어 CPU와 GPU까지 지원 범위를 대폭 확장하며, AMD·인텔·퀄컴·엔비디아 등 모든 실리콘 파트너사 하드웨어에서 구동된다.

Create a landscape editorial hero image for this Studio Global article: What did Microsoft announce at Build 2026 regarding its Aion 1.0 on-device AI models, the new Windows AI APIs that run across CPUs, GPUs, an. Article summary: At Build 2026 on June 2–3, Microsoft made three key announcements covering on-device AI models, expanded Windows AI APIs, and a dedicated developer workstation.. Topic tags: general, documentation, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "Microsoft expected to unveil new AI models and windows enhancements at build 2026: Report "Microsoft expected to unveil new AI models and windows enhancements at build 2026: Report" source context "Microsoft Expected to Unveil New AI Models and Windows ..." Reference image 2: visual subject "Sign up with your email below to instantly access member features,
2026년 6월 2일부터 3일까지 열린 마이크로소프트 빌드(Build) 2026에서, 사티아 나델라는 클라우드에 의존하던 AI의 무게 중심을 개인용 PC로 옮기는 대담한 청사진을 제시했다. 이 자리에서 마이크로소프트는 PC 자체가 AI 워크벤치가 되는 미래를 위한 세 가지 핵심 무기를 공개했다. 바로 새로운 온디바이스 AI 모델 'Aion 1.0', 모든 실리콘 파트너를 아우르는 '윈도우 AI API' 확장, 그리고 개발자들의 꿈의 머신 '서피스 RTX 스파크 데브 박스'다.
마이크로소프트는 기존 Phi-4-mini를 뛰어넘는 차세대 온디바이스 소형 언어 모델(SLM) 'Aion 1.0' 브랜드를 론칭하며 두 가지 모델을 선보였다 .
이 모델들은 앞으로 수개월 내에 정식 출시될 예정이며, 개발자들은 지금 바로 엣지(Edge) 브라우저에 내장된 AI 기능이나 윈도우 AI 개발자 포털을 통해 미리 체험해 볼 수 있다 . 이는 인터넷 연결 없이도 PC 자체에서 고도화된 AI 작업을 수행할 수 있는 시대가 성큼 다가왔음을 의미한다.
마이크로소프트는 빌드 2026에서 윈도우 AI API의 대대적인 확장을 발표했다. 이제 이 API들은 Copilot+ PC의 전유물이었던 NPU(신경망처리장치)를 넘어, AMD, 인텔, 퀄컴, 엔비디아 등 모든 주요 실리콘 파트너의 CPU와 GPU에서도 작동한다 .
이 확장의 기반에는 **윈도우 ML(Windows ML)**이 있다. 이는 CPU, GPU, NPU 전반에서 AI 추론을 처리하는 내장 런타임으로, 이제 **마이크로소프트 파운드리 온 윈도우(Foundry on Windows)**와 통합되어 모델 선택부터 미세 조정, 최적화, 배포까지 AI 개발의 전체 수명 주기를 지원한다 . 특히 AMD는 빌드 2026에서 NPU 및 GPU 실행 공급자(Execution Provider)의 업데이트를 발표하며 NPU에서 첫 토큰 생성 시간(TTFT)을 최대 1.5배까지 개선했다고 밝혔다
.
이날 가장 큰 하드웨어 발표는 단연 **서피스 RTX 스파크 데브 박스(Surface RTX Spark Dev Box)**였다 . 이는 Xbox Series X를 연상시키는 알루미늄 바디의 컴팩트한 데스크톱으로, 케이스 전체가 히트싱크 역할을 하는 100W TDP 설계를 갖추고 있어 장시간의 AI 학습과 추론 작업을 소화할 수 있다
.
그 중심에는 엔비디아의 ARM 기반 RTX 스파크 슈퍼칩이 탑재되어, 무려 1페타플롭스(PFLOPS)의 AI 연산 성능과 CPU·GPU가 공유하는 128GB의 통합 메모리를 제공한다 . 이는 최대 1,200억 개의 매개변수를 가진 대규모 언어 모델(LLM)도 로컬에서 구동할 수 있는 엄청난 능력이다
.
개발자가 별도의 세팅 없이 곧바로 작업에 착수할 수 있도록, 이 기기에는 Visual Studio Code, 윈도우 터미널 속 GitHub Copilot, WSL, PowerShell 7 등이 사전 구성된 개발자 최적화 윈도우 11 프로 환경이 탑재되며, AI 에이전트를 위한 로컬 샌드박싱 기능도 포함된다 . 서피스 RTX 스파크 데브 박스는 올해 말 미국 시장에 먼저 출시될 예정이며, 가격은 아직 공개되지 않았다
.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
MS는 빌드 2026에서 차세대 온디바이스 소형 언어 모델(SLM) 'Aion 1.0 인스트럭트'와 추론 및 도구 호출 특화 모델 'Aion 1.0 플랜'을 공개했다.
MS는 빌드 2026에서 차세대 온디바이스 소형 언어 모델(SLM) 'Aion 1.0 인스트럭트'와 추론 및 도구 호출 특화 모델 'Aion 1.0 플랜'을 공개했다. 윈도우 AI API가 NPU를 넘어 CPU와 GPU까지 지원 범위를 대폭 확장하며, AMD·인텔·퀄컴·엔비디아 등 모든 실리콘 파트너사 하드웨어에서 구동된다.
개발자를 위한 컴팩트 데스크톱 워크스테이션 '서피스 RTX 스파크 데브 박스'가 발표되었다. 최대 1페타플롭스의 AI 연산 성능과 128GB 통합 메모리를 갖췄다.