Il 7 ottobre 2026 Microsoft ha presentato l’“intelligenza ibrida” come strategia per Windows: usare il PC quando è adatto e ricorrere al cloud quando serve. Il piano integra modelli locali, supporto a llama.cpp in Windows ML, instradamento delle attività e strumenti di sicurezza per gli agenti, senza abbandonare l’A...
Pubblicato daModificato con GPT-6 LunaImmagini generate con GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Microsoft announce at its Oct. 7 Windows and Surface event in San Francisco—its first laptop-focused event in more than two years—a. Article summary: At its October 7, 2026 Windows and Surface event in San Francisco, Microsoft presented “hybrid intelligence” as a way for Windows to run AI locally when practical and use the cloud when needed. Windows chief Pavan Davulu. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
All’evento Windows e Surface del 7 ottobre 2026 a San Francisco, Microsoft ha delineato un futuro in cui le attività di intelligenza artificiale possono spostarsi tra il PC e il cloud. Pavan Davuluri, responsabile di Windows, ha definito questa visione «intelligenza ibrida»: gli agenti dovrebbero funzionare in locale quando ha senso, rivolgersi al cloud quando necessario e rispettare i controlli di sicurezza e gestione di Windows. 19
La novità non è che ogni operazione AI debba lasciare il cloud per finire su un portatile. L’obiettivo di Microsoft è piuttosto fare in modo che Windows coordini modelli locali e cloud come componenti di un unico sistema.
Alcune attività potranno essere svolte dai modelli sul PC, mentre per le altre resteranno disponibili i modelli cloud. Microsoft ha presentato questa combinazione come base per gli agenti e le funzioni AI di Windows, non come sostituto dei servizi online. 19
Per semplificare l’esecuzione di modelli in locale, l’azienda ha annunciato il supporto a llama.cpp in Windows ML, il runtime di Windows per i modelli. Per gli sviluppatori, l’integrazione può offrire un modo per usare più modelli open source attraverso lo stack hardware supportato da Windows. 39
43
Microsoft ha indicato diversi modelli destinati all’esecuzione locale, tra cui DeepSeek V4 Flash, il futuro Nemotron di Nvidia e MAI Code 1.1 Flash, il modello di Microsoft per la programmazione. 33
Secondo quanto riportato, DeepSeek V4 Flash ha 284 miliardi di parametri complessivi ed è quantizzato a 1,6 bit per rientrare in circa 60 GB di memoria. Microsoft ne ha descritto le capacità come «near-frontier», cioè vicine a quelle dei modelli più avanzati. Si tratta però di una valutazione sulle prestazioni, non di un risultato confermato da benchmark indipendenti nelle fonti disponibili. 26
Il prossimo modello Nemotron di Nvidia è stato descritto come dotato di oltre 70 miliardi di parametri e quantizzato a 2 bit, per occupare poco più di 20 GB di memoria. Le notizie sull’annuncio indicavano il 15 ottobre come data prevista: va quindi considerata una data pianificata, non la conferma che il modello sia già stato distribuito. 26
33
I requisiti di memoria mostrano quanto conti la compressione. Con 4 bit per parametro, i soli pesi di un modello da 284 miliardi di parametri richiederebbero circa 142 GB, senza contare la memoria aggiuntiva necessaria durante l’esecuzione. La configurazione da circa 60 GB riportata per DeepSeek si basa su una quantizzazione molto più aggressiva. Le fonti disponibili non dimostrano come questa versione compressa si comporti in test indipendenti: le dichiarazioni sulla qualità andranno quindi verificate. 26
Microsoft ha presentato anche strumenti per abbinare i modelli alle diverse attività. L’approccio HydraFusion di GitHub può indirizzare un compito verso il modello più adatto, includendo tra le opzioni quelli eseguiti sul PC. 39
Per gli agenti capaci di interagire con il computer, Microsoft ha annunciato gli Execution Containers, un livello di isolamento pensato per limitare ciò che un agente può vedere o fare. Il controllo degli accessi è una parte importante del progetto: più capacità locali significano anche più attenzione nel definire i confini operativi degli agenti. 34
Microsoft ha aperto i preordini del Surface Laptop Ultra, un portatile basato sull’hardware Nvidia RTX Spark. Il prezzo parte da 2.599 dollari e Microsoft indica configurazioni con un massimo di 128 GB di memoria unificata. 18
31
Questa dotazione punta a rendere pratico l’uso locale di modelli più grandi, ma prezzo e requisiti di memoria mettono in evidenza un limite: eseguire modelli impegnativi su un computer personale può richiedere sistemi costosi e con molta memoria. Anche i prezzi del DGX Spark, il sistema separato di Nvidia, riflettono questa pressione: secondo le notizie, la versione da 128 GB costa 6.950 dollari, mentre il nuovo modello da 64 GB parte da 4.999 dollari. 3
La direzione scelta da Microsoft è chiara: Windows dovrebbe coordinare l’AI locale e quella cloud, facilitare l’uso di più modelli aperti e introdurre controlli per gli agenti. L’evento, però, non dimostra che i modelli locali siano all’altezza dei servizi cloud in ogni attività, che le prestazioni annunciate siano state convalidate da test indipendenti o che l’AI sul dispositivo renderà superfluo il cloud. La risposta dipenderà dalle prove sul campo, dalla disponibilità dei software e dall’hardware a disposizione degli utenti.
Per ora, «intelligenza ibrida» si legge soprattutto come una strategia per la piattaforma: Windows cercherà di affidare al PC le attività AI adatte, mantenendo i modelli cloud nella combinazione.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Il 7 ottobre 2026 Microsoft ha presentato l’“intelligenza ibrida” come strategia per Windows: usare il PC quando è adatto e ricorrere al cloud quando serve.
Il 7 ottobre 2026 Microsoft ha presentato l’“intelligenza ibrida” come strategia per Windows: usare il PC quando è adatto e ricorrere al cloud quando serve. Il piano integra modelli locali, supporto a llama.cpp in Windows ML, instradamento delle attività e strumenti di sicurezza per gli agenti, senza abbandonare l’AI cloud.
Sono aperti i preordini del Surface Laptop Ultra con hardware Nvidia RTX Spark: prezzo di partenza, 2.599 dollari.
Il 7 ottobre 2026 Microsoft ha presentato l’“intelligenza ibrida” come strategia per Windows: usare il PC quando è adatto e ricorrere al cloud quando serve. Il piano integra modelli locali, supporto a llama.cpp in Windows ML, instradamento delle attività e strumenti di sicurezza per gli agenti, senza abbandonare l’A...
Pubblicato daModificato con GPT-6 LunaImmagini generate con GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Microsoft announce at its Oct. 7 Windows and Surface event in San Francisco—its first laptop-focused event in more than two years—a. Article summary: At its October 7, 2026 Windows and Surface event in San Francisco, Microsoft presented “hybrid intelligence” as a way for Windows to run AI locally when practical and use the cloud when needed. Windows chief Pavan Davulu. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
All’evento Windows e Surface del 7 ottobre 2026 a San Francisco, Microsoft ha delineato un futuro in cui le attività di intelligenza artificiale possono spostarsi tra il PC e il cloud. Pavan Davuluri, responsabile di Windows, ha definito questa visione «intelligenza ibrida»: gli agenti dovrebbero funzionare in locale quando ha senso, rivolgersi al cloud quando necessario e rispettare i controlli di sicurezza e gestione di Windows. 19
La novità non è che ogni operazione AI debba lasciare il cloud per finire su un portatile. L’obiettivo di Microsoft è piuttosto fare in modo che Windows coordini modelli locali e cloud come componenti di un unico sistema.
Alcune attività potranno essere svolte dai modelli sul PC, mentre per le altre resteranno disponibili i modelli cloud. Microsoft ha presentato questa combinazione come base per gli agenti e le funzioni AI di Windows, non come sostituto dei servizi online. 19
Per semplificare l’esecuzione di modelli in locale, l’azienda ha annunciato il supporto a llama.cpp in Windows ML, il runtime di Windows per i modelli. Per gli sviluppatori, l’integrazione può offrire un modo per usare più modelli open source attraverso lo stack hardware supportato da Windows. 39
43
Microsoft ha indicato diversi modelli destinati all’esecuzione locale, tra cui DeepSeek V4 Flash, il futuro Nemotron di Nvidia e MAI Code 1.1 Flash, il modello di Microsoft per la programmazione. 33
Secondo quanto riportato, DeepSeek V4 Flash ha 284 miliardi di parametri complessivi ed è quantizzato a 1,6 bit per rientrare in circa 60 GB di memoria. Microsoft ne ha descritto le capacità come «near-frontier», cioè vicine a quelle dei modelli più avanzati. Si tratta però di una valutazione sulle prestazioni, non di un risultato confermato da benchmark indipendenti nelle fonti disponibili. 26
Il prossimo modello Nemotron di Nvidia è stato descritto come dotato di oltre 70 miliardi di parametri e quantizzato a 2 bit, per occupare poco più di 20 GB di memoria. Le notizie sull’annuncio indicavano il 15 ottobre come data prevista: va quindi considerata una data pianificata, non la conferma che il modello sia già stato distribuito. 26
33
I requisiti di memoria mostrano quanto conti la compressione. Con 4 bit per parametro, i soli pesi di un modello da 284 miliardi di parametri richiederebbero circa 142 GB, senza contare la memoria aggiuntiva necessaria durante l’esecuzione. La configurazione da circa 60 GB riportata per DeepSeek si basa su una quantizzazione molto più aggressiva. Le fonti disponibili non dimostrano come questa versione compressa si comporti in test indipendenti: le dichiarazioni sulla qualità andranno quindi verificate. 26
Microsoft ha presentato anche strumenti per abbinare i modelli alle diverse attività. L’approccio HydraFusion di GitHub può indirizzare un compito verso il modello più adatto, includendo tra le opzioni quelli eseguiti sul PC. 39
Per gli agenti capaci di interagire con il computer, Microsoft ha annunciato gli Execution Containers, un livello di isolamento pensato per limitare ciò che un agente può vedere o fare. Il controllo degli accessi è una parte importante del progetto: più capacità locali significano anche più attenzione nel definire i confini operativi degli agenti. 34
Microsoft ha aperto i preordini del Surface Laptop Ultra, un portatile basato sull’hardware Nvidia RTX Spark. Il prezzo parte da 2.599 dollari e Microsoft indica configurazioni con un massimo di 128 GB di memoria unificata. 18
31
Questa dotazione punta a rendere pratico l’uso locale di modelli più grandi, ma prezzo e requisiti di memoria mettono in evidenza un limite: eseguire modelli impegnativi su un computer personale può richiedere sistemi costosi e con molta memoria. Anche i prezzi del DGX Spark, il sistema separato di Nvidia, riflettono questa pressione: secondo le notizie, la versione da 128 GB costa 6.950 dollari, mentre il nuovo modello da 64 GB parte da 4.999 dollari. 3
La direzione scelta da Microsoft è chiara: Windows dovrebbe coordinare l’AI locale e quella cloud, facilitare l’uso di più modelli aperti e introdurre controlli per gli agenti. L’evento, però, non dimostra che i modelli locali siano all’altezza dei servizi cloud in ogni attività, che le prestazioni annunciate siano state convalidate da test indipendenti o che l’AI sul dispositivo renderà superfluo il cloud. La risposta dipenderà dalle prove sul campo, dalla disponibilità dei software e dall’hardware a disposizione degli utenti.
Per ora, «intelligenza ibrida» si legge soprattutto come una strategia per la piattaforma: Windows cercherà di affidare al PC le attività AI adatte, mantenendo i modelli cloud nella combinazione.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Il 7 ottobre 2026 Microsoft ha presentato l’“intelligenza ibrida” come strategia per Windows: usare il PC quando è adatto e ricorrere al cloud quando serve.
Il 7 ottobre 2026 Microsoft ha presentato l’“intelligenza ibrida” come strategia per Windows: usare il PC quando è adatto e ricorrere al cloud quando serve. Il piano integra modelli locali, supporto a llama.cpp in Windows ML, instradamento delle attività e strumenti di sicurezza per gli agenti, senza abbandonare l’AI cloud.
Sono aperti i preordini del Surface Laptop Ultra con hardware Nvidia RTX Spark: prezzo di partenza, 2.599 dollari.