Il processo segue quattro fasi distinte:
Non si tratta di un semplice albero decisionale basato sulla dimensione del file o sul tipo di attività. Come ha spiegato Srinivas, è l'orchestratore che "ragiona su quale lavoro dovrebbe essere eseguito sul tuo dispositivo e quale lavoro dovrebbe andare agli agenti nel cloud" in tempo reale .
L'annuncio al Computex ha evidenziato diverse capacità fondamentali che posizionano questo orchestratore per l'uso aziendale:
Agnostico per progettazione
Nonostante la demo sul palco abbia utilizzato esclusivamente hardware Intel, Perplexity ha tenuto a sottolineare che l'orchestratore non è vincolato all'ecosistema Intel. In un'intervista successiva alla keynote, l'amministratore delegato Aravind Srinivas ha esplicitamente definito la piattaforma "agnostica rispetto al chip", progettata per funzionare su silicio di diversi fornitori . Il lancio iniziale sui PC Windows con processori Intel è una tappa fondamentale della partnership, non un blocco permanente .
Orchestrazione multi-modello di massa
L'orchestratore opera all'interno del più ampio sistema operativo AI "Computer" di Perplexity, che può coordinare fino a 20 diversi modelli AI contemporaneamente. Per ogni singola sottoattività, il sistema seleziona il modello ottimale in base alle sue capacità, velocità e costo, assicurandoti di non usare un martello pneumatico per schiacciare una noce .
Un vero firewall per la privacy
Per i settori regolamentati come la finanza e la sanità, mantenere i dati sensibili lontani dai server cloud di terze parti è un requisito imprescindibile. L'orchestratore funge da gatekeeper della privacy, garantendo che i documenti rilevanti per la conformità normativa vengano analizzati localmente prima che qualsiasi contesto non sensibile venga inviato al cloud per l'integrazione .
Riduzione significativa dei costi
Eseguire ogni singola query AI aziendale attraverso un modello cloud avanzato sta diventando proibitivamente costoso. Scaricando intelligentemente le attività più semplici o private su una NPU del dispositivo, si stima che l'approccio ibrido possa ridurre i costi di inferenza dal 30 al 50% .
La demo live al Computex ha mostrato un laptop alimentato dal nuovo processore Intel Core Ultra Series 3, costruito sul avanzato processo a 18A dell'azienda . La dimostrazione ha rivelato come un analista di private equity potesse caricare un progetto in codice chiamato "Project Falcon"—completo di NDA, modelli finanziari e trascrizioni riservate—e far sì che il silicio locale di Intel gestisse l'analisi dei documenti sensibili mentre gli agenti cloud recuperavano simultaneamente ricerche di mercato esterne, il tutto senza esporre dati privati .
Intel ha inquadrato la collaborazione come la conferma che l'inferenza sul dispositivo non è più una novità. La GPU e la NPU integrate del Core Ultra Series 3 possono gestire carichi di lavoro AI significativi che in precedenza erano confinati ai data center, consentendo una vera divisione del lavoro che "massimizza il valore del token per watt" . Al lancio, la capacità di inferenza ibrida è esclusiva dell'app Perplexity sui PC Windows con processori Intel, ma l'architettura sottostante dell'orchestratore è progettata per supportare una gamma molto più ampia di hardware in futuro .
La demo di Perplexity e Intel non è stato un esperimento isolato: è stato l'annuncio di punta di un tema dominante al Computex 2026: la distribuzione dei carichi di lavoro AI tra periferia e cloud.
Intel ha utilizzato l'intera keynote del Computex per rafforzare questo futuro distribuito, annunciando partnership complementari con SambaNova, Vista Equity e Cambium per un'inferenza economicamente vantaggiosa e inquadrando il calcolo ibrido come la base architettonica per la prossima era dell'"AI agenziale" .
Il messaggio è chiaro: il data center non sta scomparendo, ma non è più l'unico posto in cui risiede l'intelligenza. Nel modello ibrido su cui Perplexity e Intel stanno puntando, il futuro dell'AI è una conversazione tra il tuo dispositivo e il cloud, orchestrata automaticamente, intelligentemente e privatamente.