Perplexity noemt de orkestrator een 'luchtverkeersleider voor AI-taken' . Wanneer een gebruiker het systeem vraagt om bijvoorbeeld een vertrouwelijk investeringsdossier te analyseren, wordt niet klakkeloos alle data naar een ver model in een ver datacenter gestuurd. Het proces verloopt in vier stappen:
Dit is geen simpele beslisboom op basis van bestandsgrootte of taaktype. Srinivas legde uit dat de orkestrator 'redeneert over welk werk op je apparaat moet draaien en welk werk naar agenten in de cloud moet gaan' .
Chip-agnostisch ontwerp
Hoewel de demo op Computex exclusief gebruikmaakte van Intel-hardware, benadrukte Perplexity dat de orkestrator niet aan Intel's ecosysteem is gekoppeld. In een interview na de keynote noemde Srinivas het platform uitdrukkelijk 'chip-agnostisch' en ontworpen om met silicium van verschillende leveranciers te werken . De lancering op Intel-aangedreven Windows-pc's is een mijlpaal in een partnerschap, geen permanente uitsluiting .
Massale multi-modelorkestratie
De orkestrator werkt binnen Perplexity's bredere 'Computer' AI-besturingssysteem, dat tot twintig verschillende AI-modellen tegelijk kan coördineren. Voor elke subtaak selecteert het systeem het optimale model op basis van capaciteit, snelheid en kosten – zodat er geen mokerslag wordt gebruikt om een noot te kraken .
Een echte privacymuur
Voor gereguleerde sectoren zoals financiën en gezondheidszorg is het niet onderhandelbaar om gevoelige data niet naar servers van derden te sturen. De orkestrator fungeert als een privacypoortwachter en zorgt dat compliance-relevante documenten lokaal worden geanalyseerd voordat niet-gevoelige context naar de cloud wordt gestuurd .
Aanzienlijke kostenreductie
Het wordt steeds duurder om elke zakelijke AI-query via een cloudmodel te laten lopen. Door eenvoudige of private taken naar de lokale NPU te verplaatsen, kan de hybride aanpak de kosten van AI-berekeningen naar schatting met 30 tot 50 procent verlagen .
De live demo op Computex vond plaats op een laptop met Intel's nieuwe Core Ultra Series 3-processor, gebouwd op het geavanceerde 18A-procedé . De demonstratie liet zien hoe een private-equity-analist een project met de codenaam 'Project Falcon' kon laden – compleet met NDA's, financiële modellen en vertrouwelijke gespreksverslagen – en de lokale Intel-chip de gevoelige documentanalyse liet uitvoeren, terwijl cloudagenten tegelijkertijd extern marktonderzoek deden. Dit alles zonder dat privégegevens werden blootgesteld .
Intel presenteerde de samenwerking als bewijs dat lokale AI-berekeningen geen nieuwigheid meer zijn. De geïntegreerde GPU en NPU van de Core Ultra Series 3 kunnen betekenisvolle AI-workloads aan die voorheen alleen in datacenters konden draaien, waardoor een echte taakverdeling ontstaat die 'de tokenwaarde per watt maximaliseert' . Bij de lancering is de hybride inferentie exclusief beschikbaar in de Perplexity-app op Intel-aangedreven Windows-pc's, maar de onderliggende architectuur is ontworpen om een veel breder scala aan hardware te ondersteunen .
De Perplexity-Intel demo was geen geïsoleerd experiment; het was de belangrijkste aankondiging in een dominant thema op Computex 2026: de spreiding van AI-workloads over randapparaten en de cloud.
Intel gebruikte zijn hele Computex-keynote om deze gedistribueerde toekomst te onderstrepen, met aankondigingen van partnerschappen met SambaNova, Vista Equity en Cambium voor kostenefficiënte inferentie, en door hybride rekenkracht neer te zetten als de architecturale basis voor het komende 'agentic AI'-tijdperk .
De boodschap is duidelijk: het datacenter verdwijnt niet, maar het is niet langer de enige plek waar intelligentie plaatsvindt. In het hybride model waar Perplexity en Intel op inzetten, is de toekomst van AI een gesprek tussen je apparaat en de cloud – georkestreerd, automatisch, intelligent en privé.