Det här är inte ett enkelt beslutsträd baserat på filstorlek eller uppgiftstyp. Som Srinivas förklarade är det orkestratorn som "resonerar om vilket arbete som ska köras på din enhet och vilket arbete som ska gå till agenter i molnet" i realtid .
Tillkännagivandet på Computex lyfte fram flera kärnfunktioner som positionerar orkestratorn för företagsanvändning:
Designad för att vara chipsoberoende
Trots att demot på scenen uteslutande använde Intel-hårdvara, betonade Perplexity att orkestratorn inte är låst till Intels ekosystem. I en intervju efter keynote-talet kallade vd Aravind Srinivas uttryckligen plattformen för "chipsoberoende", designad för att fungera över olika chiptillverkares produkter . Den initiala lanseringen på Intel-drivna Windows-datorer är en milstolpe i partnerskapet, inte en permanent inlåsning .
Massiv multimodell-orkestrering
Orkestratorn verkar inom Perplexitys bredare "Computer"-AI-operativsystem, som kan samordna upp till 20 olika AI-modeller samtidigt. För varje given deluppgift väljer systemet den optimala modellen baserat på dess kapacitet, hastighet och kostnad – vilket säkerställer att du inte använder en slägga för att knäcka en nöt .
En sann integritetsbrandvägg
För reglerade branscher som finans och sjukvård är det oumbärligt att hålla känslig data borta från tredje parts molnservrar. Orkestratorn fungerar som en integritetsvakt som säkerställer att regelefterlevnadsdokument analyseras lokalt innan något icke-känsligt sammanhang någonsin skickas till molnet för berikning .
Betydande kostnadsminskning
Att köra varje företags-AI-fråga genom en molnbaserad frontmodell blir oöverkomligt dyrt. Genom att intelligent avlasta enklare eller privata uppgifter till en NPU på enheten, uppskattas hybridmetoden minska inferenskostnaderna med 30 till 50 procent .
Livademot på Computex visade en bärbar dator driven av Intels nya Core Ultra Series 3-processor, byggd på företagets avancerade 18A-processnod . Demonstrationen visade hur en private equity-analytiker kunde ladda ett projekt med kodnamnet "Project Falcon" – komplett med sekretessavtal, finansiella modeller och konfidentiella utskrifter – och låta det lokala Intel-kislet hantera den känsliga dokumentanalysen medan molnagenter samtidigt hämtade extern marknadsresearch, allt utan att exponera privat data .
Intel ramade in samarbetet som ett bevis på att inferens på enheten inte längre är en nyhet. Core Ultra Series 3:s integrerade GPU och NPU kan hantera meningsfulla AI-arbetsbelastningar som tidigare var bundna till datacenter, vilket möjliggör en verklig arbetsfördelning som "maximerar tokenvärde per watt" . Vid lanseringen är hybridinferensen exklusiv för Perplexity-appen på Intel-drivna Windows-datorer, men orkestratorns underliggande arkitektur är designad för att stödja ett mycket bredare spektrum av hårdvara framöver .
Perplexity-Intel-demon var inget isolerat experiment – det var flaggskeppsnyheten för ett dominant tema på Computex 2026: distribution av AI-arbetsbelastningar över kantenheten och molnet.
Intel använde hela sin Computex-keynote för att förstärka denna distribuerade framtid, och tillkännagav kompletterande partnerskap med SambaNova, Vista Equity och Cambium för kostnadseffektiv inferens, och ramade in hybridberäkning som den arkitektoniska grunden för den kommande "agentiska AI-eran" .
Budskapet är tydligt: datacentret försvinner inte, men det är inte längre den enda platsen där intelligens skapas. I den hybridmodell som Perplexity och Intel satsar på är framtidens AI en konversation mellan din enhet och molnet – orkestrerad automatiskt, intelligent och privat.