Zamiast zmuszać użytkowników do wyboru między słabą, lokalną AI a inwazyjną dla prywatności chmurą, to oprogramowanie automatycznie rozbiera złożone zadanie na czynniki pierwsze. Wrażliwe dane pozostają bezpiecznie zamknięte na twoim komputerze, a kosztowne obliczeniowo elementy są wysyłane do chmury. Efektem jest jedna, spójna odpowiedź, zszyta z obu światów – a według wczesnych analiz, to może obniżyć koszty wnioskowania AI w firmach o 30–50% .
Perplexity opisuje swój orkiestrator jako „kontrolera ruchu lotniczego” dla zadań AI i to porównanie doskonale pasuje . Gdy poprosisz system o przeanalizowanie, dajmy na to, poufnej umowy inwestycyjnej, nie wyśle on ślepo wszystkich twoich danych do modelu w odległym centrum danych.
Proces składa się z czterech wyraźnych kroków:
To nie jest proste drzewko decyzyjne oparte na rozmiarze pliku czy typie zadania. Jak wyjaśnił Srinivas, to orkiestrator „rozumuje, która praca powinna być wykonana na twoim urządzeniu, a która powinna trafić do agentów w chmurze” w czasie rzeczywistym .
Ogłoszenie na Computex podkreśliło kilka kluczowych możliwości, które pozycjonują ten orkiestrator do zastosowań w przedsiębiorstwach:
Niezależność od chipa (Chip-Agnostic)
Mimo że demo na scenie wykorzystywało wyłącznie sprzęt Intela, Perplexity wyraźnie podkreśliło, że orkiestrator nie jest zamknięty w ekosystemie Intela. W wywiadzie po keynote'u, CEO Aravind Srinivas wprost nazwał platformę „niezależną od chipa”, zaprojektowaną do współpracy z krzemem różnych dostawców . Premiera na komputerach z Windows zasilanych przez Intela to kamień milowy partnerstwa, a nie trwałe zamknięcie .
Masowa orkiestracja wielu modeli
Orkiestrator działa w ramach szerszego systemu operacyjnego AI Perplexity o nazwie „Computer”, który może koordynować jednocześnie do 20 różnych modeli AI. Dla każdego podzadania system wybiera optymalny model, biorąc pod uwagę jego możliwości, szybkość i koszt – zapewniając, że nie używasz młota do rozbijania orzecha .
Prawdziwa zapora prywatności
Dla regulowanych branż, takich jak finanse i opieka zdrowotna, utrzymywanie wrażliwych danych z dala od serwerów firm trzecich to wymóg niepodlegający negocjacjom. Orkiestrator działa jak strażnik prywatności, zapewniając, że dokumenty podlegające przepisom są analizowane lokalnie, zanim jakikolwiek niewrażliwy kontekst zostanie wysłany do chmury w celu wzbogacenia .
Znacząca redukcja kosztów
Przeprowadzanie każdego zapytania AI w firmie przez ogromny model w chmurze staje się niebotycznie drogie. Inteligentne odciążanie prostszych lub prywatnych zadań do lokalnego NPU może, według szacunków, obniżyć koszty wnioskowania o 30 do 50 procent .
Demo na żywo na Computex zaprezentowano na laptopie wyposażonym w nowy procesor Intel Core Ultra Series 3, zbudowany w zaawansowanym procesie technologicznym 18A . Pokaz ujawnił, jak analityk private equity mógłby załadować projekt o kryptonimie „Project Falcon” – zawierający NDA, modele finansowe i poufne transkrypty – a lokalny krzem Intela zająłby się analizą wrażliwych dokumentów, podczas gdy agenci w chmurze jednocześnie ściągaliby zewnętrzne badania rynkowe, wszystko bez ujawniania prywatnych danych .
Intel przedstawił współpracę jako potwierdzenie, że wnioskowanie na urządzeniu nie jest już nowością. Zintegrowane GPU i NPU w Core Ultra Series 3 mogą obsłużyć znaczące obciążenia AI, które wcześniej były zarezerwowane dla centrów danych, umożliwiając prawdziwy podział pracy, który „maksymalizuje wartość tokena na wat” . Na starcie możliwość hybrydowego wnioskowania jest dostępna wyłącznie w aplikacji Perplexity na komputerach z Windows napędzanych przez Intela, ale podstawowa architektura orkiestratora jest zaprojektowana do obsługi znacznie szerszej gamy sprzętu w przyszłości .
Demo Perplexity i Intela nie było odosobnionym eksperymentem – było sztandarowym ogłoszeniem dominującego tematu na Computex 2026: dystrybucji obciążeń AI między urządzenia brzegowe a chmurę.
Intel wykorzystał cały swój keynote na Computex, aby wzmocnić tę rozproszoną wizję, ogłaszając uzupełniające się partnerstwa z SambaNova, Vista Equity i Cambium na rzecz opłacalnego wnioskowania, oraz przedstawiając hybrydowe obliczenia jako architektoniczny fundament nadchodzącej ery „agentowego AI” .
Przesłanie jest jasne: centra danych nie znikną, ale nie będą już jedynym miejscem, gdzie dzieje się inteligencja. W hybrydowym modelu, na który stawiają Perplexity i Intel, przyszłość AI to rozmowa między twoim urządzeniem a chmurą – prowadzona automatycznie, inteligentnie i z zachowaniem prywatności.