Il ne s'agit pas d'un simple tri basé sur la taille du fichier. Comme l'a expliqué Aravind Srinivas, l'orchestrateur « raisonne sur le travail qui doit être exécuté sur votre appareil et celui qui doit être confié aux agents dans le cloud », le tout en temps réel .
L'annonce du Computex a mis en lumière plusieurs capacités fondamentales positionnant cet orchestrateur pour le monde professionnel.
Une conception universelle, sans préférence de marque
Même si la démonstration sur scène utilisait exclusivement du matériel Intel, Perplexity a pris soin de souligner que l'orchestrateur n'est pas verrouillé à l'écosystème du géant américain. Lors d'une interview après le discours d'ouverture, Aravind Srinivas a explicitement qualifié la plateforme d'« agnostique en matière de puces », conçue pour fonctionner avec les technologies de différents fabricants . Le lancement initial sur les PC Windows équipés de processeurs Intel est une étape partenariale, pas une exclusivité permanente .
Une orchestration multi-modèles massive
L'orchestrateur opère au sein du système d'exploitation IA plus large de Perplexity, « Computer », capable de coordonner jusqu'à 20 modèles d'IA différents simultanément. Pour chaque sous-tâche, le système sélectionne le modèle optimal en fonction de ses capacités, de sa rapidité et de son coût—s'assurant ainsi de ne pas utiliser un marteau-pilon pour écraser une mouche .
Un véritable pare-feu pour la vie privée
Pour les secteurs réglementés comme la finance ou la santé, il est hors de question de laisser des données sensibles circuler sur des serveurs cloud tiers. L'orchestrateur agit comme un gardien de la vie privée, garantissant que les documents à enjeu de conformité sont analysés localement avant que le moindre contexte non sensible ne soit envoyé dans le cloud pour enrichissement .
Une réduction significative des coûts
Faire passer chaque requête IA d'entreprise par un modèle « frontière » hébergé dans le cloud devient prohibitif. En déchargeant intelligemment les tâches simples ou privées sur le NPU d'un appareil local, l'approche hybride est censée permettre d'économiser entre 30 et 50 % des coûts d'inférence .
La démonstration en direct au Computex mettait en scène un ordinateur portable propulsé par le nouveau processeur Intel Core Ultra Series 3, bâti sur le nœud technologique avancé 18A de la firme . Le cas pratique montrait comment un analyste en capital-investissement pouvait charger un projet nommé « Projet Falcon »—incluant des accords de confidentialité, des modèles financiers et des transcriptions confidentielles—et laisser la puce locale gérer l'analyse des documents sensibles pendant que les agents du cloud récupéraient simultanément des études de marché externes, le tout sans exposer les données privées .
Intel a présenté cette collaboration comme la preuve que l'inférence sur appareil n'est plus un gadget. Le GPU et le NPU intégrés du Core Ultra Series 3 peuvent absorber des charges de travail d'IA significatives qui étaient auparavant réservées aux centres de données, permettant une véritable division du travail qui « maximise la valeur du jeton par watt » . Au lancement, cette capacité d'inférence hybride est disponible en exclusivité via l'application Perplexity sur les PC Windows équipés de processeurs Intel, mais l'architecture sous-jacente de l'orchestrateur est conçue pour supporter une gamme de matériel bien plus large à l'avenir .
La démonstration Perplexity-Intel n'était pas une expérience isolée : ce fut l'annonce phare d'une tendance dominante au Computex 2026, à savoir la distribution des charges de travail IA entre les appareils en périphérie de réseau (« edge computing ») et le cloud.
Intel a utilisé l'intégralité de son discours d'ouverture au Computex pour marteler cet avenir distribué, annonçant des partenariats complémentaires avec SambaNova, Vista Equity et Cambium pour une inférence rentable, et présentant le calcul hybride comme le socle de l'ère à venir de « l'IA agentique » .
Le message est limpide : le centre de données ne disparaît pas, mais il n'est plus le seul endroit où l'intelligence opère. Dans le modèle hybride sur lequel misent Perplexity et Intel, l'avenir de l'IA est un dialogue entre votre appareil et le cloud—orchestré automatiquement, intelligemment, et dans le plus grand respect de votre vie privée.