Annoncé au Computex 2026, le nouvel orchestrateur d'inférence hybride de Perplexity analyse chaque sous tâche en temps réel pour décider si elle doit être traitée localement sur l'appareil pour des raisons de confiden... Conçu pour être indépendant de tout fabricant de puces, le système a été lancé en exclusivité su...

Create a landscape editorial hero image for this Studio Global article: What is Perplexity AI's new "hybrid local/server agentic inference orchestrator" announced at Computex 2026, how does it dynamically split A. Article summary: Here is the full picture based on the announcements from Computex 2026.. Topic tags: general, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "# Perplexity’s new Computer is another bet that users need many AI models. The tool is available now, only on the company’s highest subscription tier, the $200/month Perplexity Max" source context "Perplexity's new Computer is another bet that users need many AI ..." Reference image 2: visual subject "# Perplexity AI unveils hybrid local-cloud inference system at Computex 2026. Perplexity AI, the fast-growing search startup now valued at $20 billion, unveiled
Au Computex 2026, Aravind Srinivas, PDG de Perplexity, et Lip-Bu Tan, son homologue d'Intel, ne se sont pas contentés de monter sur scène pour une simple annonce. Ils ont dévoilé une nouvelle vision de l'intelligence artificielle : un orchestrateur hybride d'inférence « agentique », capable de scinder une tâche complexe pour en traiter la partie sensible sur votre machine, et déléguer le gros des calculs au cloud. Le résultat est une réponse unique, transparente pour l'utilisateur, et cousue main à partir de ces deux mondes. Selon les premières analyses de l'écosystème, cette approche pourrait réduire les coûts d'inférence de 30 à 50 % .
Perplexity décrit son orchestrateur comme un « contrôleur aérien » pour les tâches d'IA, et l'analogie est parlante . Imaginez : vous demandez à votre système d'analyser une opération d'investissement confidentielle, comme un contrat de fusion-acquisition assorti d'accords de non-divulgation. Au lieu d'envoyer aveuglément toutes vos informations à un modèle surpuissant hébergé dans un centre de données, le processus se déroule en quatre étapes bien distinctes.
Il ne s'agit pas d'un simple tri basé sur la taille du fichier. Comme l'a expliqué Aravind Srinivas, l'orchestrateur « raisonne sur le travail qui doit être exécuté sur votre appareil et celui qui doit être confié aux agents dans le cloud », le tout en temps réel .
L'annonce du Computex a mis en lumière plusieurs capacités fondamentales positionnant cet orchestrateur pour le monde professionnel.
Une conception universelle, sans préférence de marque
Même si la démonstration sur scène utilisait exclusivement du matériel Intel, Perplexity a pris soin de souligner que l'orchestrateur n'est pas verrouillé à l'écosystème du géant américain. Lors d'une interview après le discours d'ouverture, Aravind Srinivas a explicitement qualifié la plateforme d'« agnostique en matière de puces », conçue pour fonctionner avec les technologies de différents fabricants . Le lancement initial sur les PC Windows équipés de processeurs Intel est une étape partenariale, pas une exclusivité permanente
.
Une orchestration multi-modèles massive
L'orchestrateur opère au sein du système d'exploitation IA plus large de Perplexity, « Computer », capable de coordonner jusqu'à 20 modèles d'IA différents simultanément. Pour chaque sous-tâche, le système sélectionne le modèle optimal en fonction de ses capacités, de sa rapidité et de son coût—s'assurant ainsi de ne pas utiliser un marteau-pilon pour écraser une mouche .
Un véritable pare-feu pour la vie privée
Pour les secteurs réglementés comme la finance ou la santé, il est hors de question de laisser des données sensibles circuler sur des serveurs cloud tiers. L'orchestrateur agit comme un gardien de la vie privée, garantissant que les documents à enjeu de conformité sont analysés localement avant que le moindre contexte non sensible ne soit envoyé dans le cloud pour enrichissement .
Une réduction significative des coûts
Faire passer chaque requête IA d'entreprise par un modèle « frontière » hébergé dans le cloud devient prohibitif. En déchargeant intelligemment les tâches simples ou privées sur le NPU d'un appareil local, l'approche hybride est censée permettre d'économiser entre 30 et 50 % des coûts d'inférence .
La démonstration en direct au Computex mettait en scène un ordinateur portable propulsé par le nouveau processeur Intel Core Ultra Series 3, bâti sur le nœud technologique avancé 18A de la firme . Le cas pratique montrait comment un analyste en capital-investissement pouvait charger un projet nommé « Projet Falcon »—incluant des accords de confidentialité, des modèles financiers et des transcriptions confidentielles—et laisser la puce locale gérer l'analyse des documents sensibles pendant que les agents du cloud récupéraient simultanément des études de marché externes, le tout sans exposer les données privées
.
Intel a présenté cette collaboration comme la preuve que l'inférence sur appareil n'est plus un gadget. Le GPU et le NPU intégrés du Core Ultra Series 3 peuvent absorber des charges de travail d'IA significatives qui étaient auparavant réservées aux centres de données, permettant une véritable division du travail qui « maximise la valeur du jeton par watt » . Au lancement, cette capacité d'inférence hybride est disponible en exclusivité via l'application Perplexity sur les PC Windows équipés de processeurs Intel, mais l'architecture sous-jacente de l'orchestrateur est conçue pour supporter une gamme de matériel bien plus large à l'avenir
.
La démonstration Perplexity-Intel n'était pas une expérience isolée : ce fut l'annonce phare d'une tendance dominante au Computex 2026, à savoir la distribution des charges de travail IA entre les appareils en périphérie de réseau (« edge computing ») et le cloud.
Intel a utilisé l'intégralité de son discours d'ouverture au Computex pour marteler cet avenir distribué, annonçant des partenariats complémentaires avec SambaNova, Vista Equity et Cambium pour une inférence rentable, et présentant le calcul hybride comme le socle de l'ère à venir de « l'IA agentique » .
Le message est limpide : le centre de données ne disparaît pas, mais il n'est plus le seul endroit où l'intelligence opère. Dans le modèle hybride sur lequel misent Perplexity et Intel, l'avenir de l'IA est un dialogue entre votre appareil et le cloud—orchestré automatiquement, intelligemment, et dans le plus grand respect de votre vie privée.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Annoncé au Computex 2026, le nouvel orchestrateur d'inférence hybride de Perplexity analyse chaque sous tâche en temps réel pour décider si elle doit être traitée localement sur l'appareil pour des raisons de confiden...
Annoncé au Computex 2026, le nouvel orchestrateur d'inférence hybride de Perplexity analyse chaque sous tâche en temps réel pour décider si elle doit être traitée localement sur l'appareil pour des raisons de confiden... Conçu pour être indépendant de tout fabricant de puces, le système a été lancé en exclusivité sur les portables Intel Core Ultra Series 3, marquant une étape clé vers une architecture informatique distribuée qui vise...
L'approche combine un 'pare feu de confidentialité' pour les données sensibles et une orchestration multi modèles (jusqu'à 20 IA différentes), promettant jusqu'à 50 % d'économies en ne sollicitant le cloud que pour le...