O novo orquestrador de inferência híbrida da Perplexity, revelado na Computex 2026, analisa cada etapa de uma tarefa de IA e decide automaticamente se ela roda no seu PC (por privacidade) ou em servidores na nuvem (po... O sistema foi projetado para ser independente de fabricante de chip, apesar da parceria de lança...

Create a landscape editorial hero image for this Studio Global article: What is Perplexity AI's new "hybrid local/server agentic inference orchestrator" announced at Computex 2026, how does it dynamically split A. Article summary: Here is the full picture based on the announcements from Computex 2026.. Topic tags: general, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "# Perplexity’s new Computer is another bet that users need many AI models. The tool is available now, only on the company’s highest subscription tier, the $200/month Perplexity Max" source context "Perplexity's new Computer is another bet that users need many AI ..." Reference image 2: visual subject "# Perplexity AI unveils hybrid local-cloud inference system at Computex 2026. Perplexity AI, the fast-growing search startup now valued at $20 billion, unveiled
Na Computex 2026, o palco principal não foi tomado por um novo chip milagroso, mas por uma ideia que pode mudar a forma como usamos inteligência artificial no dia a dia. O CEO da Perplexity, Aravind Srinivas, e o CEO da Intel, Lip-Bu Tan, apresentaram uma solução para um dos maiores dilemas da IA corporativa: como usar o poder dos grandes modelos de nuvem sem jogar seus dados confidenciais em servidores de terceiros .
A resposta é um software que atua como um verdadeiro "controlador de voo" para tarefas de IA. Em vez de forçar o usuário a escolher entre uma IA local limitada ou uma IA de nuvem invasiva, essa nova camada de orquestração disseca uma tarefa complexa automaticamente. Ela mantém as partes sensíveis trancadas no seu computador e envia apenas as partes que exigem mais poder computacional para a nuvem. O resultado é uma resposta única e integrada, costurada a partir desses dois mundos — e, segundo análises iniciais do ecossistema, com uma potencial redução de 30% a 50% nos custos de inferência .
A Perplexity chama seu novo sistema de "orquestrador de inferência agêntica híbrida local-servidor", e a analogia com um controlador de tráfego aéreo é perfeita. Quando você pede, por exemplo, para analisar um acordo de investimento ultrassecreto, ele não envia cegamente todos os seus arquivos para um modelo de fronteira em um data center distante .
O processo segue quatro etapas lógicas:
Isso vai muito além de uma simples árvore de decisão baseada no tipo de arquivo. Como explicou Srinivas, o orquestrador está constantemente "raciocinando sobre qual trabalho deve rodar no seu dispositivo e qual deve ir para os agentes na nuvem" em tempo real .
O anúncio da Computex destacou várias capacidades que posicionam este orquestrador para uso profissional imediato:
Independência de Fabricante (Chip Agnostic)
Embora a demonstração no palco tenha usado exclusivamente hardware Intel, a Perplexity fez questão de frisar que o sistema não está preso ao ecossistema da Intel. Em entrevista após a palestra, Srinivas chamou a plataforma explicitamente de "agnóstica a chips", projetada para funcionar com silício de diferentes fornecedores . O lançamento inicial em PCs Windows com processadores Intel é um marco de parceria, não uma exclusividade permanente
.
Orquestração Massiva de Múltiplos Modelos
O orquestrador opera dentro do sistema operacional de IA "Perplexity Computer", que pode coordenar até 20 modelos de IA diferentes simultaneamente. Para cada tarefa, o sistema seleciona o modelo ideal com base em sua capacidade, velocidade e custo — garantindo que você não use uma marreta para matar uma formiga .
Um Verdadeiro Firewall de Privacidade
Para setores regulados como finanças e saúde, a ideia de manter dados sensíveis longe de servidores de nuvem de terceiros não é negociável. O orquestrador atua como um guardião da privacidade, garantindo que documentos relacionados a compliance sejam analisados localmente antes que qualquer contexto não sensível seja enviado à nuvem para enriquecimento .
Redução Significativa de Custos
Executar cada consulta empresarial de IA por meio de um modelo de fronteira hospedado na nuvem está se tornando proibitivamente caro. Ao descarregar de forma inteligente as tarefas mais simples ou privadas para uma NPU no dispositivo, a abordagem híbrida pode, segundo estimativas, reduzir os custos de inferência entre 30% e 50% .
A demonstração ao vivo na Computex apresentou um laptop equipado com o novo processador Intel Core Ultra Série 3, construído no avançado nó de processo 18A da empresa . O exemplo prático foi claro: um analista de private equity precisava analisar um projeto confidencial, o "Projeto Falcon", repleto de NDAs, modelos financeiros e transcrições sigilosas. O silício local da Intel cuidou da análise dos documentos sensíveis, enquanto agentes na nuvem buscavam simultaneamente pesquisas de mercado externas — tudo sem expor um único dado privado
.
A Intel enquadrou a colaboração como a prova de que a inferência no dispositivo não é mais uma curiosidade. A GPU e NPU integradas da linha Core Ultra Série 3 já conseguem lidar com cargas de trabalho de IA significativas que antes estavam restritas a data centers, permitindo uma divisão de trabalho genuína que "maximiza o valor por token por watt" . No lançamento, a capacidade de inferência híbrida é exclusiva do aplicativo Perplexity em PCs Windows com processadores Intel, mas a arquitetura subjacente do orquestrador foi projetada para suportar uma gama muito maior de hardware no futuro
.
A demonstração da Perplexity com a Intel não foi um experimento isolado — foi o anúncio símbolo de um tema dominante na Computex 2026: a distribuição de cargas de trabalho de IA entre a borda e a nuvem.
A mensagem é clara: o data center não está desaparecendo, mas ele não é mais o único lugar onde a inteligência acontece. No modelo híbrido em que Perplexity e Intel estão apostando, o futuro da IA é uma conversa automática, inteligente e privada entre o seu dispositivo e a nuvem.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
O novo orquestrador de inferência híbrida da Perplexity, revelado na Computex 2026, analisa cada etapa de uma tarefa de IA e decide automaticamente se ela roda no seu PC (por privacidade) ou em servidores na nuvem (po...
O novo orquestrador de inferência híbrida da Perplexity, revelado na Computex 2026, analisa cada etapa de uma tarefa de IA e decide automaticamente se ela roda no seu PC (por privacidade) ou em servidores na nuvem (po... O sistema foi projetado para ser independente de fabricante de chip, apesar da parceria de lançamento com os novos processadores Intel Core Ultra Série 3, sendo parte central da tendência de distribuir cargas de IA pa...