O Pinterest criou uma base compartilhada de IA multimodal com a Nvidia, evitando que cada equipe precise desenvolver uma infraestrutura própria para produtos que usam imagens e linguagem. A arquitetura reúne GPUs Nvidia Blackwell B200, o software de serving Nvidia Dynamo e embeddings visuais do Pinterest, que podem...
Publicado porEditado com GPT-5.6 TerraImagens geradas com GPT Image 2
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What did Pinterest announce about its new multimodal AI infrastructure layer developed with Nvidia—including the Blackwell GPU, Nvidia Dynam. Article summary: Pinterest announced a shared multimodal AI infrastructure layer with Nvidia designed to make image-and-language AI products faster, more scalable, and reusable across its platform—rather than requiring custom infrastruct. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
O anúncio do Pinterest não se resume a um novo recurso para o usuário. A empresa criou, com tecnologia da Nvidia, uma camada compartilhada de infraestrutura de IA para produtos que precisam interpretar imagens e linguagem ao mesmo tempo. A proposta é que diferentes equipes possam lançar recursos sem construir um sistema técnico específico para cada um deles. 4
6
A base reúne três elementos principais:
Na prática, a arquitetura busca transformar funções como busca visual, assistente conversacional e ferramentas de segurança em aplicações apoiadas pela mesma base técnica, em vez de projetos de infraestrutura isolados. 6
O Pinterest afirma que a camada serve a uma gama crescente de experiências que combinam imagens e texto: busca visual, compreensão de conteúdo, descoberta e compras com IA, o Pinterest Assistant, reranking multimodal — uma etapa que refina a ordem dos resultados —, sistemas de segurança de conteúdo e geração de sinais. 4
6
Esse tipo de IA pode considerar, ao mesmo tempo, o que a pessoa escreve e o que aparece nas imagens. Para uma plataforma voltada à descoberta visual, isso pode ajudar a interpretar melhor uma busca, localizar conteúdo relacionado e tornar recomendações mais relevantes.
A companhia diz usar mais de 80 bilhões de buscas mensais para gerar sinais que alimentam recursos de descoberta e compras com IA. A nova infraestrutura foi desenhada para aproveitar esses sinais em experiências cada vez mais visuais e conversacionais. 6
Modelos de visão e linguagem podem ser caros de operar: precisam lidar com arquivos de imagem grandes, texto e um volume relevante de dados temporários do modelo. A abordagem do Pinterest inclui embeddings de projeção, descritos em cobertura técnica como embeddings PinCLIP, que mapeiam informações visuais para o espaço de tokens do modelo. Assim, cada solicitação pode usar uma representação visual pronta, em vez de enviar e codificar repetidamente a imagem bruta. 2
10
O Pinterest divulgou três resultados de desempenho ligados a essa abordagem e às otimizações do Dynamo:
Os números são benchmarks reportados pela própria empresa. Portanto, refletem essa arquitetura e essa configuração de carga de trabalho, e não garantem o mesmo ganho em toda busca ou interação com o assistente.
Pinterest e Nvidia apresentam o trabalho como uma extensão de uma colaboração de quase cinco anos, que abrange sistemas de recomendação e IA generativa. Segundo o Pinterest, sua frota inclui 14 mil GPUs da Nvidia. 4
A escala ajuda a explicar o objetivo estratégico: uma camada comum de serving pode facilitar a expansão de recursos visuais e conversacionais, mantendo uma infraestrutura consistente por trás deles. A Nvidia posiciona o sistema como base para aplicações que vão do Pinterest Assistant ao reranking multimodal, à segurança de conteúdo e à geração de sinais. 4
Após o anúncio, as ações do Pinterest subiram cerca de 1,8% no pregão de segunda-feira, segundo a Investing.com. 1
7
O Pinterest está migrando de sistemas de IA desenvolvidos produto a produto para uma fundação multimodal centralizada. O hardware Blackwell fornece o processamento; o Dynamo ajuda a executar e direcionar os modelos; e os embeddings visuais reduzem o retrabalho de processamento de imagens.
Juntas, essas peças foram projetadas para tornar experiências de descoberta visual, compras e assistência conversacional mais fáceis de escalar e mais eficientes de operar em toda a plataforma. 2
4
6
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
O Pinterest criou uma base compartilhada de IA multimodal com a Nvidia, evitando que cada equipe precise desenvolver uma infraestrutura própria para produtos que usam imagens e linguagem.
O Pinterest criou uma base compartilhada de IA multimodal com a Nvidia, evitando que cada equipe precise desenvolver uma infraestrutura própria para produtos que usam imagens e linguagem. A arquitetura reúne GPUs Nvidia Blackwell B200, o software de serving Nvidia Dynamo e embeddings visuais do Pinterest, que podem ser pré calculados e reutilizados.
Segundo a empresa, o Pinterest Assistant passou a processar 25 vezes mais contexto visual por solicitação; testes também apontaram início de resposta cerca de 85 vezes mais rápido e latência total 7,3 vezes menor.