Pinterest membina asas AI multimodal bersama Nvidia agar pasukan produknya boleh menggunakan semula infrastruktur bagi ciri yang memahami imej dan bahasa. Sistem ini menggabungkan GPU Nvidia Blackwell B200, perisian penyajian Nvidia Dynamo dan embedding visual Pinterest yang telah dikira lebih awal.
Diterbitkan olehDisunting dengan GPT-5.6 TerraImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Pinterest announce about its new multimodal AI infrastructure layer developed with Nvidia—including the Blackwell GPU, Nvidia Dynam. Article summary: Pinterest announced a shared multimodal AI infrastructure layer with Nvidia designed to make image-and-language AI products faster, more scalable, and reusable across its platform—rather than requiring custom infrastruct. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Pinterest bukan sekadar melancarkan satu ciri baharu untuk pengguna. Syarikat itu membina lapisan infrastruktur AI yang boleh digunakan semula bersama Nvidia, supaya pasukan produk tidak perlu membina sistem tersendiri setiap kali mahu melancarkan pengalaman AI berasaskan imej dan bahasa. 4
6
Asas teknikal ini bergantung pada tiga komponen utama:
Gabungan ini bertujuan menjadikan produk multimodal lebih mudah diskalakan dan digunakan di seluruh Pinterest. Maksudnya, carian visual, pembantu perbualan dan sistem keselamatan kandungan boleh dibina atas asas teknikal yang sama, bukannya sebagai projek infrastruktur yang terpisah-pisah. 6
Pinterest menyatakan lapisan bersama itu menyokong semakin banyak ciri yang menggunakan imej dan bahasa serentak, termasuk carian visual, pemahaman kandungan, penemuan dan beli-belah berasaskan AI, Pinterest Assistant yang bersifat perbualan, penarafan semula multimodal, sistem keselamatan kandungan serta penjanaan isyarat. 4
6
Bagi platform penemuan visual seperti Pinterest, keupayaan memahami kedua-dua kata-kata pengguna dan kandungan dalam imej membantu sistem mentafsir apa yang dicari, mengenal pasti kandungan relevan dan memperhalus cadangan.
Pinterest menggunakan lebih 80 bilion carian setiap bulan untuk menjana isyarat bagi penemuan dan beli-belah berasaskan AI. Infrastruktur baharu ini direka untuk menjadikan isyarat tersebut lebih berguna dalam pengalaman yang semakin visual dan bersifat perbualan. 6
Model visi-bahasa boleh mahal untuk dikendalikan kerana ia perlu memproses data imej yang besar bersama teks, selain mengurus keadaan cache model yang banyak. Pendekatan Pinterest menggunakan projection embeddings, yang turut dirujuk sebagai embedding PinCLIP dalam liputan teknikal. Ia memetakan maklumat visual ke dalam ruang token model. 2
10
Jadi, sistem boleh menggunakan representasi visual yang sudah tersedia, berbanding menghantar dan mengekod imej mentah berulang kali bagi setiap permintaan. Pinterest melaporkan hasil berikut daripada pendekatan itu dan pengoptimuman Dynamo berkaitan:
Angka ini ialah keputusan penanda aras yang dilaporkan syarikat. Ia menggambarkan prestasi seni bina dan konfigurasi beban kerja tersebut, bukannya jaminan bahawa setiap carian Pinterest atau interaksi dengan pembantu akan meningkat pada kadar yang sama.
Pinterest dan Nvidia menyifatkan inisiatif ini sebagai lanjutan kerjasama hampir lima tahun yang meliputi sistem cadangan dan AI generatif. Pinterest menyatakan ia mempunyai armada 14,000 GPU Nvidia. 4
Skala itu menerangkan matlamat strategiknya: lapisan penyajian yang sama membolehkan Pinterest memperluas ciri AI visual dan perbualan dengan lebih mudah, sambil mengekalkan infrastruktur yang konsisten di belakangnya. Kajian kes Nvidia meletakkan sistem ini sebagai platform untuk Pinterest Assistant, penarafan semula, keselamatan kandungan dan penjanaan isyarat. 4
Saham Pinterest naik kira-kira 1.8% dalam dagangan hari Isnin selepas pengumuman infrastruktur tersebut, menurut Investing.com. 1
7
Pinterest sedang beralih daripada sistem AI yang dibina satu demi satu mengikut produk kepada asas multimodal yang lebih berpusat. Perkakasan Blackwell menyediakan kuasa pengkomputeran, Dynamo membantu menyajikan serta menghala model, manakala embedding visual Pinterest mengurangkan pemprosesan imej yang berulang. Bersama-sama, komponen ini direka untuk menjadikan pengalaman carian visual, beli-belah dan pembantu AI lebih cekap untuk dikendalikan serta lebih mudah diperluas di seluruh platform. 2
4
6
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Pinterest membina asas AI multimodal bersama Nvidia agar pasukan produknya boleh menggunakan semula infrastruktur bagi ciri yang memahami imej dan bahasa.
Pinterest membina asas AI multimodal bersama Nvidia agar pasukan produknya boleh menggunakan semula infrastruktur bagi ciri yang memahami imej dan bahasa. Sistem ini menggabungkan GPU Nvidia Blackwell B200, perisian penyajian Nvidia Dynamo dan embedding visual Pinterest yang telah dikira lebih awal.
Pinterest melaporkan Pinterest Assistant boleh memproses 25 kali lebih banyak konteks visual bagi setiap permintaan, dengan permulaan respons kira kira 85 kali lebih pantas dan kependaman keseluruhan 7.3 kali lebih pa...