Pinterest membangun fondasi AI multimodal bersama Nvidia agar tim produk dapat memakai infrastruktur yang sama untuk fitur berbasis gambar dan bahasa. Tumpukan teknologinya menggabungkan GPU Nvidia Blackwell B200, perangkat lunak penyajian model Nvidia Dynamo, serta embedding visual Pinterest yang telah dihitung seb...
Diterbitkan olehDiedit dengan GPT-5.6 TerraGambar dibuat dengan GPT Image 2
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: What did Pinterest announce about its new multimodal AI infrastructure layer developed with Nvidia—including the Blackwell GPU, Nvidia Dynam. Article summary: Pinterest announced a shared multimodal AI infrastructure layer with Nvidia designed to make image-and-language AI products faster, more scalable, and reusable across its platform—rather than requiring custom infrastruct. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Pinterest mengumumkan lapisan infrastruktur AI multimodal bersama Nvidia. Ini bukan satu fitur baru yang berdiri sendiri bagi pengguna, melainkan fondasi teknis bersama agar berbagai tim di Pinterest tidak perlu membangun sistem AI terpisah untuk setiap produk yang harus memahami gambar sekaligus bahasa. 4
6
Fondasi tersebut bertumpu pada tiga komponen utama:
Dengan pendekatan ini, Pinterest dapat memakai basis teknis yang sama untuk pencarian visual, asisten percakapan, pemahaman konten, dan sistem keamanan. Tujuannya adalah memperluas produk AI berbasis gambar dan bahasa dengan lebih mudah serta lebih konsisten. 4
6
Pinterest menyebut fondasi bersama ini mendukung pencarian visual, pemahaman konten, discovery dan belanja berbasis AI, Pinterest Assistant yang bersifat percakapan, multimodal reranking—penyusunan ulang hasil berdasarkan beragam sinyal—serta sistem keamanan konten dan pembuatan sinyal. 4
6
Intinya, fitur-fitur itu dapat mempertimbangkan dua jenis konteks sekaligus: kata-kata pengguna dan isi gambar. Bagi layanan discovery visual seperti Pinterest, kemampuan tersebut dapat membantu menafsirkan apa yang dicari pengguna, menemukan konten yang relevan, dan memperbaiki rekomendasi.
Pinterest mengatakan mereka memanfaatkan lebih dari 80 miliar pencarian per bulan untuk membentuk sinyal bagi discovery dan belanja berbasis AI. Infrastruktur baru ini dirancang agar sinyal tersebut lebih mudah digunakan dalam pengalaman yang makin visual dan percakapan. 6
Model visi-bahasa relatif mahal untuk dijalankan karena perlu menangani data gambar berukuran besar bersama teks, sekaligus memelihara cache model yang besar. Pinterest menggunakan projection embeddings, yang dalam liputan teknis disebut sebagai embedding PinCLIP. Teknologi ini memetakan informasi visual ke ruang token model. 2
10
Artinya, sebuah permintaan dapat memakai representasi visual yang sudah disiapkan sebelumnya, alih-alih berulang kali mengirim dan mengodekan gambar mentah. Pinterest melaporkan hasil berikut dari pendekatan tersebut dan optimasi Dynamo terkait:
Angka-angka itu adalah hasil benchmark yang dilaporkan perusahaan. Karena itu, hasilnya perlu dibaca sebagai pengukuran untuk arsitektur dan konfigurasi beban kerja tersebut, bukan jaminan bahwa setiap pencarian atau percakapan di Pinterest akan meningkat pada tingkat yang sama.
Pinterest dan Nvidia menyatakan kerja sama ini merupakan kelanjutan kolaborasi hampir lima tahun di bidang sistem rekomendasi dan AI generatif. Pinterest mengatakan armadanya mencakup 14.000 GPU Nvidia. 4
Skala itu menjelaskan sasaran strategisnya: satu lapisan penyajian model bersama dapat memudahkan Pinterest memperluas fitur AI visual dan percakapan, dengan infrastruktur yang tetap seragam di belakang layar. Studi kasus Nvidia menempatkan sistem ini sebagai platform bagi Pinterest Assistant, reranking, keamanan konten, hingga pembentukan sinyal. 4
Saham Pinterest naik sekitar 1,8% pada perdagangan Senin setelah pengumuman infrastruktur tersebut, menurut Investing.com. 1
7
Pinterest sedang beralih dari sistem AI yang dibangun per produk menuju fondasi multimodal yang lebih terpusat. Perangkat keras Blackwell menyediakan daya komputasi, Dynamo membantu penyajian dan pengaturan lalu lintas model, sementara embedding visual Pinterest mengurangi kebutuhan memproses gambar yang sama berulang kali. Kombinasi ini dirancang untuk membuat pengalaman pencarian visual, belanja, discovery, dan asisten lebih cepat dioperasikan serta lebih mudah diperluas di seluruh platform. 2
4
6
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Pinterest membangun fondasi AI multimodal bersama Nvidia agar tim produk dapat memakai infrastruktur yang sama untuk fitur berbasis gambar dan bahasa.
Pinterest membangun fondasi AI multimodal bersama Nvidia agar tim produk dapat memakai infrastruktur yang sama untuk fitur berbasis gambar dan bahasa. Tumpukan teknologinya menggabungkan GPU Nvidia Blackwell B200, perangkat lunak penyajian model Nvidia Dynamo, serta embedding visual Pinterest yang telah dihitung sebelumnya.
Pinterest melaporkan Pinterest Assistant dapat menangani 25 kali lebih banyak konteks visual per permintaan, dengan awal respons sekitar 85 kali lebih cepat dan latensi menyeluruh 7,3 kali lebih cepat dalam pengujian...