Pinterest สร้างรากฐาน AI แบบมัลติโหมดร่วมกับ Nvidia เพื่อให้ทีมต่าง ๆ นำโครงสร้างเดียวกันไปใช้กับผลิตภัณฑ์ที่เข้าใจทั้งภาพและภาษาได้ ระบบนี้ใช้ GPU Nvidia Blackwell B200, ซอฟต์แวร์ Nvidia Dynamo และ visual embeddings ของ Pinterest ซึ่งเตรียมข้อมูลภาพไว้ล่วงหน้าเพื่อลดการประมวลผลภาพซ้ำ Pinterest รายงานว่า Pinterest A...
เผยแพร่โดยแก้ไขด้วย GPT-5.6 Terraรูปภาพสร้างด้วย GPT Image 2
คำตอบการวิจัย

Create a landscape editorial hero image for this Studio Global article: What did Pinterest announce about its new multimodal AI infrastructure layer developed with Nvidia—including the Blackwell GPU, Nvidia Dynam. Article summary: Pinterest announced a shared multimodal AI infrastructure layer with Nvidia designed to make image-and-language AI products faster, more scalable, and reusable across its platform—rather than requiring custom infrastruct. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Pinterest ไม่ได้เปิดตัวฟีเจอร์สำหรับผู้ใช้เพียงรายการเดียว แต่กำลังวาง ชั้นโครงสร้าง AI กลาง ที่ให้ผลิตภัณฑ์หลายประเภทใช้ร่วมกันได้ เป้าหมายคือให้ทีมพัฒนาฟีเจอร์ที่ต้องเข้าใจทั้งรูปภาพและข้อความ ไม่ต้องสร้างระบบให้บริการโมเดลของตนเองใหม่ทุกครั้ง 4
6
แกนหลักของระบบใหม่นี้ประกอบด้วย 3 ส่วน
ภาพรวมจึงไม่ใช่การทำระบบแยกส่วนสำหรับการค้นหาด้วยภาพ ผู้ช่วยสนทนา หรือเครื่องมือความปลอดภัย แต่เป็นการสร้างฐานเทคโนโลยีเดียว ซึ่งต่อยอดฟีเจอร์เหล่านี้ได้ง่ายขึ้นและขยายขนาดได้มากขึ้น 6
Pinterest ระบุว่าชั้น AI ดังกล่าวรองรับงานที่ใช้ภาพและภาษาร่วมกัน เช่น การค้นหาด้วยภาพ การทำความเข้าใจเนื้อหา การค้นพบสินค้าและการช้อปปิ้งด้วย AI, Pinterest Assistant แบบสนทนา, การจัดอันดับซ้ำแบบมัลติโหมด, ระบบความปลอดภัยของเนื้อหา และการสร้างสัญญาณข้อมูล 4
6
ประเด็นสำคัญคือ AI สามารถพิจารณาได้ทั้งสิ่งที่ผู้ใช้พิมพ์ค้นหาและรายละเอียดในภาพ ซึ่งมีประโยชน์ต่อแพลตฟอร์มค้นหาไอเดียอย่าง Pinterest ไม่ว่าจะเป็นการตีความความต้องการ คัดเลือกเนื้อหาที่เกี่ยวข้อง หรือปรับคำแนะนำให้เหมาะกับผู้ใช้มากขึ้น
บริษัทระบุว่าใช้การค้นหามากกว่า 80,000 ล้านครั้งต่อเดือน เพื่อสร้างสัญญาณสำหรับการค้นพบและการช้อปปิ้งด้วย AI โดยโครงสร้างใหม่นี้มีเป้าหมายทำให้สัญญาณดังกล่าวนำไปใช้กับประสบการณ์ที่เน้นภาพและการสนทนาได้ดีขึ้น 6
โมเดลภาพ-ภาษามีต้นทุนการทำงานสูง เพราะต้องรับข้อมูลภาพขนาดใหญ่พร้อมข้อความ และจัดการข้อมูลแคชของโมเดลจำนวนมาก แนวทางของ Pinterest ใช้ projection embeddings หรือที่เรียกในเชิงเทคนิคว่า PinCLIP embeddings เพื่อแปลงข้อมูลภาพเข้าสู่พื้นที่โทเค็นของโมเดลโดยตรง
ผลคือ ในแต่ละคำขอ ระบบสามารถส่งตัวแทนของภาพที่คำนวณไว้แล้ว แทนการส่งและเข้ารหัสไฟล์ภาพดิบซ้ำทุกครั้ง 2
10
Pinterest รายงานผลด้านประสิทธิภาพจากแนวทางนี้และการปรับแต่ง Dynamo ดังนี้
ตัวเลขเหล่านี้เป็นผลเบนช์มาร์กที่บริษัทรายงานสำหรับสถาปัตยกรรมและรูปแบบงานที่ทดสอบ จึงไม่ใช่คำรับประกันว่าการค้นหาหรือทุกบทสนทนากับผู้ช่วยบน Pinterest จะเร็วขึ้นในระดับเดียวกันทั้งหมด
Pinterest และ Nvidia ระบุว่าความร่วมมือนี้ต่อยอดจากการทำงานร่วมกันมาเกือบ 5 ปี ครอบคลุมทั้งระบบแนะนำเนื้อหาและ generative AI โดย Pinterest มี GPU ของ Nvidia อยู่ในระบบรวม 14,000 ตัว 4
ขนาดของโครงสร้างดังกล่าวสะท้อนเป้าหมายเชิงกลยุทธ์: การมีชั้นให้บริการกลางช่วยให้ Pinterest ขยายฟีเจอร์ AI ที่ขับเคลื่อนด้วยภาพและการสนทนาได้ โดยยังใช้รากฐานเทคโนโลยีที่สอดคล้องกัน ตั้งแต่ Pinterest Assistant และการจัดอันดับซ้ำ ไปจนถึงความปลอดภัยของเนื้อหาและการสร้างสัญญาณข้อมูล 4
หลังการประกาศ หุ้น Pinterest เพิ่มขึ้นประมาณ 1.8% ในการซื้อขายวันจันทร์ ตามรายงานของ Investing.com 1
7
Pinterest กำลังเปลี่ยนจากระบบ AI ที่พัฒนาแยกตามผลิตภัณฑ์ ไปสู่รากฐานมัลติโหมดแบบรวมศูนย์ Blackwell ทำหน้าที่ด้านกำลังประมวลผล, Dynamo ช่วยให้บริการและจัดเส้นทางโมเดล ส่วน visual embeddings ช่วยลดการประมวลผลภาพซ้ำ
เมื่อรวมกันแล้ว เทคโนโลยีชุดนี้ถูกออกแบบมาเพื่อทำให้การค้นพบไอเดียด้วยภาพ การช้อปปิ้ง และประสบการณ์แบบผู้ช่วยสนทนา ดำเนินงานได้รวดเร็วขึ้นและขยายไปทั่วแพลตฟอร์มได้ง่ายขึ้น 2
4
6
Studio Global AI
หน้านี้รวมคำตอบที่ได้รับการสนับสนุนจากแหล่งที่มาซึ่งคุณสามารถดำเนินการต่อภายใน Studio Global
Pinterest สร้างรากฐาน AI แบบมัลติโหมดร่วมกับ Nvidia เพื่อให้ทีมต่าง ๆ นำโครงสร้างเดียวกันไปใช้กับผลิตภัณฑ์ที่เข้าใจทั้งภาพและภาษาได้
Pinterest สร้างรากฐาน AI แบบมัลติโหมดร่วมกับ Nvidia เพื่อให้ทีมต่าง ๆ นำโครงสร้างเดียวกันไปใช้กับผลิตภัณฑ์ที่เข้าใจทั้งภาพและภาษาได้ ระบบนี้ใช้ GPU Nvidia Blackwell B200, ซอฟต์แวร์ Nvidia Dynamo และ visual embeddings ของ Pinterest ซึ่งเตรียมข้อมูลภาพไว้ล่วงหน้าเพื่อลดการประมวลผลภาพซ้ำ
Pinterest รายงานว่า Pinterest Assistant รับบริบทภาพต่อคำขอได้มากขึ้น 25 เท่า ขณะที่ผลทดสอบชี้ว่าเวลาเริ่มตอบเร็วขึ้นราว 85 เท่า และความหน่วงตลอดกระบวนการดีขึ้น 7.3 เท่า