Pinterest har bygget en felles multimodal KI plattform med Nvidia, slik at team kan gjenbruke den samme infrastrukturen i produkter som tolker både bilder og språk. Løsningen kombinerer Nvidia Blackwell B200 GPU er, serverprogramvaren Nvidia Dynamo og Pinterests egne visuelle representasjoner, slik at bilder kan for...
Publisert avRedigert med GPT-5.6 TerraBilder generert med GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Pinterest announce about its new multimodal AI infrastructure layer developed with Nvidia—including the Blackwell GPU, Nvidia Dynam. Article summary: Pinterest announced a shared multimodal AI infrastructure layer with Nvidia designed to make image-and-language AI products faster, more scalable, and reusable across its platform—rather than requiring custom infrastruct. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Pinterest’ kunngjøring handler først og fremst om en felles og gjenbrukbar KI-infrastruktur, ikke om én enkelt ny funksjon for brukerne. Sammen med Nvidia har selskapet bygget et lag for produkter som må forstå bilder og språk i sammenheng. Dermed slipper hvert produktteam å etablere egne systemer for å kjøre KI-modeller for visuelle opplevelser. 4
6
Plattformen består av tre sentrale deler:
Målet er å gjøre produkter som kombinerer bilde- og språkforståelse enklere å sette i drift og skalere på tvers av Pinterest. Visuelt søk, en assistent og sikkerhetsverktøy kan dermed bygge på samme tekniske grunnmur, fremfor å være separate infrastrukturprosjekter. 6
Pinterest sier at det felles KI-laget støtter et voksende utvalg funksjoner som bruker både bilder og tekst. Det inkluderer visuelt søk, innholdsforståelse, KI-drevet oppdagelse og shopping, den samtalebaserte Pinterest Assistant, multimodal rerangering, systemer for innholdssikkerhet og signalgenerering. 4
6
For en tjeneste der folk leter etter ideer gjennom bilder, kan denne kombinasjonen være viktig: Systemet kan ta hensyn til både hva brukeren skriver og hva som faktisk vises i bildene. Det kan bidra til å tolke intensjonen bak et søk, finne mer relevant innhold og forbedre anbefalinger.
Pinterest opplyser at selskapet bruker mer enn 80 milliarder månedlige søk til å lage signaler for KI-drevet oppdagelse og shopping. Den nye infrastrukturen er ment å gjøre disse signalene mer anvendelige i stadig mer visuelle og samtalebaserte opplevelser. 6
Syns- og språkmodeller kan være kostbare å kjøre. De må håndtere store bildedata sammen med tekst og samtidig holde styr på betydelig modellcache. Pinterest bruker såkalte projeksjonsinnleiringer, omtalt som PinCLIP-embeddings i teknisk dekning, som kobler visuell informasjon til modellens token-rom. Det gjør at en forespørsel kan bruke en ferdigberegnet visuell representasjon i stedet for å sende og kode et råbilde på nytt hver gang. 2
10
Pinterest har rapportert tre resultater fra denne tilnærmingen og optimaliseringer i Dynamo:
Dette er tall rapportert av selskapet fra benchmarktester. De bør derfor leses som målinger av denne arkitekturen og arbeidslastkonfigurasjonen, ikke som en garanti for at hvert søk eller hver samtale med assistenten blir like mye raskere.
Pinterest og Nvidia beskriver arbeidet som en videreføring av et samarbeid som har vart i nesten fem år, innen både anbefalingssystemer og generativ KI. Pinterest oppgir at selskapets flåte omfatter 14 000 Nvidia-GPU-er. 4
Skalaen forklarer den strategiske tanken: Et felles lag for modellkjøring kan gjøre det enklere å utvide visuelle og samtalebaserte KI-funksjoner, samtidig som infrastrukturen under er konsistent. Nvidias kundecase plasserer systemet som en plattform for alt fra Pinterest Assistant til rerangering, innholdssikkerhet og signalgenerering. 4
Pinterest-aksjen steg rundt 1,8 prosent i mandagshandelen etter kunngjøringen, ifølge Investing.com. 1
7
Pinterest går fra KI-systemer bygget produkt for produkt til en sentral multimodal plattform. Blackwell-maskinvaren leverer regnekraften, Dynamo hjelper til med å kjøre og rute modellene, mens Pinterests visuelle representasjoner reduserer behovet for gjentatt bildebehandling. Til sammen skal dette gjøre visuelt søk, shopping og assistentlignende funksjoner raskere å drifte og lettere å skalere på plattformen. 2
4
6
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Pinterest har bygget en felles multimodal KI plattform med Nvidia, slik at team kan gjenbruke den samme infrastrukturen i produkter som tolker både bilder og språk.
Pinterest har bygget en felles multimodal KI plattform med Nvidia, slik at team kan gjenbruke den samme infrastrukturen i produkter som tolker både bilder og språk. Løsningen kombinerer Nvidia Blackwell B200 GPU er, serverprogramvaren Nvidia Dynamo og Pinterests egne visuelle representasjoner, slik at bilder kan forberedes én gang i stedet for å behandles på nytt for hver forespø...
Pinterest oppgir 25 ganger mer visuell kontekst per forespørsel i Pinterest Assistant, om lag 85 ganger raskere oppstart av svar og 7,3 ganger lavere ende til ende forsinkelse i benchmarktester.