Bloombergin mukaan Gemini 4 sai hyviä tuloksia alan vertailutesteissä, mutta työntekijät raportoivat vaikeuksista joissakin käytännön koodaustehtävissä. Aiemmissa Bloombergin jutuissa Googlen työntekijät olivat huolissaan Anthropicista ja OpenAI:sta sekä Gemini 3.5 Pron viivästymisestä koodauskykyjen parantamisen vu...
JulkaisijaMuokattu mallilla GPT-6 LunaKuvat luotu mallilla GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Bloomberg report about the gap between Gemini 4’s strong benchmark scores and its performance on real-world coding tasks, why does. Article summary: Bloomberg reported that Gemini 4 scores well on standard AI benchmarks, but some employees testing it say it struggles with certain coding tasks in actual use. That gap matters because Google is preparing to launch a fla. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
Bloombergin mukaan Gemini 4 menestyi hyvin yleisesti käytetyissä tekoälyn vertailutesteissä, mutta työntekijöiden kokemukset käytännön tehtävistä olivat ristiriitaisempia. Osa malliin suoraan tutustuneista työntekijöistä kertoi, että se takelteli joissakin koodaustehtävissä. Kyse oli nimettöminä puhuneiden työntekijöiden palautteesta, ei riippumattomasta, kattavasta arviosta mallin kaikista kyvyistä. 7
Google kiisti kritiikin. Samana päivänä julkaistun uutisen mukaan yhtiö esitteli Gemini 4 Argonin, mutta ei kertonut aikataulua sen laajalle julkiselle saatavuudelle. 5
10
Vertailutestit ja työntekijöiden arviot tiettyjen tehtävien sujumisesta ovat erilaista näyttöä. Bloombergin uutinen nostaa esiin kysymyksen siitä, näkyvätkö hyvät testitulokset myös koodaustyössä. Se ei kuitenkaan osoita, että Gemini 4 suoriutuisi heikosti kaikissa tosielämän käyttötarkoituksissa. 7
Kysymys on Googlelle merkityksellinen, sillä yhtiö pyrkii rakentamaan tekoälypohjaisia koodaustyökaluja ja kilpailee tällä alueella muiden tekoälykehittäjien kanssa. Bloomberg kertoi jo huhtikuussa, että Googlen sisällä oltiin huolissaan kilpailijoiden edistymisestä. Lähteiden mukaan Anthropicilla oli yrityskäyttöön työkaluja, joita pidettiin tehokkaampina ja suosituimpina. 4
Heinäkuussa Bloomberg raportoi myös Gemini 3.5 Pron viivästyneen kuukausia, kun Google yritti parantaa mallin kykyjä etenkin koodauksessa. Jutussa haastatellut työntekijät pelkäsivät Anthropic- ja OpenAI-mallien menevän Geminin edelle. 1 Reutersin mukaan Gemini 3.5 Prolla pyrittiin kuromaan eroa umpeen tekoälypohjaisissa koodaustyökaluissa ja agenttimaisissa tekoälytehtävissä.
2
Aiemmat jutut antavat taustaa kilpailutilanteelle, mutta ne käsittelevät Gemini 3.5 Prota ja Googlen laajempia huolia – eivät todista, että Gemini 4:llä olisi samat ongelmat tai että Google olisi hävinnyt kilpailun. Lähteet eivät myöskään kerro, miten Gemini 4:ää koskevat huolet vaikuttavat tiettyihin tuotteisiin tai asiakkaisiin. 2
4
7
Saatavilla olevien tietojen perusteella Gemini 3.5 Prota viivästettiin, kun Google työskenteli sen kykyjen, erityisesti koodauksen, parantamiseksi. Lähteet eivät vahvista, että yhtiö olisi hylännyt mallin. 1
2
Viivästys ei siis itsessään ole näyttöä perumisesta. Gemini 3.5 Prota koskevia uutisia ei myöskään pidä tulkita vahvistukseksi Gemini 4:n suorituskyvystä: Bloombergin jutussa kuvataan erillisiä työntekijöiden huolia. 1
7
Bloombergin uutisen ZeroHedge-välityksen mukaan Google piti Gemini 4:n koodauskykyä alisuoriutujana kuvaavaa arviota ”epätarkkana”. Googlen kommentti on ristiriidassa nimettöminä puhuneiden työntekijöiden kokemusten kanssa. Käytettävissä olevissa lähteissä ei ole julkista, riippumatonta testiä, joka ratkaisisi kiistan. 5
7
Ajoituskin vaatii tarkennusta: Bloomberg kertoi yhtiön sisäisistä epäilyistä mallin lähestyessä julkistusta, ja samana päivänä uutisoitiin Gemini 4 Argonin esittelystä. Laajan julkisen saatavuuden aikataulua ei tuolloin ollut ilmoitettu. 7
10
Bloombergin jutun jälkeen Alphabetin osakekurssi menetti osan päivän nousustaan. Investing.comiin viitanneen uutisen mukaan osake nousi aiemmin yli kaksi prosenttia, mutta oli lähellä pörssipäivän päätöstä enää noin 0,5 prosenttia plussalla. Kurssi siis laski päivän huipusta, mutta ei painunut edellisen päätöskurssin alapuolelle. 9
Uutinen nostaa esiin olennaisen kysymyksen: siirtyvätkö Gemini 4:n hyvät vertailutulokset työntekijöiden kokeilemiin koodaustehtäviin? Tähänastinen näyttö perustuu nimettömiin sisäisiin arvioihin ja Googlen vastaukseen, ei kattavaan julkiseen arviointiin. Gemini 3.5 Pron viivästyminen kertoo taustalla olevasta kilpailupaineesta, mutta ei todista, että malli olisi hylätty tai että Gemini 4 olisi yleisesti kilpailijoitaan jäljessä. 1
5
7
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Bloombergin mukaan Gemini 4 sai hyviä tuloksia alan vertailutesteissä, mutta työntekijät raportoivat vaikeuksista joissakin käytännön koodaustehtävissä.
Bloombergin mukaan Gemini 4 sai hyviä tuloksia alan vertailutesteissä, mutta työntekijät raportoivat vaikeuksista joissakin käytännön koodaustehtävissä. Aiemmissa Bloombergin jutuissa Googlen työntekijät olivat huolissaan Anthropicista ja OpenAI:sta sekä Gemini 3.5 Pron viivästymisestä koodauskykyjen parantamisen vuoksi.
Alphabetin osakekurssi luopui osasta päivän nousuaan: yli kahden prosentin nousu kutistui noin 0,5 prosenttiin lähellä päätöstä, mutta osake pysyi yhä plussalla.