Bloomberg napsal, že Gemini 4 dosahuje dobrých výsledků v běžně používaných testech, ale při zkoušení některých programátorských úkolů v praxi podle zaměstnanců zaostává. Google označil tvrzení o slabém výkonu v programování za nepřesné.
PublikovalUpraveno pomocí GPT-6 LunaObrázky vytvořeny pomocí GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Bloomberg report about the gap between Gemini 4’s strong benchmark scores and its performance on real-world coding tasks, why does. Article summary: Bloomberg reported that Gemini 4 scores well on standard AI benchmarks, but some employees testing it say it struggles with certain coding tasks in actual use. That gap matters because Google is preparing to launch a fla. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
Silné výsledky v testech ještě nezaručují, že si AI poradí stejně dobře s konkrétní prací. Právě na tenhle rozdíl upozornil Bloomberg ve zprávě o Gemini 4: model podle lidí s přímým přístupem k jeho vývoji bodoval v zavedených testech, ale u některých programátorských úkolů v praxi měl potíže. Jejich výpovědi jsou anonymní a nejde o nezávislé veřejné hodnocení všech schopností modelu. 7
Google kritiku odmítl. Ve stejný den navíc podle další zprávy představil Gemini 4 Argon, ale neuvedl, kdy bude model obecně dostupný. 5
10
Srovnávací testy, často označované jako benchmarky, měří výkon modelů podle předem stanovených úloh a pravidel. Zkušenost zaměstnanců s konkrétními pracovními úkoly je jiný typ důkazu. Bloombergovo zjištění naznačuje, že dobré výsledky v testech neodstranily všechny interní pochybnosti o tom, jak si Gemini 4 vede při programování. Neznamená to ale, že model selhává ve všech skutečných použitích. 7
Výkon při psaní kódu je důležitý v době, kdy Google vyvíjí nástroje s umělou inteligencí pro programátory a soutěží v této oblasti s dalšími firmami. Bloomberg už v dubnu informoval o obavách některých lidí z vedení Googlu, že firma ztrácí tempo. Podle tehdejší zprávy nabízela Anthropic nástroje pro programování, které zdroje označovaly za účinnější a oblíbenější u firem. 4
Také dřívější zprávy se týkaly vývoje modelů Gemini. V červenci Bloomberg napsal, že Gemini 3.5 Pro nabral několikaměsíční zpoždění, zatímco Google pracoval na jeho schopnostech, zejména v programování. Zaměstnanci citovaní ve zprávě se obávali, že modely Anthropic a OpenAI překonávají schopnosti Gemini. 1 Reuters uvedla, že Gemini 3.5 Pro měl Googlu pomoci dohnat konkurenci v nástrojích pro programování a úlohách, které AI zvládá jako samostatnější agent.
2
Tyto starší zprávy dokreslují konkurenční tlak, ale týkají se Gemini 3.5 Pro a širších obav uvnitř firmy. Samy o sobě nedokazují, že Gemini 4 trpí stejnými nedostatky nebo že Google v závodě o AI prohrává. Dostupné zdroje také neukazují, jak konkrétně se popsané potíže Gemini 4 promítají do produktů či zkušeností zákazníků. 2
4
7
Dostupné zprávy popisují několikaměsíční zpoždění Gemini 3.5 Pro a snahu Googlu zlepšit jeho schopnosti, především v programování. Nepotvrzují však, že firma model zrušila nebo opustila. 1
2
Zpoždění není důkazem zrušení projektu a informace o Gemini 3.5 Pro nelze zaměňovat za hodnocení Gemini 4. Bloombergova zpráva o novějším modelu popisuje samostatné pochybnosti zaměstnanců. 1
7
Google označil za „nepřesné“ tvrzení, že Gemini 4 podává slabý výkon v programování, jak uvedl Bloomberg podle zprávy ZeroHedge. Stanovisko firmy je v rozporu s anonymními výpověďmi zaměstnanců. Mezi dostupnými zdroji není nezávislý veřejný test, který by tento spor rozhodl. 5
7
V načasování zpráv je důležitý ještě jeden detail: zatímco Bloomberg psal o interní skepsi před uvedením modelu, další zpráva z téhož dne uvedla, že Google představil Gemini 4 Argon. Termín obecné dostupnosti ale společnost podle ní nesdělila. 7
10
Po zveřejnění zprávy se akcie Alphabetu posunuly z růstu o více než 2 % k přibližně 0,5 % nad úrovní předchozího závěru. Šlo tedy o zmenšení denního zisku, nikoli o pokles pod předchozí závěr. 9
Zpráva otevírá podstatnou otázku: zda se dobré výsledky Gemini 4 ve standardizovaných testech promítají i do programátorských úkolů, které zaměstnanci zkoušeli v praxi. Podklady tvoří anonymní interní výpovědi a odmítavá reakce Googlu, nikoli úplné veřejné hodnocení modelu. Zpoždění Gemini 3.5 Pro přidává kontext konkurenčního tlaku, ale nepotvrzuje, že byl model opuštěn ani že Gemini 4 celkově zaostává za konkurencí. 1
5
7
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Bloomberg napsal, že Gemini 4 dosahuje dobrých výsledků v běžně používaných testech, ale při zkoušení některých programátorských úkolů v praxi podle zaměstnanců zaostává.
Bloomberg napsal, že Gemini 4 dosahuje dobrých výsledků v běžně používaných testech, ale při zkoušení některých programátorských úkolů v praxi podle zaměstnanců zaostává. Google označil tvrzení o slabém výkonu v programování za nepřesné. Dostupné zdroje neobsahují nezávislé veřejné hodnocení, které by spor rozhodlo.
Alphabet po zveřejnění zprávy odevzdal část denních zisků: akcie se z růstu přes 2 % dostaly k zhruba 0,5 % nad předchozím závěrem.