בלומברג דיווחה כי Gemini 4 השיג תוצאות טובות במבחני ביצועים מקובלים, אך התקשה בחלק ממשימות הקידוד כשעובדים ניסו להשתמש בו. הדיווחים הקודמים על חששות בגוגל מפני התחרות עם Anthropic ו OpenAI ועל העיכוב ב Gemini 3.5 Pro מספקים הקשר — אך אינם מוכיחים שהמודל ננטש או ש Gemini 4 סובל מאותן בעיות.
פורסם על ידינערך באמצעות GPT-6 Lunaהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Bloomberg report about the gap between Gemini 4’s strong benchmark scores and its performance on real-world coding tasks, why does. Article summary: Bloomberg reported that Gemini 4 scores well on standard AI benchmarks, but some employees testing it say it struggles with certain coding tasks in actual use. That gap matters because Google is preparing to launch a fla. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
לפי בלומברג, Gemini 4 השיג תוצאות טובות במבחני ביצועים המקובלים בתעשייה, אך התקשה בחלק ממשימות הקידוד כשעובדים ניסו להפעיל אותו בפועל. מדובר בדיווחים של עובדים שביקשו להישאר בעילום שם — לא בבדיקה עצמאית ומקיפה של המודל. גוגל דחתה את הביקורת, ובדיווח מאותו יום נמסר כי חשפה את Gemini 4 Argon, בלי לקבוע מועד להפצה כללית. 7
5
10
אנשים בעלי היכרות ישירה עם הפרויקט אמרו לבלומברג כי Gemini 4 הצליח במבחני ביצועים מקובלים, אך התקשה במשימות קידוד מסוימות בשימוש מעשי. מאחר שהמקורות ביקשו אנונימיות, נכון להתייחס לדברים כאל משוב של עובדים — ולא כתוצאות של הערכה פומבית ועצמאית. 7
מבחני ביצועים ומשימות שמנסים לבצע בעבודה בפועל הם סוגים שונים של ראיות. הדיווח מצביע על כך שהתוצאות הטובות במבחנים לא הסירו את כל החששות הפנימיים בנוגע ליכולות הקידוד של המודל; הוא אינו מוכיח ש-Gemini 4 מתקשה בכל שימוש מעשי. 7
הנושא משמעותי על רקע התחרות על פיתוח כלי בינה מלאכותית לכתיבת קוד. בלומברג דיווחה באפריל כי בכירים בגוגל חששו שהחברה מפגרת בתחום, במיוחד לנוכח כלי הקידוד של Anthropic, שמקורות תיארו כיעילים ופופולריים יותר בקרב עסקים. 4
דיווח נפרד מיולי תיאר את Gemini 3.5 Pro כמודל שמתעכב בחודשים, בזמן שגוגל מנסה לשפר את יכולותיו — ובייחוד את יכולות הקידוד. עובדים שצוטטו בדיווח הביעו חשש שמודלים של Anthropic ושל OpenAI עולים ביכולותיהם על Gemini. 1 גם רויטרס דיווחה כי Gemini 3.5 Pro נועד לסייע לגוגל לצמצם פער בתחום כלי הקידוד ובמשימות של בינה מלאכותית סוכנית — מערכות שמסוגלות לבצע משימות מורכבות באופן אוטונומי יותר.
2
הדיווחים הקודמים מספקים הקשר לתחרות, אך הם עוסקים ב-Gemini 3.5 Pro ובחששות רחבים יותר — ואינם מוכיחים של-Gemini 4 יש אותן חולשות או שגוגל הפסידה במרוץ. שיפור בכתיבת קוד עשוי להיות חשוב למאמצי גוגל בתחום כלי הקידוד והמערכות הסוכניות, אך המקורות אינם קובעים כיצד הקשיים שדווחו משפיעים על מוצרים או לקוחות מסוימים. 2
4
7
הדיווחים הזמינים תומכים בכך ש-Gemini 3.5 Pro התעכב בזמן שגוגל עבדה על שיפור יכולותיו, ובפרט על הקידוד. הם אינם מוכיחים שהחברה נטשה את המודל. 1
2
חשוב להבחין בין עיכוב לבין ביטול. כמו כן, הדיווחים על Gemini 3.5 Pro אינם אישור ליכולות או לחולשות של Gemini 4 — שעליו דווח בנפרד. 1
7
לפי הדיווח ב-ZeroHedge שהעביר את דברי בלומברג, גוגל כינתה את התיאור שלפיו Gemini 4 מתקשה בקידוד „לא מדויק”. כך נוצר פער בין דברי העובדים האנונימיים לבין עמדת החברה. המקורות הזמינים אינם כוללים בדיקה פומבית ועצמאית שתכריע במחלוקת. 5
7
גם לעיתוי יש חשיבות: בעוד בלומברג דיווחה על ספקנות פנימית לקראת השקת Gemini 4, דיווח מאותו יום מסר כי גוגל חשפה את Gemini 4 Argon — אך עדיין לא הודיעה מתי יהיה זמין לציבור הרחב. 7
10
לאחר פרסום הדיווח, מניית אלפבית צמצמה חלק מהעליות שרשמה במהלך היום. לפי דיווח שהתבסס על Investing.com, היא ירדה מעלייה של יותר מ-2% לעלייה של כ-0.5% סמוך לנעילה. כלומר, המניה עדיין הייתה בעלייה באותו יום, ולא ירדה מתחת למחיר הסגירה הקודם. 9
הדיווחים מעלים שאלה מעשית עבור גוגל: האם ההצלחה של Gemini 4 במבחני ביצועים מתורגמת גם ליכולת להתמודד עם משימות קידוד שעובדים ניסו לבצע. אבל התמונה מורכבת מדיווחים אנונימיים לצד הכחשת גוגל, ולא מהערכה פומבית מלאה. העיכוב הקודם של Gemini 3.5 Pro מוסיף הקשר תחרותי; הוא אינו מוכיח שהמודל ננטש או ש-Gemini 4 מפגר באופן כללי אחרי המתחרות. 1
5
7
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
בלומברג דיווחה כי Gemini 4 השיג תוצאות טובות במבחני ביצועים מקובלים, אך התקשה בחלק ממשימות הקידוד כשעובדים ניסו להשתמש בו.
בלומברג דיווחה כי Gemini 4 השיג תוצאות טובות במבחני ביצועים מקובלים, אך התקשה בחלק ממשימות הקידוד כשעובדים ניסו להשתמש בו. הדיווחים הקודמים על חששות בגוגל מפני התחרות עם Anthropic ו OpenAI ועל העיכוב ב Gemini 3.5 Pro מספקים הקשר — אך אינם מוכיחים שהמודל ננטש או ש Gemini 4 סובל מאותן בעיות.
לאחר פרסום הדיווח, מניית אלפבית צמצמה את העליות: מיותר מ 2% לכ 0.5% סמוך לנעילה, אך עדיין נותרה בעלייה באותו יום.