Bloomberg รายงานว่า Gemini 4 ทำได้ดีในการทดสอบมาตรฐานของอุตสาหกรรม แต่มีพนักงานบางคนระบุว่ารุ่นนี้ติดขัดกับงานเขียนโค้ดบางประเภทเมื่อลองใช้งานจริง รายงานก่อนหน้านี้กล่าวถึงความกังวลใน Google เรื่องการแข่งขันกับ Anthropic และ OpenAI รวมถึงการเลื่อน Gemini 3.5 Pro เพื่อปรับปรุงความสามารถ โดยไม่มีข้อมูลยืนยันว่าบริษัทเ...
เผยแพร่โดยแก้ไขด้วย GPT-6 Lunaรูปภาพสร้างด้วย GPT Image 2
คำตอบการวิจัย

Create a landscape editorial hero image for this Studio Global article: What did Bloomberg report about the gap between Gemini 4’s strong benchmark scores and its performance on real-world coding tasks, why does. Article summary: Bloomberg reported that Gemini 4 scores well on standard AI benchmarks, but some employees testing it say it struggles with certain coding tasks in actual use. That gap matters because Google is preparing to launch a fla. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
รายงานของ Bloomberg ระบุว่า Gemini 4 ทำคะแนนได้ดีในการทดสอบมาตรฐานที่ใช้วัดความสามารถของโมเดล AI แต่พนักงานบางคนที่ได้ทดลองใช้พบว่ารุ่นนี้ทำได้ไม่ดีเท่าเดิมกับงานจริง โดยเฉพาะงานเขียนโค้ดบางประเภท ข้อมูลดังกล่าวมาจากแหล่งข่าวที่ไม่เปิดเผยชื่อ จึงสะท้อนข้อกังวลภายใน ไม่ใช่ผลประเมินอิสระที่ครอบคลุมความสามารถทั้งหมดของโมเดล 7
ประเด็นนี้เกิดขึ้นในช่วงที่ Google กำลังผลักดันโมเดลเรือธงรุ่นใหม่ และพยายามแข่งขันในตลาดเครื่องมือ AI สำหรับเขียนโค้ด วันเดียวกับรายงาน Bloomberg มีข่าวว่า Google เปิดตัว Gemini 4 Argon แล้ว แต่ยังไม่ได้ประกาศกำหนดการเปิดให้ประชาชนทั่วไปใช้งาน 7
10
เบนช์มาร์กคือชุดทดสอบมาตรฐานที่ช่วยเปรียบเทียบโมเดลตามเกณฑ์ที่กำหนด ส่วนคำบอกเล่าจากพนักงานในรายงาน Bloomberg กล่าวถึงประสบการณ์เมื่อนำโมเดลไปทำงานบางอย่างจริง ๆ ทั้งสองอย่างจึงเป็นหลักฐานคนละประเภท
รายงานชี้ว่าแม้ Gemini 4 จะทำคะแนนทดสอบได้ดี แต่ผลดังกล่าวไม่ได้คลายข้อกังวลของพนักงานทุกคนเกี่ยวกับความสามารถด้านเขียนโค้ด อย่างไรก็ตาม ข้อมูลนี้ยังไม่เพียงพอจะสรุปว่า Gemini 4 ทำได้ไม่ดีในงานจริงทุกประเภท 7
Google กำลังแข่งขันเพื่อพัฒนาเครื่องมือ AI สำหรับช่วยเขียนโค้ด ซึ่งเป็นหนึ่งในด้านที่บริษัทเคยมีความกังวลเรื่องความก้าวหน้าของคู่แข่ง Bloomberg รายงานเมื่อเดือนเมษายนว่า ผู้นำบางส่วนใน Google ห่วงว่าบริษัทอาจตามหลัง โดยเฉพาะเมื่อแหล่งข่าวมองว่าเครื่องมือของ Anthropic มีประสิทธิภาพและได้รับความนิยมจากธุรกิจมากกว่า 4
รายงานอีกชิ้นในเดือนกรกฎาคมระบุว่า Gemini 3.5 Pro ล่าช้ากว่ากำหนดหลายเดือน ขณะที่ Google พยายามยกระดับความสามารถ โดยเฉพาะด้านเขียนโค้ด พนักงานที่ให้ข้อมูลในรายงานแสดงความกังวลว่าโมเดลจาก Anthropic และ OpenAI อาจมีความสามารถเหนือกว่า Gemini 1 Reuters ระบุด้วยว่า Gemini 3.5 Pro ตั้งใจพัฒนามาเพื่อช่วยให้ Google ไล่ตามคู่แข่งในเครื่องมือเขียนโค้ดและงาน AI แบบเอเจนต์ ซึ่งทำงานเป็นขั้นตอนได้
2
ข้อมูลก่อนหน้านี้ช่วยอธิบายบริบทการแข่งขัน แต่เป็นเรื่อง Gemini 3.5 Pro และความกังวลโดยรวม ไม่ใช่หลักฐานว่า Gemini 4 มีข้อบกพร่องแบบเดียวกัน หรือว่า Google แพ้การแข่งขันแล้ว ความสามารถด้านเขียนโค้ดอาจเกี่ยวข้องกับการพัฒนาเครื่องมือและงานแบบเอเจนต์ของบริษัท แต่แหล่งข้อมูลที่มีไม่ได้ระบุผลกระทบต่อผลิตภัณฑ์หรือลูกค้าโดยเฉพาะ 2
4
7
รายงานที่มีระบุว่า Gemini 3.5 Pro ล่าช้า ขณะที่ Google ปรับปรุงความสามารถ โดยเฉพาะด้านเขียนโค้ด แต่ไม่ได้ยืนยันว่าบริษัทเลิกพัฒนาโมเดลนี้ 1
2
การเลื่อนกำหนดไม่เท่ากับการยกเลิก และข้อกังวลเกี่ยวกับ Gemini 3.5 Pro ก็ไม่ใช่ข้อยืนยันประสิทธิภาพของ Gemini 4 ซึ่งเป็นคนละรายงานและคนละชุดข้อกังวล 1
7
ตามรายงานที่ ZeroHedge ถ่ายทอดจาก Bloomberg Google ระบุว่าเป็นการกล่าวที่ “ไม่ถูกต้อง” หากจะบอกว่า Gemini 4 ทำผลงานด้านเขียนโค้ดต่ำกว่าคาด 5 คำชี้แจงนี้ขัดกับคำบอกเล่าของพนักงานที่ไม่เปิดเผยชื่อ และแหล่งข้อมูลที่มีไม่ได้รวมผลทดสอบสาธารณะจากหน่วยงานอิสระที่ใช้ชี้ขาดข้อโต้แย้ง
5
7
ด้านความเคลื่อนไหวของผลิตภัณฑ์ รายงานในวันเดียวกันระบุว่า Google เปิดตัว Gemini 4 Argon แล้ว แต่ยังไม่แจ้งกำหนดการเปิดให้ใช้งานทั่วไป 10
หลังรายงานเผยแพร่ หุ้น Alphabet ลดช่วงบวกจากมากกว่า 2% เหลือประมาณ 0.5% ใกล้ปิดตลาด ตามรายงานที่อ้างข้อมูลจาก Investing.com กล่าวคือราคาหุ้นยังสูงกว่าระดับปิดวันก่อนหน้า ไม่ได้ปรับลงไปอยู่ในแดนลบ 9
รายงานชี้ให้เห็นคำถามสำคัญสำหรับ Google ว่าคะแนนทดสอบที่ดีของ Gemini 4 จะถ่ายทอดไปสู่งานเขียนโค้ดที่พนักงานลองทำได้มากน้อยเพียงใด แต่ข้อมูลที่มีประกอบด้วยคำบอกเล่าภายในแบบไม่เปิดเผยชื่อและคำชี้แจงโต้แย้งจาก Google ไม่ใช่การประเมินสาธารณะที่ครอบคลุมทุกด้าน
การเลื่อน Gemini 3.5 Pro เป็นบริบทของการแข่งขันที่ช่วยให้เห็นว่าเหตุใดความสามารถด้านเขียนโค้ดจึงเป็นประเด็นสำคัญ แต่ไม่ได้พิสูจน์ว่าโมเดลนั้นถูกยกเลิก หรือว่า Gemini 4 ตามหลังคู่แข่งโดยรวม 1
5
7
Studio Global AI
หน้านี้รวมคำตอบที่ได้รับการสนับสนุนจากแหล่งที่มาซึ่งคุณสามารถดำเนินการต่อภายใน Studio Global
Bloomberg รายงานว่า Gemini 4 ทำได้ดีในการทดสอบมาตรฐานของอุตสาหกรรม แต่มีพนักงานบางคนระบุว่ารุ่นนี้ติดขัดกับงานเขียนโค้ดบางประเภทเมื่อลองใช้งานจริง
Bloomberg รายงานว่า Gemini 4 ทำได้ดีในการทดสอบมาตรฐานของอุตสาหกรรม แต่มีพนักงานบางคนระบุว่ารุ่นนี้ติดขัดกับงานเขียนโค้ดบางประเภทเมื่อลองใช้งานจริง รายงานก่อนหน้านี้กล่าวถึงความกังวลใน Google เรื่องการแข่งขันกับ Anthropic และ OpenAI รวมถึงการเลื่อน Gemini 3.5 Pro เพื่อปรับปรุงความสามารถ โดยไม่มีข้อมูลยืนยันว่าบริษัทเลิกพัฒนาโมเดลนี้
Google โต้ว่าไม่ถูกต้องที่จะบอกว่า Gemini 4 ทำผลงานด้านเขียนโค้ดต่ำกว่าคาด ส่วนหุ้น Alphabet ลดช่วงบวกจากมากกว่า 2% เหลือราว 0.5% ใกล้ปิดตลาด แต่ยังอยู่ในแดนบวก