Bloomberg dẫn lời các nguồn ẩn danh cho biết Gemini 4 đạt kết quả tốt ở những bài benchmark phổ biến, nhưng gặp khó với một số tác vụ lập trình khi được nhân viên dùng thử. Các bài viết trước đó ghi nhận lo ngại của một số nhân viên Google về cạnh tranh với Anthropic và OpenAI, cũng như việc Gemini 3.5 Pro bị chậm đ...
Đăng bởiBiên tập bằng GPT-6 LunaHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What did Bloomberg report about the gap between Gemini 4’s strong benchmark scores and its performance on real-world coding tasks, why does. Article summary: Bloomberg reported that Gemini 4 scores well on standard AI benchmarks, but some employees testing it say it struggles with certain coding tasks in actual use. That gap matters because Google is preparing to launch a fla. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
Bloomberg đưa tin Gemini 4 đạt kết quả tốt ở các bài kiểm tra chuẩn hóa thường dùng để đánh giá mô hình AI, nhưng một số nhân viên cho biết mô hình xử lý kém hơn khi được giao việc thực tế, trong đó có một số tác vụ lập trình. Đây là phản hồi nội bộ được kể lại bởi các nguồn đề nghị giấu tên, không phải đánh giá độc lập toàn diện về mọi khả năng của Gemini 4. 7
Google bác bỏ nhận định rằng mô hình yếu về lập trình. Cùng ngày, một bản tin khác cho biết công ty đã công bố Gemini 4 Argon, nhưng chưa đưa ra lịch phát hành rộng rãi. Vì vậy, câu chuyện không chỉ là điểm số trên benchmark — tức các bài kiểm tra chuẩn hóa — mà còn là câu hỏi liệu mô hình có thể vận dụng năng lực đó vào công việc cụ thể hay không. 5
10
Theo những người có quyền tiếp cận dự án mà Bloomberg dẫn lời, Gemini 4 đạt điểm tốt trên các benchmark phổ biến nhưng gặp khó với một số nhiệm vụ lập trình khi nhân viên dùng thử. Vì các nguồn này ẩn danh, thông tin nên được hiểu là phản hồi từ người trải nghiệm mô hình trong một số tình huống, chứ không phải kết quả kiểm thử công khai, độc lập. 7
Hai loại bằng chứng này không hoàn toàn tương đương: benchmark đưa ra một thước đo chuẩn hóa, còn phản hồi khi dùng thật phản ánh hiệu quả trên những tác vụ cụ thể. Bài báo cho thấy điểm số cao chưa xóa hết nghi ngại nội bộ về khả năng lập trình, nhưng không chứng minh Gemini 4 kém trong mọi ứng dụng thực tế. 7
Google đang cạnh tranh trong lĩnh vực công cụ AI hỗ trợ lập trình. Bloomberg từng đưa tin một số lãnh đạo và nhân viên trong công ty lo ngại Google tụt lại phía sau, trong bối cảnh các nguồn mô tả công cụ lập trình của Anthropic là hiệu quả hơn và được doanh nghiệp ưa chuộng. 4
Một bài viết khác của Bloomberg hồi tháng 7 cho biết Gemini 3.5 Pro chậm nhiều tháng so với kế hoạch khi Google tìm cách cải thiện năng lực, đặc biệt là lập trình. Những nhân viên được dẫn lời lo rằng các mô hình của Anthropic và OpenAI đang vượt Gemini về khả năng. Reuters cũng đưa tin Gemini 3.5 Pro được định hướng để giúp Google bắt kịp trong công cụ lập trình AI và các tác vụ AI dạng tác nhân — những hệ thống có thể thực hiện chuỗi bước để hoàn thành công việc. 1
2
Các bài viết trước tạo bối cảnh cho cuộc cạnh tranh, nhưng nói về Gemini 3.5 Pro và những lo ngại rộng hơn, chứ không chứng minh Gemini 4 có cùng hạn chế hay Google đã thua cuộc đua. Năng lực lập trình tốt hơn có thể quan trọng với các công cụ lập trình và tác vụ dạng tác nhân của Google; những nguồn hiện có chưa xác định các vấn đề được nêu ảnh hưởng thế nào đến sản phẩm hoặc khách hàng cụ thể. 2
4
7
Thông tin hiện có cho thấy Gemini 3.5 Pro bị chậm trong lúc Google tìm cách nâng cấp năng lực, nhất là về lập trình. Các nguồn không xác nhận Google đã khai tử mô hình này. 1
2
Chậm phát hành không đồng nghĩa với hủy bỏ. Đồng thời, những thông tin về Gemini 3.5 Pro cũng không thể được xem là bằng chứng xác nhận hiệu năng của Gemini 4 — Bloomberg mô tả đây là những quan ngại riêng về mô hình mới. 1
7
Theo bản tin của Bloomberg được ZeroHedge dẫn lại, Google gọi việc mô tả Gemini 4 là hoạt động kém trong lập trình là “không chính xác”. Phản hồi này trái với lời kể của các nhân viên ẩn danh; những nguồn được cung cấp không có bài kiểm tra công khai, độc lập để phân định bất đồng. 5
7
Cũng cần đặt thông tin đúng mốc thời gian: khi Bloomberg đưa tin về hoài nghi nội bộ lúc Gemini 4 tiến gần thời điểm ra mắt, một bản tin cùng ngày cho biết Google đã công bố Gemini 4 Argon nhưng chưa công bố lịch mở rộng cho công chúng. 7
10
Sau khi tin được đăng, cổ phiếu Alphabet thu hẹp mức tăng trong phiên: từ hơn 2% lên còn khoảng 0,5% gần thời điểm đóng cửa, theo bản tin dẫn Investing.com. Nói cách khác, cổ phiếu giảm bớt phần tăng chứ không chuyển sang giảm so với mức đóng cửa phiên trước. 9
Các thông tin đặt ra một câu hỏi đáng chú ý với Google: liệu kết quả tốt trên benchmark của Gemini 4 có chuyển hóa thành hiệu quả trong những tác vụ lập trình mà nhân viên thử nghiệm hay không. Tuy nhiên, bằng chứng hiện có gồm lời kể nội bộ ẩn danh và phản hồi bác bỏ từ Google, chứ chưa phải một đánh giá công khai toàn diện. Việc Gemini 3.5 Pro bị chậm giúp làm rõ bối cảnh cạnh tranh, nhưng không chứng minh mô hình đã bị hủy hay Gemini 4 thua kém đối thủ trên mọi mặt. 1
5
7
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Bloomberg dẫn lời các nguồn ẩn danh cho biết Gemini 4 đạt kết quả tốt ở những bài benchmark phổ biến, nhưng gặp khó với một số tác vụ lập trình khi được nhân viên dùng thử.
Bloomberg dẫn lời các nguồn ẩn danh cho biết Gemini 4 đạt kết quả tốt ở những bài benchmark phổ biến, nhưng gặp khó với một số tác vụ lập trình khi được nhân viên dùng thử. Các bài viết trước đó ghi nhận lo ngại của một số nhân viên Google về cạnh tranh với Anthropic và OpenAI, cũng như việc Gemini 3.5 Pro bị chậm để cải thiện năng lực, đặc biệt là lập trình.
Sau khi tin được đăng, cổ phiếu Alphabet thu hẹp mức tăng từ hơn 2% xuống khoảng 0,5% gần cuối phiên, nhưng vẫn tăng trong ngày.