Grok 4.5 เข้าสู่ช่วงเบต้าส่วนตัวที่ SpaceX และ Tesla เมื่อวันที่ 28 มิถุนายน 2026 ขับเคลื่อนด้วยโมเดลพื้นฐาน V9 ขนาด 1.5 ล้านล้านพารามิเตอร์ ซึ่งเสร็จสิ้นการฝึกฝนล่วงหน้าเมื่อวันที่ 26 พฤษภาคม 2026 ต่อมาได้เปิดให้ใช้งานผ่าน xAI API ในวันที่ 8 กรกฎาคม ในราคา $2 ต่ออินพุต 1 ล้านโทเค็น และ $6 ต่อเอาต์พุต 1 ล้านโทเค็น Grok 4.6 มี จำนวนพารามิเตอร์เพิ่มขึ้น 33% เมื่อเทียบกับรุ่นก่อน จาก 1.5T เป็น 2T พารามิเตอร์
| สเปก | Grok 4.5 | Grok 4.6 |
|---|---|---|
| พารามิเตอร์ | 1.5 ล้านล้าน | 2 ล้านล้าน |
| โมเดลพื้นฐาน | V9 (ฝึกแล้วเสร็จ 26 พ.ค. 2026) | เจเนอเรชันใหม่ (ยังไม่เปิดเผยรายละเอียดสถาปัตยกรรม) |
| สถานะ | เบต้าส่วนตัวที่ SpaceX & Tesla ตั้งแต่ 28 มิ.ย. เปิด API 8 ก.ค. | ฝึกใกล้เสร็จในสัปดาห์นี้ คาดเปิดตัวเดือนสิงหาคม |
| ราคา (API) | $2/1M อินพุต, $6/1M เอาต์พุต | ยังไม่ประกาศ |
| ประสิทธิภาพที่รายงาน | รายงานตนเองว่าใกล้เคียง/เหนือกว่า Claude Opus; ยังไม่มี benchmark อิสระเผยแพร่ | อ้างว่าเหนือกว่า Grok 4.5; ตั้งเป้าเหนือกว่า Kimi K3 |
ข้อควรระวังที่สำคัญ: ไม่มี benchmark อิสระจากบุคคลที่สามสำหรับ Grok 4.5 — การอ้างสิทธิ์ประสิทธิภาพทั้งหมดเป็นของ xAI เอง วิศวกร xAI คนหนึ่งตั้งข้อสังเกตว่า Grok 4.5 ใช้ข้อมูลเสริม "Cursor data" (ข้อมูลที่เน้นการเขียนโค้ด) ที่ไม่ได้รวมอยู่ในการฝึกฝนเบื้องต้น ซึ่ง "ไม่ได้ดีเท่ากับการมีข้อมูลนั้นในการฝึกฝนเบื้องต้น"
ช่วงเวลาของการประกาศของ Musk เชื่อมโยงโดยตรงกับการเปิดตัว Kimi K3 ของ Moonshot AI ในวันที่ 16 กรกฎาคม 2026 Kimi K3 เป็นโมเดล Mixture-of-Experts (MoE) แบบโอเพนเวท ขนาด 2.8 ล้านล้านพารามิเตอร์ มี หน้าต่างบริบท 1 ล้านโทเค็น และความสามารถด้านภาพในตัว ทำให้เป็นโมเดลโอเพนเวทที่ใหญ่ที่สุดเท่าที่เคยมีมา และเป็นรุ่นแรกในคลาส "3T" โดยจะเปิดใช้งานผู้เชี่ยวชาญเพียง 16 จาก 896 คนต่อโทเค็น ซึ่งเป็นดีไซน์ที่ช่วยลดต้นทุนการประมวลผล
โพสต์ของ Musk ระบุชัดเจนว่า Grok 4.6 คือการตอบโต้ โดยมีเป้าหมายเพื่อ เอาชนะ Kimi K3 ในด้านประสิทธิภาพ ในขณะที่ยังคงความได้เปรียบด้านความเร็วและประสิทธิภาพของ Grok Grok 4.6 ที่ 2T พารามิเตอร์นั้นเล็กกว่า Kimi K3 ที่ 2.8T ดังนั้น xAI จึงเดิมพันด้วย ประสิทธิภาพของสถาปัตยกรรมและการปรับแต่งการอนุมาน มากกว่าจำนวนพารามิเตอร์ดิบ
นี่คือประเด็นสำคัญ: Grok 4.5 ไม่มีคะแนน benchmark อิสระ การอ้างสิทธิ์ในการแข่งขันทั้งหมดเป็นเพียงการรายงานตนเองโดย xAI ในทางตรงกันข้าม Kimi K3 ได้รับการประเมินอย่างอิสระและอยู่ในอันดับ #3 ของโลก ในลีดเดอร์บอร์ดที่ครอบคลุม เป็นรองเพียง Claude Fable 5 ของ Anthropic และ GPT-5.6 Sol ของ OpenAI มีการอธิบายว่ามันทำงาน "สูสีกับระบบกรรมสิทธิ์ที่ทรงพลังที่สุดจากคู่แข่งสหรัฐฯ" K3 มีประสิทธิภาพเหนือกว่า Claude Fable 5 ในเกณฑ์มาตรฐานการเขียนโค้ดและการพัฒนาเว็บบางส่วน
ในด้านราคา API ของ Kimi K3 มีรายงานว่าถูกกว่า ประมาณครึ่งหนึ่ง เมื่อเทียบกับโมเดลระดับแนวหน้าอื่นๆ เช่น Claude Fable 5 และ GPT-5.6 Sol ไม่พบราคาต่อโทเค็นที่แน่นอนจากแหล่งที่มีอำนาจสูง
ประเด็นสำคัญ: ไม่มีการเปรียบเทียบ benchmark อิสระแบบตัวต่อตัวระหว่างโมเดล Grok ใดๆ กับ Kimi K3 ข้อความเกี่ยวกับประสิทธิภาพทั้งหมดของ xAI เป็นเพียงคำกล่าวอ้างที่ไม่ได้รับการยืนยันจาก Musk บนโซเชียลมีเดีย
การประกาศของ Musk เมื่อวันที่ 18 กรกฎาคม เป็นส่วนหนึ่งของแผนที่ใหญ่กว่ามาก นี่คือสิ่งที่ xAI ให้คำมั่นสัญญาต่อสาธารณะแล้ว:
นอกจากการแข่งโมเดลแล้ว xAI ยัง เปิดซอร์ส Grok Build ในวันที่ 15-16 กรกฎาคม 2026 ภายใต้สัญญาอนุญาต Apache 2.0 โดยเผยแพร่ CLI coding agent ที่เขียนด้วย Rust บน GitHub ที่ xai-org/grok-build Grok Build มีคุณสมบัติเอเจนต์ย่อย 8 ตัวที่ทำงานแบบขนาน, ขั้นตอนการทำงานแบบวางแผนก่อน, และโหมด Arena การเปิดซอร์สครั้งนี้เกิดขึ้นหลังจากเกิดข้อถกเถียงเรื่องความเป็นส่วนตัว: นักวิจัยด้านความปลอดภัยพบว่าเวอร์ชันก่อนหน้าอัปโหลดไดเรกทอรีการทำงานทั้งหมดของผู้ใช้ไปยังเซิร์ฟเวอร์ของ xAI การเปิดโค้ดดังกล่าวมีเป้าหมายเพื่อสร้างความไว้วางใจและเร่งการนำไปใช้ของชุมชน
Musk ยืนยันแยกต่างหากเมื่อวันที่ 8 กรกฎาคมว่า xAI กำลังปรับปรุง Grok Build ทุกวัน โดยขับเคลื่อนโดยความคิดเห็นของผู้ใช้ สิ่งนี้ทำให้ xAI พร้อมที่จะท้าทายผู้เล่นหลักในตลาด coding agent โดยตรง เช่น Cursor และ GitHub Copilot
การประกาศ Grok 4.6 ของ Musk เมื่อวันที่ 18 กรกฎาคม เป็น หมัดตอบโต้ทางการแข่งขัน ที่ชัดเจนต่อการเปิดตัว Kimi K3 ของ Moonshot ซึ่งเกิดขึ้นเพียงสองวันก่อนหน้านั้น จังหวะการปล่อยโมเดลรายเดือนของ xAI นั้นเร็วกว่าห้องปฏิบัติการชั้นนำอื่นๆ และแผนงาน Grok 5 ก็ส่งสัญญาณถึงโมเดลที่ใหญ่กว่ามากในอนาคต แต่การ ไม่มี benchmark อิสระ สำหรับโมเดล xAI ใดๆ หมายความว่าข้อกล่าวอ้างในการแข่งขันทั้งหมดยังคงไม่ได้รับการยืนยัน จนกว่าจะมีการทดสอบจากบุคคลที่สาม ในเกมที่วัดกันที่ความโปร่งใสไม่แพ้ขนาด ช่องว่างนี้มีความสำคัญ