xAI เปิดตัว Grok 4.7 อย่างเป็นทางการ โมเดลเรือธงด้านการเขียนโปรแกรมและงานความรู้ ราคาเท่า 4.6 ใช้ได้ทันทีทั้ง API และแอป
xAI เปิดตัว Grok 4.7 เมื่อ 21 กันยายน 2569 โดยบริษัทระบุว่าเป็น “โมเดลด้านการเขียนโปรแกรมและงานความรู้ที่แข็งแกร่งที่สุด” บริบท 500k tokens ระดับการให้เหตุผล 4 ระดับ ความรู้ถึงพฤษภาคม 2569 ราคาเท่า Grok 4.6 ทุกประการ เปิดใช้ทันทีบน API, Cursor, แอป และ X
เมื่อวันที่ 21 กันยายน 2569 (วันจันทร์ตามเวลาสหรัฐฯ) xAI ได้เปิดตัว Grok 4.7 อย่างเป็นทางการบนหน้าเว็บของบริษัท โดยบริษัทระบุว่าเป็น “โมเดลด้านการเขียนโปรแกรมและงานความรู้ที่แข็งแกร่งที่สุด” หลังจากที่ Elon Musk ประกาศล่วงหน้าหลายครั้งตั้งแต่ต้นเดือนกันยายนและเลื่อนกำหนดหลายรอบ ผู้สืบทอดของ Grok 4.6 (เปิดตัวสิงหาคม 2569) ก็ออกสู่ตลาดในที่สุด โดยมี API model ID คือ grok-4.7
ด้านสเปก Grok 4.7 รองรับบริบท 500k tokens รับอินพุตทั้งข้อความและรูปภาพ มีระดับการให้เหตุผล 4 ระดับ (low, medium, high, xhigh) และมีความรู้ถึงเดือนพฤษภาคม 2569 ราคาเท่ากับ Grok 4.6 ทุกประการ กล่าวคือ เมื่อพรอมป์ต่ำกว่า 200k tokens คิดต่อล้าน tokens ที่อินพุต 2 ดอลลาร์ อินพุตแคช 0.5 ดอลลาร์ เอาต์พุต 6 ดอลลาร์ หากพรอมป์ตั้งแต่ 200k tokens ขึ้นไป ทั้งรายการจะคิดในอัตรา 4, 1 และ 12 ดอลลาร์ตามลำดับ ใช้งานได้ทันทีบน Grok API, Cursor, Grok Build, เครื่องมือเขียนโปรแกรมของบุคคลที่สาม, แพลตฟอร์มคลาวด์, แอป iOS และ Android รวมถึงแพลตฟอร์ม X นอกจากนี้ยังมีรุ่น Grok 4.7 Fast ที่เร็วเป็นสองเท่าและราคาสองเท่า ปัจจุบันจำกัดเฉพาะ Cursor และ Grok Build และยังไม่มี API model ID สาธารณะแยกต่างหาก
ความหมายเชิงเทคนิค โมเดลฐานใหญ่ขึ้น ฝึก RL ยาวขึ้น
xAI อธิบายว่าการพัฒนาในรุ่นนี้มาจากสองทิศทาง
- โมเดลฐานที่ใหญ่ขึ้น (สื่อรายงานว่ามีพารามิเตอร์ราว 2.1 ล้านล้าน แต่หน้าเว็บทางการไม่ได้ระบุ จึงถือเป็นเพียงการประเมินจากภายนอก)
- การฝึก reinforcement learning ที่ยาวนานขึ้นบนชุดงานที่ยากขึ้น ทำให้โมเดลทำงานยากได้นานขึ้น ตรวจสอบตัวเองละเอียดขึ้น และผลิตเอกสารกับสไลด์นำเสนอได้ดีขึ้น
บริษัทยังระบุว่าได้นำข้อมูลวิศวกรรมของ SpaceX มาฝึกเสริมด้วย
เทียบกับรุ่นก่อน ตัวเลขเกณฑ์วัดที่บริษัทรายงานเอง
ตัวเลขด้านล่างเป็นการรายงานของบริษัทเองและยังไม่ผ่านการตรวจสอบอิสระ (ในวงเล็บคือ Grok 4.6)
- CursorBench 4.0: 46.3% (40.4%)
- DeepSWE v1.1: 71.0% (65.2%)
- Terminal-Bench 4.0: 38.0% (20.3%)
- SWE-Marathon v1.1: 46.0% (31.9%)
- EEBench วิศวกรรมไฟฟ้า: 64.0% และ Harvey งานกฎหมาย: 19.6%
Terminal-Bench เพิ่มเกือบเท่าตัวและ SWE-Marathon เพิ่มอย่างมาก ชี้ไปที่ “งานวิศวกรรมแบบเอเจนต์ที่ยาวและหลายขั้นตอน” ไม่ใช่การถาม-ตอบรอบเดียว ส่วนงานกฎหมายที่ได้เพียง 19.6% ก็แสดงว่าบริษัทไม่ได้นำเสนอเป็นโมเดลที่เก่งทุกด้าน
ความปลอดภัยและสองประเด็นที่น่าจับตา
xAI ระบุว่า Grok 4.7 ใช้ชุดรั้วความปลอดภัยใหม่ทั้งหมดและทนต่อการเจลเบรกได้ดีขึ้น โดยเกณฑ์ความปลอดภัยชีวภาพ LatchBio ได้ 62.4% และ HackerBench v0.3 มีพรอมป์สองทางความเสี่ยงสูงผ่านเพียง 3.3% จากการเปิดตัวครั้งนี้ ผู้เขียนเห็นว่ามีสองประเด็นที่น่าจับตา
- แนวทาง “ราคาเท่าเดิม ความสามารถสูงขึ้น” ซึ่งเทียบได้โดยตรงกับ Gemini 3.8 Flash, GPT-6 Astra และ DeepSeek V4.1-Flash ที่เปิดตัวก่อนหน้านี้ในเดือนเดียวกัน
- รุ่น Fast ยังไม่เปิด API แยก ข้อได้เปรียบด้านความเร็วจึงใช้ได้เฉพาะใน Cursor และ Grok Build ในขณะนี้
ความหมายสำหรับผู้บริหาร
สำหรับผู้บริหารที่ดูแลทีมในประเทศไทย สาระสำคัญไม่ได้อยู่ที่พารามิเตอร์ แต่อยู่ที่ “อัปเกรดในราคาเดิม” และ “งานระยะยาว” งบการใช้งาน Grok 4.6 เดิมใช้ต่อได้ทันที ขณะที่โมเดลเหมาะกับงานที่ต้องตรวจสอบตัวเองหลายขั้นตอนมากขึ้น เช่น การเรียบเรียงกระบวนการทำงานของโรงงานหรือหน้าร้านให้เป็นเอกสารและสไลด์ ทั้งนี้ เกณฑ์วัดที่บริษัทรายงานเองไม่ใช่มาตรฐานสุดท้าย การทดสอบกับงานจริงขององค์กรต่างหากที่ตัดสิน
สมาชิกฟรีทำแบบทดสอบ คุยกับโค้ช AI ฟังบทความสะสมประวัติการเรียนรู้ สมัครรับ 100 พอยต์ทันที
สมัครฟรี