คอลัมน์ บันทึกเหตุการณ์ AI เพื่อผู้บริหาร ตอนที่ 283/303 ตอน ดูสารบัญคอร์ส

xAI เปิดตัว Grok 4.7 อย่างเป็นทางการ โมเดลเรือธงด้านการเขียนโปรแกรมและงานความรู้ ราคาเท่า 4.6 ใช้ได้ทันทีทั้ง API และแอป

21/09/2026 205
5:24
xAI เปิดตัว Grok 4.7 อย่างเป็นทางการ โมเดลเรือธงด้านการเขียนโปรแกรมและงานความรู้ ราคาเท่า 4.6 ใช้ได้ทันทีทั้ง API และแอป
ภาพ/Photo by Fatemeh Rezvani on Unsplash

xAI เปิดตัว Grok 4.7 เมื่อ 21 กันยายน 2569 โดยบริษัทระบุว่าเป็น “โมเดลด้านการเขียนโปรแกรมและงานความรู้ที่แข็งแกร่งที่สุด” บริบท 500k tokens ระดับการให้เหตุผล 4 ระดับ ความรู้ถึงพฤษภาคม 2569 ราคาเท่า Grok 4.6 ทุกประการ เปิดใช้ทันทีบน API, Cursor, แอป และ X

เมื่อวันที่ 21 กันยายน 2569 (วันจันทร์ตามเวลาสหรัฐฯ) xAI ได้เปิดตัว Grok 4.7 อย่างเป็นทางการบนหน้าเว็บของบริษัท โดยบริษัทระบุว่าเป็น “โมเดลด้านการเขียนโปรแกรมและงานความรู้ที่แข็งแกร่งที่สุด” หลังจากที่ Elon Musk ประกาศล่วงหน้าหลายครั้งตั้งแต่ต้นเดือนกันยายนและเลื่อนกำหนดหลายรอบ ผู้สืบทอดของ Grok 4.6 (เปิดตัวสิงหาคม 2569) ก็ออกสู่ตลาดในที่สุด โดยมี API model ID คือ grok-4.7

ด้านสเปก Grok 4.7 รองรับบริบท 500k tokens รับอินพุตทั้งข้อความและรูปภาพ มีระดับการให้เหตุผล 4 ระดับ (low, medium, high, xhigh) และมีความรู้ถึงเดือนพฤษภาคม 2569 ราคาเท่ากับ Grok 4.6 ทุกประการ กล่าวคือ เมื่อพรอมป์ต่ำกว่า 200k tokens คิดต่อล้าน tokens ที่อินพุต 2 ดอลลาร์ อินพุตแคช 0.5 ดอลลาร์ เอาต์พุต 6 ดอลลาร์ หากพรอมป์ตั้งแต่ 200k tokens ขึ้นไป ทั้งรายการจะคิดในอัตรา 4, 1 และ 12 ดอลลาร์ตามลำดับ ใช้งานได้ทันทีบน Grok API, Cursor, Grok Build, เครื่องมือเขียนโปรแกรมของบุคคลที่สาม, แพลตฟอร์มคลาวด์, แอป iOS และ Android รวมถึงแพลตฟอร์ม X นอกจากนี้ยังมีรุ่น Grok 4.7 Fast ที่เร็วเป็นสองเท่าและราคาสองเท่า ปัจจุบันจำกัดเฉพาะ Cursor และ Grok Build และยังไม่มี API model ID สาธารณะแยกต่างหาก

ความหมายเชิงเทคนิค โมเดลฐานใหญ่ขึ้น ฝึก RL ยาวขึ้น

xAI อธิบายว่าการพัฒนาในรุ่นนี้มาจากสองทิศทาง

  • โมเดลฐานที่ใหญ่ขึ้น (สื่อรายงานว่ามีพารามิเตอร์ราว 2.1 ล้านล้าน แต่หน้าเว็บทางการไม่ได้ระบุ จึงถือเป็นเพียงการประเมินจากภายนอก)
  • การฝึก reinforcement learning ที่ยาวนานขึ้นบนชุดงานที่ยากขึ้น ทำให้โมเดลทำงานยากได้นานขึ้น ตรวจสอบตัวเองละเอียดขึ้น และผลิตเอกสารกับสไลด์นำเสนอได้ดีขึ้น

บริษัทยังระบุว่าได้นำข้อมูลวิศวกรรมของ SpaceX มาฝึกเสริมด้วย

เทียบกับรุ่นก่อน ตัวเลขเกณฑ์วัดที่บริษัทรายงานเอง

ตัวเลขด้านล่างเป็นการรายงานของบริษัทเองและยังไม่ผ่านการตรวจสอบอิสระ (ในวงเล็บคือ Grok 4.6)

  • CursorBench 4.0: 46.3% (40.4%)
  • DeepSWE v1.1: 71.0% (65.2%)
  • Terminal-Bench 4.0: 38.0% (20.3%)
  • SWE-Marathon v1.1: 46.0% (31.9%)
  • EEBench วิศวกรรมไฟฟ้า: 64.0% และ Harvey งานกฎหมาย: 19.6%

Terminal-Bench เพิ่มเกือบเท่าตัวและ SWE-Marathon เพิ่มอย่างมาก ชี้ไปที่ “งานวิศวกรรมแบบเอเจนต์ที่ยาวและหลายขั้นตอน” ไม่ใช่การถาม-ตอบรอบเดียว ส่วนงานกฎหมายที่ได้เพียง 19.6% ก็แสดงว่าบริษัทไม่ได้นำเสนอเป็นโมเดลที่เก่งทุกด้าน

ความปลอดภัยและสองประเด็นที่น่าจับตา

xAI ระบุว่า Grok 4.7 ใช้ชุดรั้วความปลอดภัยใหม่ทั้งหมดและทนต่อการเจลเบรกได้ดีขึ้น โดยเกณฑ์ความปลอดภัยชีวภาพ LatchBio ได้ 62.4% และ HackerBench v0.3 มีพรอมป์สองทางความเสี่ยงสูงผ่านเพียง 3.3% จากการเปิดตัวครั้งนี้ ผู้เขียนเห็นว่ามีสองประเด็นที่น่าจับตา

  1. แนวทาง “ราคาเท่าเดิม ความสามารถสูงขึ้น” ซึ่งเทียบได้โดยตรงกับ Gemini 3.8 Flash, GPT-6 Astra และ DeepSeek V4.1-Flash ที่เปิดตัวก่อนหน้านี้ในเดือนเดียวกัน
  2. รุ่น Fast ยังไม่เปิด API แยก ข้อได้เปรียบด้านความเร็วจึงใช้ได้เฉพาะใน Cursor และ Grok Build ในขณะนี้

ความหมายสำหรับผู้บริหาร

สำหรับผู้บริหารที่ดูแลทีมในประเทศไทย สาระสำคัญไม่ได้อยู่ที่พารามิเตอร์ แต่อยู่ที่ “อัปเกรดในราคาเดิม” และ “งานระยะยาว” งบการใช้งาน Grok 4.6 เดิมใช้ต่อได้ทันที ขณะที่โมเดลเหมาะกับงานที่ต้องตรวจสอบตัวเองหลายขั้นตอนมากขึ้น เช่น การเรียบเรียงกระบวนการทำงานของโรงงานหรือหน้าร้านให้เป็นเอกสารและสไลด์ ทั้งนี้ เกณฑ์วัดที่บริษัทรายงานเองไม่ใช่มาตรฐานสุดท้าย การทดสอบกับงานจริงขององค์กรต่างหากที่ตัดสิน

แบบทดสอบ: ยืนยันความเข้าใจ
5 บทความ · ตอบถูก 80% ผ่าน บันทึกลงโปรไฟล์การเรียนรู้ เข้าสู่ระบบเพื่อทำแบบทดสอบ
ถาม AI: บทความนี้ใช้กับการบริหารของคุณอย่างไร?
เนื้อหาสร้างโดย AI จากบทความนี้ โปรดใช้วิจารณญาณในการพิจารณาความถูกต้อง
ตอนถัดไป・บันทึกเหตุการณ์ AI เพื่อผู้บริหาร Anthropic เปิดตัว Claude Opus 5.5 งานส่วนใหญ่เทียบเท่า Fable 5.1 ต้นทุนต่ำกว่า Opus 5 ถึง 40%

บทความที่เกี่ยวข้อง

เราใช้คุกกี้ที่จำเป็นเพื่อรักษาการเข้าสู่ระบบและภาษา และเก็บพฤติกรรมการใช้งานเพื่อปรับปรุงบริการ คุณเลือกเฉพาะที่จำเป็นได้ นโยบายความเป็นส่วนตัว