ChatGPT Voice เชื่อมกับโมเดลให้เหตุผลระดับแนวหน้า: คุยด้วยเสียงกับ GPT-6 Astra ได้แล้ว ยกเลิกระดับความฉลาดเสียงแบบ 3 ขั้น
OpenAI ประกาศอัปเดต ChatGPT Voice เมื่อวันที่ 9 กันยายน พ.ศ. 2569 โดยโหมดเสียงสามารถเรียกใช้ GPT-5.6 และ GPT-6 Astra เมื่อคำถามต้องค้นข้อมูลหรือใช้การให้เหตุผลที่ลึกขึ้น ผู้ใช้เลือกโมเดลและระดับการให้เหตุผลได้เอง ยกเลิกระดับ Instant/Medium/High ทั้งหมด พร้อมจัดโควตาใหม่ และ Plus กับ Pro จะไม่ถูกลดระดับอัตโนมัติอีกต่อไป
เมื่อวันที่ 9 กันยายน พ.ศ. 2569 OpenAI ประกาศในเอกสาร ChatGPT Release Notes ว่าโหมดเสียง (ChatGPT Voice) ได้เชื่อมต่อกับโมเดลให้เหตุผลระดับแนวหน้าอย่างเป็นทางการ นับจากนี้ เมื่อผู้ใช้ถามคำถามที่ต้องค้นข้อมูลบนอินเทอร์เน็ตหรือต้องใช้การให้เหตุผลที่ลึกขึ้นระหว่างสนทนาด้วยเสียง ระบบสามารถเรียกใช้ GPT-5.6 หรือ GPT-6 Astra มาตอบได้โดยตรง ไม่ถูกจำกัดอยู่กับโมเดลเสียงขนาดเล็กที่ปรับแต่งมาเพื่อการตอบแบบเรียลไทม์อีกต่อไป การเปลี่ยนแปลงนี้ปรากฏทั้งใน help.openai.com (ChatGPT Release Notes ฉบับ 9 กันยายน พ.ศ. 2569) และในสรุปอัปเดตของ releasebot.io
รวมชุดควบคุม: เสียงไม่ใช่สายผลิตภัณฑ์แยกอีกต่อไป
เดิมที ChatGPT Voice มีชุดควบคุมแยกต่างหากชื่อ “Voice intelligence level” แบ่งเป็นสามระดับ คือ Instant, Medium และ High ซึ่งในมุมของผู้ใช้เลือกได้เพียงสามระดับนามธรรมนี้เท่านั้น การอัปเดตครั้งนี้ยกเลิกระบบสามระดับดังกล่าวทั้งหมด เปลี่ยนมาใช้ชุดควบคุมเดียวกับการสนทนาแบบข้อความ กล่าวคือผู้ใช้เลือกโมเดลเองและเลือกระดับการให้เหตุผลเอง สะท้อนว่า OpenAI ยุบรวมเสียงให้เป็น “อีกช่องทางรับเข้าและแสดงผลของโมเดลเดียวกัน” ทักษะที่สั่งสมจากการสนทนาแบบข้อความจึงย้ายมาใช้กับเสียงได้ทั้งชุด และองค์กรไม่ต้องจัดทำคู่มือกับการอบรมแยกสำหรับงานที่ใช้เสียง ทั้งนี้ จากการที่ตารางโควตายังระบุทั้ง GPT-Live-1 และรุ่น mini พออนุมานได้ว่าบทสนทนาทั่วไปยังประมวลผลด้วยโมเดลเสียงขนาดเล็กแบบเรียลไทม์ ส่วนคำถามที่ต้องค้นข้อมูลหรือให้เหตุผลหลายขั้นจึงส่งต่อให้โมเดลระดับแนวหน้า การแลกกันระหว่างความเร็วกับคุณภาพจึงถูกแทนที่ด้วยการแยกโมเดลทำงานอยู่เบื้องหลัง
จัดโควตาใหม่: ไม่ถูกลดระดับแบบเงียบ ๆ และเปิด Think ให้ระดับฟรี
พร้อมกับการปรับโมเดล โควตาการใช้เสียงถูกจัดชั้นใหม่ดังนี้
- แพ็กเกจ Go: 3 ชั่วโมง ใช้ GPT-Live-1 mini
- แพ็กเกจ Plus: 3 ชั่วโมง ใช้ GPT-Live-1
- แพ็กเกจ Pro ราคา 100 ดอลลาร์สหรัฐ: 15 ชั่วโมง
- แพ็กเกจ Pro ราคา 200 ดอลลาร์สหรัฐ: ใช้ได้ไม่จำกัด
ประเด็นที่สำคัญยิ่งกว่าคือกติกาประกอบ: ผู้ใช้ Plus และ Pro จะไม่ถูกลดระดับไปใช้โมเดล mini โดยอัตโนมัติเมื่อโควตาหมดอีกต่อไป จุดที่น่าหงุดหงิดที่สุดของการ “ลดระดับแบบเงียบ” ในอดีตคือคุณภาพตกลงโดยไม่มีการแจ้งเตือน ผู้ใช้มักรู้ตัวเมื่อพูดไปได้ครึ่งทางแล้ว เมื่อเปลี่ยนเป็นโควตาแบบตายตัว ข้อดีคือคาดการณ์ได้ แต่ข้อแลกเปลี่ยนคือหมดแล้วก็คือหมด การคิดโควตาเป็น “ชั่วโมง” แทนจำนวนข้อความนั้น สันนิษฐานได้ว่าเกี่ยวข้องกับต้นทุนของเสียงที่ขึ้นกับระยะเวลาสนทนา ในการอัปเดตชุดเดียวกัน OpenAI ยังเปิดฟังก์ชัน Think (การคิดแบบยืดเวลา) ให้แพ็กเกจ Free และ Go โดยผู้ใช้เวอร์ชันเว็บเลือกใช้ได้เอง ขณะที่ผู้เล่นรายอื่นยังคงแข่งกันต่อในเรื่องการแบ่งชั้นความสามารถด้านการให้เหตุผล ความเร็ว และเพดานโควตา
ความหมายต่อผู้บริหาร
สำหรับผู้บริหารที่มักไม่ได้นั่งอยู่ที่โต๊ะทำงาน การอัปเดตครั้งนี้ยกระดับเสียงจาก “เครื่องมือถามตอบเร็ว” ขึ้นเป็น “อินเทอร์เฟซการทำงานที่ให้เหตุผลและค้นข้อมูลได้” เช่น การสอบถามข้อวินิจฉัยเกี่ยวกับเงื่อนไขในสัญญาระหว่างขับรถไปทำงาน การถามสาเหตุที่เป็นไปได้ของความผิดปกติด้านคุณภาพขณะเดินตรวจสายการผลิต หรือการบอกคำสั่งจัดการประจำวันระหว่างเดินตรวจร้านสาขา สถานการณ์เหล่านี้ซึ่งเดิมได้เพียงคำตอบผิวเผิน ตอนนี้มีโอกาสได้รับการวิเคราะห์ที่ใกล้เคียงคุณภาพของการสนทนาแบบข้อความ
สิ่งที่ควรคิดให้ชัดก่อนมีสองเรื่อง ดังนี้
- โควตาคิดเป็นชั่วโมง ผู้ที่เคยชินกับการเปิด AI ทิ้งไว้เป็นเสียงประกอบจะใช้หมดเร็วกว่าที่คาด องค์กรจึงควรประเมินระยะเวลาสนทนาจริงก่อนนำไปใช้ทั้งทีม
- เนื้อหาที่ป้อนด้วยเสียงมักเป็นข้อมูลสด เป็นภาษาพูด และยังไม่ผ่านการเรียบเรียง เมื่อเกี่ยวข้องกับข้อมูลส่วนบุคคลของพนักงาน รายชื่อลูกค้า หรือตัวเลขทางการเงินที่ยังไม่เปิดเผย ยังต้องปฏิบัติตามระเบียบการเปิดเผยข้อมูลเดียวกันกับการป้อนด้วยข้อความ ความเสี่ยงไม่ได้ลดลงเพราะ “แค่พูดออกไป”
เมื่อเสียงเชื่อมเข้ากับโมเดลระดับแนวหน้าแล้ว ความต่างที่แท้จริงจึงไม่ได้อยู่ที่ถามอะไรได้บ้าง แต่อยู่ที่ว่าคุณยินดีจะพูดเรื่องใดออกไป
สมาชิกฟรีทำแบบทดสอบ คุยกับโค้ช AI ฟังบทความสะสมประวัติการเรียนรู้ สมัครรับ 100 พอยต์ทันที
สมัครฟรี