Anthropic เปิดตัว Claude Opus 4 และ Claude Sonnet 4 โมเดลเขียนโค้ดที่ดีที่สุดในโลก
Anthropic เปิดตัวโมเดล Hybrid Reasoning รุ่นใหม่ Claude Opus 4 และ Sonnet 4 โดย Opus 4 ทำคะแนน SWE-bench ได้ 72.5% เปิดให้ใช้ทันทีทั้งแผน Pro, Max, Team, Enterprise และผู้ใช้ฟรี (Sonnet 4) พร้อมวางจำหน่ายผ่าน API, Bedrock, Vertex AI
วันที่ 22 พฤษภาคม พ.ศ. 2568 บริษัท Anthropic ได้เปิดตัวโมเดลรุ่นใหม่ Claude Opus 4 และ Claude Sonnet 4 อย่างเป็นทางการ ทั้งสองโมเดลใช้สถาปัตยกรรม “Hybrid Reasoning” ที่ผู้ใช้สามารถเลือกได้ว่าจะให้ตอบแบบเกือบเรียลไทม์ หรือเปิดโหมดคิดเชิงลึก (Extended Thinking) เพื่อการให้เหตุผลที่ละเอียดขึ้น ตอบโจทย์ทั้งความเร็วและความลึกในคราวเดียวกัน นับเป็นการอัปเดตครั้งใหญ่หลังจาก Anthropic เปิดตัว Claude 3.7 Sonnet และ Claude Code เมื่อเดือนกุมภาพันธ์ที่ผ่านมา ห่างกันราวสามเดือน
Claude Opus 4 คือโมเดลที่ทรงพลังที่สุดของ Anthropic ในขณะนี้ ทางบริษัทระบุว่าเป็น “โมเดลเขียนโค้ดที่ดีที่สุดในโลก” โดยทำคะแนนบนเกณฑ์ทดสอบ SWE-bench ซึ่งวัดความสามารถในการแก้ปัญหาวิศวกรรมซอฟต์แวร์จริงได้ 72.5% และบน Terminal-bench ซึ่งวัดความสามารถในการสั่งงานหลายขั้นตอนผ่าน terminal ได้ 43.2% ส่วน Claude Sonnet 4 เป็นการอัปเกรดครั้งใหญ่จาก Sonnet 3.7 ที่เปิดตัวเมื่อเดือนกุมภาพันธ์ปีเดียวกัน ทั้งความสามารถด้านการเขียนโค้ดและการให้เหตุผลดีขึ้นอย่างชัดเจน และสามารถทำตามคำสั่งของผู้ใช้ได้แม่นยำขึ้น ลดปัญหาที่โมเดลรุ่นก่อน “ตัดสินใจเอง” จนออกนอกกรอบคำสั่งเดิม
นัยเชิงเทคนิค: จากโหมดตอบสนองเดียวสู่ Hybrid Reasoning
โมเดลภาษาขนาดใหญ่ในอดีตมักมีวิธีตอบสนองเพียงแบบเดียว หากผู้ใช้ต้องการการให้เหตุผลที่รัดกุมกว่า มักต้องเรียกใช้โมเดล “เวอร์ชันคิด” แยกต่างหาก Claude Opus 4 และ Sonnet 4 รวมสองโหมดไว้ในโมเดลเดียว ทำให้ผู้ใช้สลับโหมดได้ตามความยากของงาน คำถามง่ายใช้โหมดตอบทันทีเพื่อประหยัดต้นทุนและเวลารอ ส่วนงานแก้บั๊กที่ซับซ้อนหรือการวางแผนหลายขั้นตอนก็สลับไปใช้โหมดคิดเชิงลึกเพื่อความแม่นยำที่สูงขึ้น การออกแบบ “หนึ่งโมเดล สองความเร็ว” นี้สะท้อนว่าอุตสาหกรรมกำลังเปลี่ยนจากการแข่งขันด้านขนาดโมเดล ไปสู่การแข่งขันด้านความยืดหยุ่นในการจัดสรรทรัพยากรการให้เหตุผล
เทียบกับรุ่นก่อน: การเขียนโค้ดกลายเป็นสนามรบหลัก
Anthropic วางน้ำหนักของการเปิดตัวครั้งนี้ไว้ที่ “การเขียนโค้ด” อย่างชัดเจน มากกว่าความสามารถด้านการสนทนาทั่วไป ทั้ง SWE-bench และ Terminal-bench ต่างเป็นเกณฑ์ที่ออกแบบมาเพื่อวัดว่าโมเดลเข้าใจโค้ดเบส แก้บั๊กจริง และสั่งงานผ่าน command line ได้เหมือนวิศวกรหรือไม่ เมื่อเทียบกับรุ่น 3.7 ความแม่นยำในการทำตามคำสั่งของ Sonnet 4 ถูกเน้นเป็นพิเศษ แสดงว่า Anthropic กำลังตอบสนองข้อร้องเรียนที่พบบ่อยจากลูกค้าองค์กรว่า “โมเดลตัดสินใจเองมากเกินไป ไม่ทำตามคำสั่ง” และยกให้ความควบคุมได้เป็นตัวชี้วัดสำคัญพอ ๆ กับความสามารถ
ขอบเขตการเปิดให้ใช้: จากแผนเสียเงินถึงผู้ใช้ฟรี
ทั้งสองโมเดลพร้อมฟีเจอร์คิดเชิงลึก เปิดให้ผู้ใช้แผน Pro, Max, Team และ Enterprise ใช้งานได้ทันที ที่น่าสนใจคือ Sonnet 4 ยังเปิดให้ผู้ใช้แผนฟรีใช้งานได้ด้วย ทำให้ผู้ใช้ทั่วไปได้สัมผัสโมเดลรุ่นใหม่โดยไม่ต้องเสียเงิน นอกจากนี้ Opus 4 และ Sonnet 4 ยังวางจำหน่ายพร้อมกันผ่าน Anthropic API, Amazon Bedrock และ Google Cloud Vertex AI ทั้งสามช่องทาง เพื่อให้องค์กรผสานโมเดลเข้ากับโครงสร้างคลาวด์ที่มีอยู่ได้สะดวก ด้านราคายังคงเดิมไม่ปรับขึ้น โดย Opus 4 อยู่ที่ 15 ดอลลาร์สหรัฐต่อล้านโทเคนอินพุต และ 75 ดอลลาร์สหรัฐต่อล้านโทเคนเอาต์พุต ส่วน Sonnet 4 อยู่ที่ 3 ดอลลาร์สหรัฐต่อล้านโทเคนอินพุต และ 15 ดอลลาร์สหรัฐต่อล้านโทเคนเอาต์พุต แสดงให้เห็นว่า Anthropic เลือกใช้การอัปเกรดประสิทธิภาพแทนการขึ้นราคาเป็นจุดขายของการเปิดตัวครั้งนี้
ความหมายต่อผู้บริหาร
สิ่งที่ผู้บริหารควรให้ความสนใจในการเปิดตัวครั้งนี้ ไม่ใช่ตัวเลขเทคนิคเพียงอย่างเดียว แต่คือสัญญาณสองอย่าง คือ “ผู้ใช้ฟรีก็เข้าถึงโมเดลหลักรุ่นใหม่ได้” และ “วางจำหน่ายพร้อมกันบนสามแพลตฟอร์มคลาวด์ใหญ่” ซึ่งบ่งชี้ว่าอุปสรรคในการนำเครื่องมือ AI มาใช้ในองค์กรกำลังลดลงเรื่อย ๆ หากทีมงานยังไม่เคยประเมินการนำ Claude มาใช้ตรวจโค้ด แก้ปัญหาระบบ หรือพัฒนาเครื่องมือภายใน นี่คือจังหวะที่ดีในการทบทวนใหม่อีกครั้ง
สมาชิกฟรีทำแบบทดสอบ คุยกับโค้ช AI ฟังบทความสะสมประวัติการเรียนรู้ สมัครรับ 100 พอยต์ทันที
สมัครฟรี