คอลัมน์ บันทึกเหตุการณ์ AI เพื่อผู้บริหาร ตอนที่ 108/303 ตอน ดูสารบัญคอร์ส

Anthropic เปิดตัว Claude Opus 4 และ Claude Sonnet 4 โมเดลเขียนโค้ดที่ดีที่สุดในโลก

22/05/2025 169
≈4:56
Anthropic เปิดตัว Claude Opus 4 และ Claude Sonnet 4 โมเดลเขียนโค้ดที่ดีที่สุดในโลก
ภาพ/Photo by Danial Igdery on Unsplash

Anthropic เปิดตัวโมเดล Hybrid Reasoning รุ่นใหม่ Claude Opus 4 และ Sonnet 4 โดย Opus 4 ทำคะแนน SWE-bench ได้ 72.5% เปิดให้ใช้ทันทีทั้งแผน Pro, Max, Team, Enterprise และผู้ใช้ฟรี (Sonnet 4) พร้อมวางจำหน่ายผ่าน API, Bedrock, Vertex AI

วันที่ 22 พฤษภาคม พ.ศ. 2568 บริษัท Anthropic ได้เปิดตัวโมเดลรุ่นใหม่ Claude Opus 4 และ Claude Sonnet 4 อย่างเป็นทางการ ทั้งสองโมเดลใช้สถาปัตยกรรม “Hybrid Reasoning” ที่ผู้ใช้สามารถเลือกได้ว่าจะให้ตอบแบบเกือบเรียลไทม์ หรือเปิดโหมดคิดเชิงลึก (Extended Thinking) เพื่อการให้เหตุผลที่ละเอียดขึ้น ตอบโจทย์ทั้งความเร็วและความลึกในคราวเดียวกัน นับเป็นการอัปเดตครั้งใหญ่หลังจาก Anthropic เปิดตัว Claude 3.7 Sonnet และ Claude Code เมื่อเดือนกุมภาพันธ์ที่ผ่านมา ห่างกันราวสามเดือน

Claude Opus 4 คือโมเดลที่ทรงพลังที่สุดของ Anthropic ในขณะนี้ ทางบริษัทระบุว่าเป็น “โมเดลเขียนโค้ดที่ดีที่สุดในโลก” โดยทำคะแนนบนเกณฑ์ทดสอบ SWE-bench ซึ่งวัดความสามารถในการแก้ปัญหาวิศวกรรมซอฟต์แวร์จริงได้ 72.5% และบน Terminal-bench ซึ่งวัดความสามารถในการสั่งงานหลายขั้นตอนผ่าน terminal ได้ 43.2% ส่วน Claude Sonnet 4 เป็นการอัปเกรดครั้งใหญ่จาก Sonnet 3.7 ที่เปิดตัวเมื่อเดือนกุมภาพันธ์ปีเดียวกัน ทั้งความสามารถด้านการเขียนโค้ดและการให้เหตุผลดีขึ้นอย่างชัดเจน และสามารถทำตามคำสั่งของผู้ใช้ได้แม่นยำขึ้น ลดปัญหาที่โมเดลรุ่นก่อน “ตัดสินใจเอง” จนออกนอกกรอบคำสั่งเดิม

นัยเชิงเทคนิค: จากโหมดตอบสนองเดียวสู่ Hybrid Reasoning

โมเดลภาษาขนาดใหญ่ในอดีตมักมีวิธีตอบสนองเพียงแบบเดียว หากผู้ใช้ต้องการการให้เหตุผลที่รัดกุมกว่า มักต้องเรียกใช้โมเดล “เวอร์ชันคิด” แยกต่างหาก Claude Opus 4 และ Sonnet 4 รวมสองโหมดไว้ในโมเดลเดียว ทำให้ผู้ใช้สลับโหมดได้ตามความยากของงาน คำถามง่ายใช้โหมดตอบทันทีเพื่อประหยัดต้นทุนและเวลารอ ส่วนงานแก้บั๊กที่ซับซ้อนหรือการวางแผนหลายขั้นตอนก็สลับไปใช้โหมดคิดเชิงลึกเพื่อความแม่นยำที่สูงขึ้น การออกแบบ “หนึ่งโมเดล สองความเร็ว” นี้สะท้อนว่าอุตสาหกรรมกำลังเปลี่ยนจากการแข่งขันด้านขนาดโมเดล ไปสู่การแข่งขันด้านความยืดหยุ่นในการจัดสรรทรัพยากรการให้เหตุผล

เทียบกับรุ่นก่อน: การเขียนโค้ดกลายเป็นสนามรบหลัก

Anthropic วางน้ำหนักของการเปิดตัวครั้งนี้ไว้ที่ “การเขียนโค้ด” อย่างชัดเจน มากกว่าความสามารถด้านการสนทนาทั่วไป ทั้ง SWE-bench และ Terminal-bench ต่างเป็นเกณฑ์ที่ออกแบบมาเพื่อวัดว่าโมเดลเข้าใจโค้ดเบส แก้บั๊กจริง และสั่งงานผ่าน command line ได้เหมือนวิศวกรหรือไม่ เมื่อเทียบกับรุ่น 3.7 ความแม่นยำในการทำตามคำสั่งของ Sonnet 4 ถูกเน้นเป็นพิเศษ แสดงว่า Anthropic กำลังตอบสนองข้อร้องเรียนที่พบบ่อยจากลูกค้าองค์กรว่า “โมเดลตัดสินใจเองมากเกินไป ไม่ทำตามคำสั่ง” และยกให้ความควบคุมได้เป็นตัวชี้วัดสำคัญพอ ๆ กับความสามารถ

ขอบเขตการเปิดให้ใช้: จากแผนเสียเงินถึงผู้ใช้ฟรี

ทั้งสองโมเดลพร้อมฟีเจอร์คิดเชิงลึก เปิดให้ผู้ใช้แผน Pro, Max, Team และ Enterprise ใช้งานได้ทันที ที่น่าสนใจคือ Sonnet 4 ยังเปิดให้ผู้ใช้แผนฟรีใช้งานได้ด้วย ทำให้ผู้ใช้ทั่วไปได้สัมผัสโมเดลรุ่นใหม่โดยไม่ต้องเสียเงิน นอกจากนี้ Opus 4 และ Sonnet 4 ยังวางจำหน่ายพร้อมกันผ่าน Anthropic API, Amazon Bedrock และ Google Cloud Vertex AI ทั้งสามช่องทาง เพื่อให้องค์กรผสานโมเดลเข้ากับโครงสร้างคลาวด์ที่มีอยู่ได้สะดวก ด้านราคายังคงเดิมไม่ปรับขึ้น โดย Opus 4 อยู่ที่ 15 ดอลลาร์สหรัฐต่อล้านโทเคนอินพุต และ 75 ดอลลาร์สหรัฐต่อล้านโทเคนเอาต์พุต ส่วน Sonnet 4 อยู่ที่ 3 ดอลลาร์สหรัฐต่อล้านโทเคนอินพุต และ 15 ดอลลาร์สหรัฐต่อล้านโทเคนเอาต์พุต แสดงให้เห็นว่า Anthropic เลือกใช้การอัปเกรดประสิทธิภาพแทนการขึ้นราคาเป็นจุดขายของการเปิดตัวครั้งนี้

ความหมายต่อผู้บริหาร

สิ่งที่ผู้บริหารควรให้ความสนใจในการเปิดตัวครั้งนี้ ไม่ใช่ตัวเลขเทคนิคเพียงอย่างเดียว แต่คือสัญญาณสองอย่าง คือ “ผู้ใช้ฟรีก็เข้าถึงโมเดลหลักรุ่นใหม่ได้” และ “วางจำหน่ายพร้อมกันบนสามแพลตฟอร์มคลาวด์ใหญ่” ซึ่งบ่งชี้ว่าอุปสรรคในการนำเครื่องมือ AI มาใช้ในองค์กรกำลังลดลงเรื่อย ๆ หากทีมงานยังไม่เคยประเมินการนำ Claude มาใช้ตรวจโค้ด แก้ปัญหาระบบ หรือพัฒนาเครื่องมือภายใน นี่คือจังหวะที่ดีในการทบทวนใหม่อีกครั้ง

เหมาะกับอุตสาหกรรม: อีคอมเมิร์ซและโซเชียล
แบบทดสอบ: ยืนยันความเข้าใจ
5 บทความ · ตอบถูก 80% ผ่าน บันทึกลงโปรไฟล์การเรียนรู้ เข้าสู่ระบบเพื่อทำแบบทดสอบ
ถาม AI: บทความนี้ใช้กับการบริหารของคุณอย่างไร?
เนื้อหาสร้างโดย AI จากบทความนี้ โปรดใช้วิจารณญาณในการพิจารณาความถูกต้อง
ตอนถัดไป・บันทึกเหตุการณ์ AI เพื่อผู้บริหาร DeepSeek เปิดตัว R1-0528 อัปเดตใหญ่ ความแม่นยำในการให้เหตุผลพุ่งกระโดด เปิดซอร์สใช้เชิงพาณิชย์ได้ฟรี

บทความที่เกี่ยวข้อง

เราใช้คุกกี้ที่จำเป็นเพื่อรักษาการเข้าสู่ระบบและภาษา และเก็บพฤติกรรมการใช้งานเพื่อปรับปรุงบริการ คุณเลือกเฉพาะที่จำเป็นได้ นโยบายความเป็นส่วนตัว