DeepSeek เปิดตัว DeepSeek-V3-0324 รุ่นอัปเดต ปรับปรุงขั้นตอนหลังการฝึกฝน คะแนนคณิตศาสตร์และโค้ดแซง GPT-4.5
DeepSeek เปิดตัว DeepSeek-V3-0324 เมื่อวันที่ 24 มีนาคม 2568 ใช้สถาปัตยกรรมเดิมแต่ปรับปรุงขั้นตอนหลังการฝึกฝน เสริมความสามารถด้านเหตุผล การเขียนโค้ด และการใช้เครื่องมือ พร้อมเปลี่ยนไปใช้สัญญาอนุญาต MIT
DeepSeek เปิดตัว DeepSeek-V3-0324 เมื่อวันที่ 24 มีนาคม 2568 ซึ่งเป็นรุ่นปรับปรุงจากโมเดล DeepSeek-V3 ดั้งเดิม ทางบริษัทระบุว่ารุ่นใหม่นี้ยังคงใช้สถาปัตยกรรมโมเดลพื้นฐานเดิม โดยไม่ได้ฝึกฝนโมเดลใหม่ทั้งหมด แต่มุ่งเน้นการปรับปรุงขั้นตอน “การฝึกฝนภายหลัง” (post-training) โดยนำประสบการณ์ด้านเทคนิคการเรียนรู้แบบเสริมแรง (reinforcement learning) จากโมเดลด้านการให้เหตุผล R1 ของตนเองมาปรับใช้ แนวทาง “สถาปัตยกรรมเดิม เสริมการฝึกฝนภายหลัง” นี้ทำให้ DeepSeek สามารถออกรุ่นที่มีประสิทธิภาพดีขึ้นได้อย่างรวดเร็วด้วยต้นทุนที่ค่อนข้างต่ำ
DeepSeek-V3-0324 รองรับหน้าต่างบริบทยาวถึง 128,000 โทเคน เหมาะกับงานที่ต้องอ่านเนื้อหาจำนวนมากในครั้งเดียว เช่น การวิเคราะห์เอกสารยาว การสรุปหนังสือ และการทำความเข้าใจโค้ดขนาดใหญ่ ข้อมูลการทดสอบที่ทางบริษัทเผยแพร่ระบุว่ารุ่นนี้มีผลการทดสอบด้านคณิตศาสตร์และโค้ดที่เหนือกว่า GPT-4.5 ของ OpenAI ที่เปิดตัวในช่วงเวลาใกล้เคียงกัน อีกจุดเปลี่ยนสำคัญคือรูปแบบสัญญาอนุญาต โดย DeepSeek เปลี่ยนจากสัญญาอนุญาตโอเพนซอร์สแบบกำหนดเองเดิม มาเป็นสัญญาอนุญาต MIT ที่ใช้กันอย่างแพร่หลายในวงการ ซึ่งช่วยลดข้อกังวลด้านกฎหมายและอุปสรรคในการนำไปใช้เชิงพาณิชย์สำหรับองค์กรและนักพัฒนา
เหตุใดการปรับปรุงขั้นตอนหลังการฝึกฝนจึงน่าสนใจ
แทนที่จะเปิดตัวโมเดลรุ่นใหม่ที่มีพารามิเตอร์มากขึ้นและฝึกฝนใหม่ทั้งหมด DeepSeek เลือกที่จะ “ปรับจูน” พฤติกรรมของโมเดลบนสถาปัตยกรรม V3 เดิม ผ่านเทคนิคการฝึกฝนภายหลังอย่างการเรียนรู้แบบเสริมแรง ทำให้ความสามารถด้านการให้เหตุผล การเขียนโค้ด และการใช้เครื่องมือ (tool use) ดีขึ้นพร้อมกัน สิ่งนี้สะท้อนว่าความก้าวหน้าของโมเดลไม่จำเป็นต้องมาจากการลงทุนฝึกฝนขนาดใหญ่เพียงอย่างเดียว ขั้นตอนการฝึกฝนภายหลังเองก็เป็นจุดคานงัดสำคัญที่ช่วยยกระดับประสิทธิภาพได้ และอธิบายได้ว่าเหตุใด DeepSeek จึงสามารถออกรุ่นอัปเดตต่อเนื่องได้ในเวลาอันสั้น
สัญญาณจากการเทียบผลทดสอบกับ GPT-4.5
ข้อมูลที่ทางบริษัทเผยแพร่ระบุว่า DeepSeek-V3-0324 มีผลทดสอบด้านคณิตศาสตร์และโค้ดเหนือกว่า GPT-4.5 การเปรียบเทียบนี้ได้รับความสนใจ เพราะ GPT-4.5 เป็นโมเดลรุ่นทดลองวิจัยที่ OpenAI เพิ่งเปิดตัวในช่วงปลายเดือนกุมภาพันธ์ 2568 ซึ่งเป็นช่วงเวลาใกล้เคียงกัน การที่โมเดลโอเพนซอร์สที่เปลี่ยนมาใช้สัญญาอนุญาต MIT แบบผ่อนปรน สามารถทัดเทียมหรือแซงหน้าผลลัพธ์ล่าสุดของโมเดลปิดในบางรายการทดสอบได้ สะท้อนว่าฝ่ายโอเพนซอร์สไม่ได้ตามหลังโมเดลปิดชั้นนำมากนักในด้านความเร็วของการไล่ตาม และท้าทายภาพจำเดิมที่ว่า “โมเดลโอเพนซอร์สเป็นได้แค่ตัวสำรอง”
ความหมายเชิงปฏิบัติของการเปลี่ยนไปใช้สัญญาอนุญาต MIT
การเปลี่ยนจากสัญญาอนุญาตแบบกำหนดเองมาเป็น MIT เป็นการเปลี่ยนแปลงที่มักถูกมองข้าม แต่ส่งผลโดยตรงต่อผู้ใช้งานระดับองค์กรมากที่สุดในการอัปเดตครั้งนี้ สัญญาอนุญาต MIT เป็นหนึ่งในสัญญาอนุญาตโอเพนซอร์สที่ผ่อนปรนและได้รับการยอมรับจากฝ่ายกฎหมายขององค์กรมากที่สุด อนุญาตให้ใช้งาน ดัดแปลง นำไปใช้เชิงพาณิชย์ หรือแม้แต่อนุญาตช่วงต่อได้อย่างอิสระ เพียงคงคำประกาศสัญญาอนุญาตเดิมไว้ นั่นหมายความว่าหากองค์กรต้องการนำ DeepSeek-V3-0324 ไปใช้ในระบบภายใน พัฒนาต่อยอด หรือนำไปใช้เชิงพาณิชย์ ความซับซ้อนในการตรวจสอบด้านกฎหมายจะลดลงอย่างชัดเจน ซึ่งเป็นประโยชน์เชิงปฏิบัติอย่างมากสำหรับทีมไอทีและฝ่ายกฎหมายที่กำลังประเมินการนำโมเดลโอเพนซอร์สมาใช้
สำหรับผู้บริหาร ความหมายของข่าวนี้ไม่ได้อยู่ที่การไล่ตามอันดับของโมเดลใดโมเดลหนึ่ง แต่เป็นการเตือนว่าความเร็วในการพัฒนาโมเดล AI และเงื่อนไขสัญญาอนุญาตกำลังเปลี่ยนแปลงอย่างรวดเร็ว การยกระดับความสามารถด้านบริบทยาวและความเข้าใจโค้ด หมายถึงความเป็นไปได้ในการมอบหมายให้ AI จัดการสัญญายาว รายงานยาว หรือตรวจสอบโค้ดก้าวไปอีกขั้น จึงควรจับตาว่าเครื่องมือเหล่านี้สามารถช่วยลดภาระงานเอกสารและงานเทคนิคของทีมได้จริงหรือไม่
สมาชิกฟรีทำแบบทดสอบ คุยกับโค้ช AI ฟังบทความสะสมประวัติการเรียนรู้ สมัครรับ 100 พอยต์ทันที
สมัครฟรี