Anthropic แก้การบล็อกเกินจำเป็นด้านชีววิทยาใน Fable 5: fallback ด้านชีววิทยาลดราว 85% แต่ข้อจำกัดสาขาเสี่ยงสูงยังคงเดิม
วันที่ 7 สิงหาคม พ.ศ. 2569 Anthropic ประกาศปรับปรุงมาตรการป้องกันด้านชีววิทยาของ Fable 5 โดยเขียนธรรมนูญ (constitution) ของตัวจำแนกใหม่และฝึกใหม่ ทำให้ fallback ด้านชีววิทยาลดลงราว 85% ส่วน fallback รวมทุกสาเหตุคาดว่าจะลดลงราว 67% (Claude.ai), 55% (Cowork), 17% (Claude Code) และ 7% (Claude Platform) ขณะที่สาขาสองทางอย่างไวรัสวิทยาและพิษวิทยายังถูกจำกัดเหมือนเดิม
เมื่อวันที่ 7 สิงหาคม พ.ศ. 2569 Anthropic เผยแพร่เอกสาร “Improving Fable 5's biology safeguards” แก้ไขการตัดสินผิดพลาดของระบบกรองด้านชีววิทยา โดยเขียนธรรมนูญ (constitution) ของตัวจำแนกขึ้นใหม่และฝึกโมเดลใหม่ ทำให้ fallback ด้านชีววิทยาลดลงราว 85% คำว่า fallback หมายถึงกรณีที่ตัวจำแนกตัดสินว่าคำถามอยู่ในขอบเขตชีววิทยาความเสี่ยงสูง ระบบจะไม่ให้ Fable 5 ตอบ แต่ส่งต่อให้ Opus 5 ซึ่ง Anthropic ระบุว่าเป็น “โมเดลที่มีความสามารถด้านชีววิทยาไม่เท่า Fable 5” อันหมายถึงเพดานความสามารถเฉพาะสาขานี้
แก้กฎก่อน แล้วจึงฝึกใหม่ตามกฎ
บริษัทเปิดเผยสามขั้นตอน
- เขียนธรรมนูญของตัวจำแนกใหม่ กำหนดให้ชัดว่าสิ่งใดควรบล็อกและสิ่งใดควรปล่อยผ่าน
- รวบรวมความเห็นผู้เชี่ยวชาญทั้งภายในและภายนอก เติมเกณฑ์จากหน้างานคลินิก การศึกษา และห้องปฏิบัติการตรวจวิเคราะห์
- สร้างชุดข้อมูลฝึกตามกฎใหม่ และฝึกตัวจำแนกใหม่
สาระคือแก้กฎเกณฑ์ก่อนแล้วจึงแก้โมเดล มิใช่การผ่อนเกณฑ์ลงทั้งกระดาน อัตราการตรวจจับเนื้อหาอันตรายคงเดิม ลดเฉพาะการแจ้งเตือนผิดพลาด (false positive)
ตัวเลขสองชุดวัดคนละเรื่อง
ผลลัพธ์ที่ประกาศเป็นตัวเลขสองชุดที่นิยามต่างกัน
- fallback ด้านชีววิทยาโดยตรง ลดลงราว 85%
- fallback รวมของแต่ละแพลตฟอร์ม (รวมทุกสาเหตุ) คาดว่าจะลดลง Claude.ai ราว 67%, Cowork ราว 55%, Claude Code ราว 17%, Claude Platform ราว 7%
ความต่างสะท้อนว่าสัดส่วนคำถามด้านชีววิทยาใน fallback ทั้งหมดของแต่ละแพลตฟอร์มไม่เท่ากัน Claude.ai มีสัดส่วนสูงจึงลดลงมาก ส่วน Claude Platform มีสัดส่วนต่ำจึงลดเพียงราว 7% องค์กรที่เชื่อมต่อผ่าน API จึงรู้สึกถึงการปรับปรุงน้อยกว่าผู้ใช้รายบุคคลบนหน้าจอสนทนา ทั้งนี้บริษัทมิได้เปิดเผยการเปลี่ยนแปลงของอัตราการปล่อยผ่านเนื้อหาอันตราย ข้อมูลจึงมีเพียงด้านเดียว
สิ่งที่ไม่ได้ผ่อนคลาย
กลุ่มที่ได้ประโยชน์มีสี่ประเภท ได้แก่ การอ่านรายงานผลตรวจ การสอบถามอาการ คำถามเชิงการศึกษาด้านชีววิทยา และการสนับสนุนงานคลินิก แต่ข้อจำกัดไม่ได้ผ่อนคลาย สาขาสองทางอย่างไวรัสวิทยา พิษวิทยา การออกแบบระดับโมเลกุล และคำถามด้านการพัฒนายา Fable 5 ยังคง fallback ไปยัง Opus 5 เพราะอาจช่วยผู้ไม่ประสงค์ดีพัฒนาอาวุธชีวภาพอย่างมีนัยสำคัญ สาระจึงคือการแก้การตัดสินผิดพลาด มิใช่การยกเลิกข้อจำกัด
ความหมายต่อผู้บริหาร
ประเด็นคือการนับ “ต้นทุนของการตัดสินผิดพลาด” เป็นต้นทุนรายการหนึ่ง เมื่อระบบบล็อกเกินจำเป็น ต้นทุนจะไม่ปรากฏในรายงานความมั่นคงปลอดภัยสารสนเทศ แต่กระจายอยู่ตามหน้างานการแพทย์ ห้องปฏิบัติการ และประกันคุณภาพ พนักงานจะบ่นเพียงว่าเครื่องมือใช้ยาก ก่อนตัดสินใจใช้เครื่องมือ AI จึงควรให้แต่ละหน่วยงานส่งคำถามที่ใช้จริงหน่วยละสิบข้อ แล้ววัดว่าความผิดพลาดแบบบล็อกเกินและปล่อยผ่านมีสัดส่วนเท่าใด การดูเพียง benchmark ด้านความสามารถ วัดไม่ได้ว่าพนักงานถูกขัดจังหวะวันละกี่ครั้ง
สมาชิกฟรีทำแบบทดสอบ คุยกับโค้ช AI ฟังบทความสะสมประวัติการเรียนรู้ สมัครรับ 100 พอยต์ทันที
สมัครฟรี