คอลัมน์ บันทึกเหตุการณ์ AI เพื่อผู้บริหาร ตอนที่ 228/303 ตอน ดูสารบัญคอร์ส

Anthropic แก้การบล็อกเกินจำเป็นด้านชีววิทยาใน Fable 5: fallback ด้านชีววิทยาลดราว 85% แต่ข้อจำกัดสาขาเสี่ยงสูงยังคงเดิม

28/08/2026 174
4:10
Anthropic แก้การบล็อกเกินจำเป็นด้านชีววิทยาใน Fable 5: fallback ด้านชีววิทยาลดราว 85% แต่ข้อจำกัดสาขาเสี่ยงสูงยังคงเดิม
ภาพ/Photo by Davide Buttani on Unsplash

วันที่ 7 สิงหาคม พ.ศ. 2569 Anthropic ประกาศปรับปรุงมาตรการป้องกันด้านชีววิทยาของ Fable 5 โดยเขียนธรรมนูญ (constitution) ของตัวจำแนกใหม่และฝึกใหม่ ทำให้ fallback ด้านชีววิทยาลดลงราว 85% ส่วน fallback รวมทุกสาเหตุคาดว่าจะลดลงราว 67% (Claude.ai), 55% (Cowork), 17% (Claude Code) และ 7% (Claude Platform) ขณะที่สาขาสองทางอย่างไวรัสวิทยาและพิษวิทยายังถูกจำกัดเหมือนเดิม

เมื่อวันที่ 7 สิงหาคม พ.ศ. 2569 Anthropic เผยแพร่เอกสาร “Improving Fable 5's biology safeguards” แก้ไขการตัดสินผิดพลาดของระบบกรองด้านชีววิทยา โดยเขียนธรรมนูญ (constitution) ของตัวจำแนกขึ้นใหม่และฝึกโมเดลใหม่ ทำให้ fallback ด้านชีววิทยาลดลงราว 85% คำว่า fallback หมายถึงกรณีที่ตัวจำแนกตัดสินว่าคำถามอยู่ในขอบเขตชีววิทยาความเสี่ยงสูง ระบบจะไม่ให้ Fable 5 ตอบ แต่ส่งต่อให้ Opus 5 ซึ่ง Anthropic ระบุว่าเป็น “โมเดลที่มีความสามารถด้านชีววิทยาไม่เท่า Fable 5” อันหมายถึงเพดานความสามารถเฉพาะสาขานี้

แก้กฎก่อน แล้วจึงฝึกใหม่ตามกฎ

บริษัทเปิดเผยสามขั้นตอน

  1. เขียนธรรมนูญของตัวจำแนกใหม่ กำหนดให้ชัดว่าสิ่งใดควรบล็อกและสิ่งใดควรปล่อยผ่าน
  2. รวบรวมความเห็นผู้เชี่ยวชาญทั้งภายในและภายนอก เติมเกณฑ์จากหน้างานคลินิก การศึกษา และห้องปฏิบัติการตรวจวิเคราะห์
  3. สร้างชุดข้อมูลฝึกตามกฎใหม่ และฝึกตัวจำแนกใหม่

สาระคือแก้กฎเกณฑ์ก่อนแล้วจึงแก้โมเดล มิใช่การผ่อนเกณฑ์ลงทั้งกระดาน อัตราการตรวจจับเนื้อหาอันตรายคงเดิม ลดเฉพาะการแจ้งเตือนผิดพลาด (false positive)

ตัวเลขสองชุดวัดคนละเรื่อง

ผลลัพธ์ที่ประกาศเป็นตัวเลขสองชุดที่นิยามต่างกัน

  • fallback ด้านชีววิทยาโดยตรง ลดลงราว 85%
  • fallback รวมของแต่ละแพลตฟอร์ม (รวมทุกสาเหตุ) คาดว่าจะลดลง Claude.ai ราว 67%, Cowork ราว 55%, Claude Code ราว 17%, Claude Platform ราว 7%

ความต่างสะท้อนว่าสัดส่วนคำถามด้านชีววิทยาใน fallback ทั้งหมดของแต่ละแพลตฟอร์มไม่เท่ากัน Claude.ai มีสัดส่วนสูงจึงลดลงมาก ส่วน Claude Platform มีสัดส่วนต่ำจึงลดเพียงราว 7% องค์กรที่เชื่อมต่อผ่าน API จึงรู้สึกถึงการปรับปรุงน้อยกว่าผู้ใช้รายบุคคลบนหน้าจอสนทนา ทั้งนี้บริษัทมิได้เปิดเผยการเปลี่ยนแปลงของอัตราการปล่อยผ่านเนื้อหาอันตราย ข้อมูลจึงมีเพียงด้านเดียว

สิ่งที่ไม่ได้ผ่อนคลาย

กลุ่มที่ได้ประโยชน์มีสี่ประเภท ได้แก่ การอ่านรายงานผลตรวจ การสอบถามอาการ คำถามเชิงการศึกษาด้านชีววิทยา และการสนับสนุนงานคลินิก แต่ข้อจำกัดไม่ได้ผ่อนคลาย สาขาสองทางอย่างไวรัสวิทยา พิษวิทยา การออกแบบระดับโมเลกุล และคำถามด้านการพัฒนายา Fable 5 ยังคง fallback ไปยัง Opus 5 เพราะอาจช่วยผู้ไม่ประสงค์ดีพัฒนาอาวุธชีวภาพอย่างมีนัยสำคัญ สาระจึงคือการแก้การตัดสินผิดพลาด มิใช่การยกเลิกข้อจำกัด

ความหมายต่อผู้บริหาร

ประเด็นคือการนับ “ต้นทุนของการตัดสินผิดพลาด” เป็นต้นทุนรายการหนึ่ง เมื่อระบบบล็อกเกินจำเป็น ต้นทุนจะไม่ปรากฏในรายงานความมั่นคงปลอดภัยสารสนเทศ แต่กระจายอยู่ตามหน้างานการแพทย์ ห้องปฏิบัติการ และประกันคุณภาพ พนักงานจะบ่นเพียงว่าเครื่องมือใช้ยาก ก่อนตัดสินใจใช้เครื่องมือ AI จึงควรให้แต่ละหน่วยงานส่งคำถามที่ใช้จริงหน่วยละสิบข้อ แล้ววัดว่าความผิดพลาดแบบบล็อกเกินและปล่อยผ่านมีสัดส่วนเท่าใด การดูเพียง benchmark ด้านความสามารถ วัดไม่ได้ว่าพนักงานถูกขัดจังหวะวันละกี่ครั้ง

แบบทดสอบ: ยืนยันความเข้าใจ
5 บทความ · ตอบถูก 80% ผ่าน บันทึกลงโปรไฟล์การเรียนรู้ เข้าสู่ระบบเพื่อทำแบบทดสอบ
ถาม AI: บทความนี้ใช้กับการบริหารของคุณอย่างไร?
เนื้อหาสร้างโดย AI จากบทความนี้ โปรดใช้วิจารณญาณในการพิจารณาความถูกต้อง
ตอนถัดไป・บันทึกเหตุการณ์ AI เพื่อผู้บริหาร OpenAI เปิดตัว GPT-5.6-Cyber โมเดลเฉพาะทางไซเบอร์ พร้อมขยาย Daybreak เป็นสองระดับ Blue/Red

บทความที่เกี่ยวข้อง

เราใช้คุกกี้ที่จำเป็นเพื่อรักษาการเข้าสู่ระบบและภาษา และเก็บพฤติกรรมการใช้งานเพื่อปรับปรุงบริการ คุณเลือกเฉพาะที่จำเป็นได้ นโยบายความเป็นส่วนตัว