คอลัมน์ บันทึกเหตุการณ์ AI เพื่อผู้บริหาร ตอนที่ 56/303 ตอน ดูสารบัญคอร์ส

Google DeepMind เปิดตัวโมเดลขนาดเล็ก Gemma 2 2B พร้อมเครื่องมือความปลอดภัยและการอธิบายได้ ShieldGemma และ Gemma Scope

31/07/2024 266
≈4:27
Google DeepMind เปิดตัวโมเดลขนาดเล็ก Gemma 2 2B พร้อมเครื่องมือความปลอดภัยและการอธิบายได้ ShieldGemma และ Gemma Scope
ภาพ/Photo by Sandip Kalal on Unsplash

Google DeepMind เปิดตัว Gemma 2 2B โมเดลขนาด 2 พันล้านพารามิเตอร์ พร้อมเครื่องมือความปลอดภัยเนื้อหา ShieldGemma และเครื่องมือวิเคราะห์การทำงานภายในโมเดล Gemma Scope ตอกย้ำแนวทาง AI ขนาดเล็กที่รับผิดชอบ

เมื่อวันที่ 31 กรกฎาคม พ.ศ. 2567 Google DeepMind ได้เปิดตัว Gemma 2 2B ซึ่งเป็นรุ่นที่มีขนาดเล็กที่สุดในตระกูล Gemma 2 มีจำนวนพารามิเตอร์เพียง 2 พันล้าน (2B) นักพัฒนาสามารถดาวน์โหลดผ่าน Kaggle, Hugging Face, Vertex AI Model Garden หรือทดลองใช้งานได้ทันทีบน Google AI Studio โดยไม่ต้องตั้งค่าสภาพแวดล้อมเพิ่มเติม พร้อมกันนี้ Google ยังเปิดตัวเครื่องมือประกอบอีกสองรายการ ได้แก่ ShieldGemma โมเดลด้านความปลอดภัยที่ออกแบบมาเพื่อตรวจจับและกรองเนื้อหาที่เป็นอันตราย (เช่น วาจาสร้างความเกลียดชัง การคุกคาม เนื้อหาทางเพศโจ่งแจ้ง และเนื้อหาอันตราย) และ Gemma Scope ชุดเครื่องมือด้านการอธิบายได้ (interpretability) ที่ช่วยให้นักวิจัยสามารถเปิดกล่องดำ สังเกตการทำงานของนิวรอนและฟีเจอร์ภายในโมเดล ทั้งสามรายการเปิดตัวพร้อมกันในวันเดียว ถือเป็นการเปิดตัวผลิตภัณฑ์แบบครบชุด ไม่ใช่เพียงโมเดลเดี่ยว

ความหมายเชิงเทคนิค: โมเดลเล็กก็ต้องสมน้ำสมเนื้อกับกลไกความปลอดภัยของโมเดลใหญ่

ที่ผ่านมาการพูดถึง AI ที่รับผิดชอบมักโฟกัสอยู่ที่โมเดลใหญ่ระดับเรือธง การเปิดตัว Gemma 2 2B จึงส่งสัญญาณชัดเจนว่า แม้จะเป็นโมเดลขนาดเล็กที่รันได้บน GPU ระดับผู้บริโภคเพียงตัวเดียว หรือแม้แต่บนอุปกรณ์ edge ก็ควรมาพร้อมกับระบบความปลอดภัยเนื้อหาและเครื่องมืออธิบายได้ไปพร้อมกัน แทนที่จะรอให้โมเดลใหญ่ขึ้นก่อนแล้วค่อยตามมาทีหลัง ShieldGemma เองถูกปรับแต่ง (fine-tune) บนพื้นฐานของ Gemma 2 ออกแบบให้เสียบเข้ากับแอปพลิเคชันที่มีอยู่แล้วเพื่อทำหน้าที่เป็นประตูความปลอดภัย ส่วน Gemma Scope ใช้เทคนิค sparse autoencoder ในการแยกรูปแบบการทำงานของนิวรอนที่ซับซ้อนและตีความยากออกมาเป็นฟีเจอร์ที่มนุษย์เข้าใจได้ง่ายขึ้น นับเป็นการนำงานวิจัยด้าน interpretability จากบทความวิชาการมาสู่เครื่องมือที่เปิดใช้งานได้จริง

เทียบกับรุ่นก่อนและคู่แข่งในอุตสาหกรรม

เมื่อเทียบกับผู้ให้บริการรายอื่นในช่วงเวลาเดียวกันที่มักเก็บเรื่องความปลอดภัยและการอธิบายได้ไว้เป็นงานวิจัยภายในหรือการทดสอบแบบปิด การที่ Google เลือกเปิด ShieldGemma และ Gemma Scope ให้นักพัฒนาและชุมชนวิจัยภายนอกใช้งานได้ ถือเป็นการนำเครื่องมือตรวจสอบและแก้ไขข้อบกพร่องที่เคยใช้เฉพาะภายในห้องแล็บมาสู่มือบุคคลที่สามเร็วขึ้น สอดคล้องกับกระแสการแข่งขันของค่ายโมเดลโอเพนซอร์ส (เช่น Meta Llama 3, Mistral) ที่การแข่งขันด้วยขนาดพารามิเตอร์และคะแนนเบนช์มาร์กเพียงอย่างเดียวไม่เพียงพออีกต่อไป เบา ปลอดภัย โปร่งใส กำลังกลายเป็นสนามรบใหม่ที่ผู้ให้บริการโมเดลใช้สร้างความไว้วางใจและความแตกต่าง

ปฏิกิริยาจากอุตสาหกรรม

ชุมชนนักพัฒนาต้อนรับรุ่น 2B ที่ลดอุปสรรคในการทดลองและติดตั้งใช้งาน โดยเฉพาะทีมที่ต้องการรัน AI บนอุปกรณ์ในองค์กร อุปกรณ์พกพา หรือในสถานการณ์ที่อ่อนไหวด้านต้นทุน ถือเป็นตัวเลือกที่ใช้งานได้จริง ส่วนแวดวงวิจัยตอบรับการเปิดเผย Gemma Scope อย่างกระตือรือร้น มองว่าเป็นก้าวสำคัญที่ช่วยให้งานวิจัยด้าน interpretability เข้าถึงได้กว้างขึ้น เปิดโอกาสให้นักวิชาการและนักวิจัยอิสระจำนวนมากขึ้นเข้ามาศึกษาโครงสร้างภายในของโมเดล แทนที่จะพึ่งพาผลงานภายในของห้องแล็บขนาดใหญ่เพียงไม่กี่แห่ง

ความหมายต่อผู้บริหาร

ข่าวนี้เตือนผู้บริหารว่า เมื่อนำเครื่องมือ AI มาใช้งาน คำถามว่าโมเดลใช้งานได้หรือไม่เป็นเพียงชั้นแรก ส่วนมีการควบคุมความปลอดภัยของเนื้อหาหรือไม่ และเมื่อเกิดข้อผิดพลาดสามารถตรวจสอบย้อนกลับได้หรือไม่ ก็ควรถูกบรรจุไว้ในรายการตรวจสอบตอนจัดซื้อและประเมินการนำไปใช้งานด้วยเช่นกัน แทนที่จะแก้ไขหลังเกิดปัญหาแล้ว

แบบทดสอบ: ยืนยันความเข้าใจ
5 บทความ · ตอบถูก 80% ผ่าน บันทึกลงโปรไฟล์การเรียนรู้ เข้าสู่ระบบเพื่อทำแบบทดสอบ
ถาม AI: บทความนี้ใช้กับการบริหารของคุณอย่างไร?
เนื้อหาสร้างโดย AI จากบทความนี้ โปรดใช้วิจารณญาณในการพิจารณาความถูกต้อง
ตอนถัดไป・บันทึกเหตุการณ์ AI เพื่อผู้บริหาร OpenAI เปิดตัว Structured Outputs พร้อมลดราคา GPT-4o ครั้งใหญ่

บทความที่เกี่ยวข้อง

เราใช้คุกกี้ที่จำเป็นเพื่อรักษาการเข้าสู่ระบบและภาษา และเก็บพฤติกรรมการใช้งานเพื่อปรับปรุงบริการ คุณเลือกเฉพาะที่จำเป็นได้ นโยบายความเป็นส่วนตัว