คอลัมน์ บันทึกเหตุการณ์ AI เพื่อผู้บริหาร ตอนที่ 35/217 ตอน ดูสารบัญคอร์ส

Google DeepMind เปิดตัว SIMA เอเจนต์ AI สากลที่ "ลงมือทำ" ได้ในโลกเสมือน 3 มิติ

13/03/2024 212
4:43
Google DeepMind เปิดตัว SIMA เอเจนต์ AI สากลที่ "ลงมือทำ" ได้ในโลกเสมือน 3 มิติ

Google DeepMind เปิดตัว SIMA เอเจนต์ AI สากลที่เข้าใจคำสั่งภาษาธรรมชาติ และสามารถลงมือทำภารกิจจริงในเกม 9 เกมและสภาพแวดล้อมวิจัย 4 แบบ สะท้อนก้าวสำคัญของ AI จาก "ตอบคำถาม" สู่ "ลงมือทำ"

เมื่อวันที่ 13 มีนาคม 2024 Google DeepMind ได้เผยแพร่ผลงานวิจัยชื่อ SIMA (Scalable Instructable Multiworld Agent) ซึ่งเป็นระบบเอเจนต์ AI แบบ "สากล" (generalist) ต่างจาก AI ในอดีตที่ถูกฝึกเฉพาะเกมใดเกมหนึ่ง (เช่นโมเดลที่เชี่ยวชาญหมากล้อมหรือ StarCraft) ข้อมูลฝึกของ SIMA ครอบคลุมเกมเชิงพาณิชย์ถึง 9 เกมจากค่ายเกมต่างๆ บวกกับสภาพแวดล้อมวิจัยภายในของ DeepMind อีก 4 แบบ ครอบคลุมฉากเสมือน 3 มิติหลากหลายประเภท ตั้งแต่การสำรวจโลกเปิด การก่อสร้าง ไปจนถึงเกมไขปริศนาเชิงแอ็กชัน

ความสามารถหลักของ SIMA คือ เมื่อผู้ใช้ป้อนคำสั่งด้วยภาษาธรรมชาติ (เช่น "เปิดแผนที่" "เดินไปทางซ้ายไปยังอาคารนั้น" "เก็บไม้ที่อยู่ใกล้ๆ") SIMA จะเข้าใจความหมายและใช้วิธีควบคุมแบบเดียวกับผู้เล่นทั่วไป (คีย์บอร์ดและเมาส์) เพื่อลงมือทำภารกิจนั้นให้สำเร็จจริงบนหน้าจอ โดยไม่ต้องอาศัย API พิเศษหรือช่องทางลับจากผู้พัฒนาเกม นี่คือความแตกต่างที่สำคัญที่สุดจาก AI เกมแบบดั้งเดิม

ความหมายเชิงเทคนิค: จาก "เข้าใจ" สู่ "ทำได้จริง"

ตลอดกว่าหนึ่งปีที่ผ่านมา ความก้าวหน้าของ AI เชิงสร้างสรรค์ส่วนใหญ่เน้นไปที่ "การเข้าใจและสร้างข้อความ/ภาพ" เช่น ตอบคำถาม เขียนคอนเทนต์ วาดภาพ แต่ SIMA แสดงให้เห็นแนวทางอีกแบบหนึ่ง คือ AI จะสามารถแปลงคำสั่งภาษาให้กลายเป็นชุดการกระทำที่เป็นรูปธรรมในพื้นที่เสมือน 3 มิติที่ไม่เคยเห็นมาก่อน และบรรลุเป้าหมายได้หรือไม่ ซึ่งต้องอาศัยทั้งความเข้าใจภาษา การรับรู้เชิงพื้นที่ และการวางแผนตัดสินใจต่อเนื่อง ซึ่งยากกว่าระบบถาม-ตอบธรรมดามาก DeepMind เน้นย้ำว่าสิ่งที่ SIMA เรียนรู้ไม่ใช่ "เทคนิคเฉพาะเกมใดเกมหนึ่ง" แต่เป็นความสามารถในการปฏิบัติงานที่สามารถนำไปใช้ได้กับ "สภาพแวดล้อมเกมใหม่ที่ไม่เคยเจอมาก่อน"

เปรียบเทียบกับเทคโนโลยีเดิม

เมื่อเทียบกับ AlphaGo หรือ AlphaStar ที่เป็น AI แบบ "เชี่ยวชาญเฉพาะเกมเดียว" คุณค่าของ SIMA อยู่ที่ "การขยายผลข้ามสภาพแวดล้อม" นอกจากนี้ยังต่างจากผู้ช่วยเสียงหรือแชทบอทที่รู้จักกันในขณะนั้น (เช่น ChatGPT, Gemini) ซึ่งส่วนใหญ่ยังอยู่ในระดับการสนทนาด้วยข้อความ ไม่ได้ควบคุมโลก 3 มิติที่มีกฎฟิสิกส์โดยตรง SIMA เปรียบเสมือนการนำความสามารถในการเข้าใจของโมเดลภาษา มาเชื่อมต่อกับอินเทอร์เฟซที่ "ลงมือทำ" ได้จริงในโลกเสมือน ถือเป็นตัวอย่างที่เป็นรูปธรรมของ AI ที่ก้าวจากการ "ให้คำแนะนำ" ไปสู่การ "ลงมือทำแทน"

ปฏิกิริยาจากวงการ

หลังการเปิดตัว วงการส่วนใหญ่มองว่า SIMA เป็นความก้าวหน้าสำคัญของสายวิจัย "เอเจนต์ AI" (AI Agent) และเป็นผลงานระยะหนึ่งของ DeepMind ในทิศทางการวิจัยปัญญาประดิษฐ์ทั่วไป (AGI) หลายฝ่ายชี้ว่าเวอร์ชันที่เปิดเผยครั้งนี้ยังเป็นเพียง "การพรีวิวเชิงวิจัย" ยังไม่เปิดให้ใช้งานจริง และคงไม่ปรากฏในผลิตภัณฑ์สำหรับผู้บริโภคในระยะสั้น แต่ความสำคัญอยู่ที่การพิสูจน์ว่า "เอเจนต์สากลข้ามสภาพแวดล้อม" เป็นไปได้ในทางเทคนิค ปูทางให้ AI ก้าวจากโลกเกมไปสู่ภารกิจในโลกจริง เช่น การควบคุมซอฟต์แวร์คอมพิวเตอร์หรือหุ่นยนต์

สำหรับผู้บริหาร สัญญาณที่แท้จริงจากข่าวนี้ไม่ใช่เรื่อง "AI เล่นเกม" แต่คือจุดเปลี่ยนที่ AI กำลังก้าวจาก "การตอบคำถาม" ไปสู่ "การลงมือทำแทน" — ในอีก 1-2 ปีข้างหน้า เอเจนต์ AI ที่เข้าใจคำสั่งและดำเนินภารกิจหลายขั้นตอนได้เองอาจปรากฏในระบบภายในองค์กรหรือการจำลองฝึกอบรม ผู้บริหารควรจับตาความเร็วในการนำเทคโนโลยีสายนี้มาใช้จริง

แบบทดสอบ: ยืนยันความเข้าใจ
5 บทความ · ตอบถูก 80% ผ่าน บันทึกลงโปรไฟล์การเรียนรู้ เข้าสู่ระบบเพื่อทำแบบทดสอบ
ถาม AI: บทความนี้ใช้กับการบริหารของคุณอย่างไร?
เนื้อหาสร้างโดย AI จากบทความนี้ โปรดใช้วิจารณญาณในการพิจารณาความถูกต้อง
ตอนถัดไป・บันทึกเหตุการณ์ AI เพื่อผู้บริหาร อีลอน มัสก์ ทำตามสัญญา: xAI เปิดซอร์ส Grok-1 โมเดล 3.14 แสนล้านพารามิเตอร์

บทความที่เกี่ยวข้อง

เราใช้คุกกี้ที่จำเป็นเพื่อรักษาการเข้าสู่ระบบและภาษา และเก็บพฤติกรรมการใช้งานเพื่อปรับปรุงบริการ คุณเลือกเฉพาะที่จำเป็นได้ นโยบายความเป็นส่วนตัว