Google DeepMind ยืนยัน Gemini Deep Think เวอร์ชันขั้นสูงคว้ามาตรฐานเหรียญทอง IMO อย่างเป็นทางการ
Google DeepMind ประกาศอย่างเป็นทางการเมื่อวันที่ 21 กรกฎาคม 2025 ว่า Gemini เวอร์ชันขั้นสูงที่ใช้โหมด Deep Think คว้ามาตรฐานเหรียญทองในการแข่งขันคณิตศาสตร์โอลิมปิกระหว่างประเทศ (IMO) 2025 ได้สำเร็จ แก้โจทย์ได้ 5 จาก 6 ข้อ คะแนนรวม 35/42 โดยเลื่อนการประกาศไปเป็นวันจันทร์เพื่อเคารพขั้นตอนการตรวจสอบผลอย่างเป็นทางการของ IMO
Google DeepMind ประกาศอย่างเป็นทางการผ่านบล็อกของบริษัทเมื่อวันจันทร์ที่ 21 กรกฎาคม 2025 ว่า Gemini เวอร์ชันขั้นสูงที่เสริมด้วยโหมดการให้เหตุผลแบบ "Deep Think" สามารถคว้ามาตรฐานเหรียญทองในการแข่งขันคณิตศาสตร์โอลิมปิกระหว่างประเทศ (IMO) ประจำปี 2025 ได้อย่างเป็นทางการ โดยระบบนี้แก้โจทย์ได้ 5 จาก 6 ข้อ คิดเป็นคะแนนรวม 35 คะแนน (จากคะแนนเต็ม 42) ซึ่งถึงเกณฑ์เหรียญทองที่ทาง IMO กำหนด
สิ่งที่น่าสนใจคือจังหวะเวลาของการประกาศครั้งนี้ Demis Hassabis ซีอีโอของ DeepMind ระบุว่า ทีมงานเลือกที่จะเลื่อนการประกาศผลไปเป็นวันจันทร์ เพื่อเคารพคำขอของผู้จัดการแข่งขัน IMO ที่กำหนดให้ห้องปฏิบัติการ AI ทุกแห่งที่เข้าร่วมทดสอบต้องรอให้ทาง IMO ตรวจสอบผลคะแนนอย่างเป็นทางการก่อน จึงจะสามารถเผยแพร่ผลได้ ขณะที่ OpenAI ได้ประกาศผลของโมเดลตนเองในการแข่งขัน IMO ไปก่อนแล้วตั้งแต่วันเสาร์ที่ผ่านมา ห่างกันประมาณสองวัน สะท้อนให้เห็นแนวทางที่แตกต่างกันระหว่างห้องปฏิบัติการ AI แต่ละแห่งในการเลือกระหว่าง "รีบประกาศข่าว" กับ "รอปฏิบัติตามข้อตกลงของผู้จัดงาน"
ความหมายเชิงเทคนิค: จากการแก้โจทย์สู่ "การคิดเชิงลึก"
Deep Think ไม่ใช่เพียงการเปลี่ยนชื่อโมเดล Gemini เดิม แต่เป็นโหมดการประมวลผลที่เสริมความสามารถด้านการให้เหตุผล ทำให้โมเดลสามารถคิดวิเคราะห์และตรวจสอบตนเองได้ลึกและยาวนานขึ้นก่อนให้คำตอบ คล้ายกับกระบวนการที่มนุษย์ใช้เมื่อแก้โจทย์คณิตศาสตร์ที่ต้องคำนวณและตรวจทานซ้ำหลายรอบ โจทย์ของ IMO ส่วนใหญ่เป็นโจทย์พิสูจน์ที่ต้องอาศัยห่วงโซ่ตรรกะที่รัดกุมและการอนุมานหลายขั้นตอน ไม่ใช่เพียงการค้นคืนความรู้ ดังนั้นผลลัพธ์ระดับเหรียญทองจึงสะท้อนความก้าวหน้าที่แท้จริงในด้าน "การให้เหตุผลเชิงซับซ้อนหลายขั้นตอน" ไม่ใช่แค่การจดจำโจทย์เดิมหรือใช้สูตรสำเร็จ
เทียบกับคู่แข่ง: แข่งขันในสนามเดียวกัน จุดยืนต่างกัน
นี่เป็นห้องปฏิบัติการหลักแห่งที่สองที่ยืนยันต่อสาธารณะว่า AI ของตนคว้ามาตรฐานเหรียญทองในการแข่งขันคณิตศาสตร์ระดับโลกนี้ได้ ต่อจากที่ OpenAI ประกาศผลคล้ายกันก่อนหน้านี้ คะแนนและจำนวนข้อที่แก้ได้ของทั้งสองบริษัทใกล้เคียงกัน ซึ่งในระดับหนึ่งสะท้อนว่า "ความสามารถในการให้เหตุผลระดับสูงสุด" ได้กลายเป็นเกณฑ์ทางเทคนิคที่หลายห้องปฏิบัติการเข้าใกล้พร้อมกันในช่วงกลางปี 2025 ไม่ใช่จุดแข็งเฉพาะของบริษัทใดบริษัทหนึ่งอีกต่อไป อย่างไรก็ตาม DeepMind เน้นย้ำเป็นพิเศษว่าตนรอการตรวจสอบอย่างเป็นทางการก่อนประกาศ ซึ่งถูกมองว่าเป็นการแสดงจุดยืนทางอ้อมที่ต่างจากแนวทาง "รีบประกาศผลก่อนได้รับการยืนยันจากบุคคลที่สาม"
ปฏิกิริยาในวงการ: การดึงกันระหว่างความน่าเชื่อถือกับการตรวจสอบ
ผลงานของโมเดล AI ในการแข่งขันคณิตศาสตร์ถือเป็นตัวชี้วัดสำคัญที่ใช้ตรวจสอบว่าความสามารถด้านการให้เหตุผลที่อ้างนั้น "เกินจริง" หรือไม่ เพราะโจทย์เปิดเผยต่อสาธารณะ ผลลัพธ์ถูกหรือผิดชัดเจน ไม่สามารถใช้คำพูดกลบเกลื่อนได้ การที่ DeepMind เลือกรอการรับรองอย่างเป็นทางการก่อนประกาศ ในแง่หนึ่งคือการช่วยสร้างธรรมเนียมปฏิบัติของการตรวจสอบโดยบุคคลที่สามที่รัดกุมขึ้นสำหรับการ "อ้างความสามารถของ AI" ซึ่งเป็นสัญญาณที่ควรจับตาต่อไปว่าวงการจะมองความน่าเชื่อถือของการประเมินความสามารถโมเดลอย่างไร
สำหรับผู้บริหาร ความสำคัญของข่าวนี้ไม่ได้อยู่ที่ "AI แก้โจทย์คณิตศาสตร์ได้หรือไม่" แต่อยู่ที่ความสามารถด้านการให้เหตุผลได้เข้าสู่สนามการตรวจสอบที่เปิดเผยและเข้มงวดแล้ว ซึ่งหมายความว่างานภายในองค์กรที่ต้องอาศัยการอนุมานเชิงตรรกะหลายขั้นตอน (เช่น การเปรียบเทียบเงื่อนไขสัญญาที่ซับซ้อน หรือการคำนวณทางการเงินหลายสถานการณ์) ควรติดตามว่าโหมด "การคิดเชิงลึก" เช่นนี้จะเปิดให้ผู้ใช้ทั่วไปใช้งานได้เมื่อใด
สมาชิกฟรีทำแบบทดสอบ คุยกับโค้ช AI ฟังบทความสะสมประวัติการเรียนรู้ สมัครรับ 100 พอยต์ทันที
สมัครฟรี