คอลัมน์ บันทึกเหตุการณ์ AI เพื่อผู้บริหาร ตอนที่ 113/217 ตอน ดูสารบัญคอร์ส

Gemini 2.5 Pro และ Flash เปิดใช้งานจริง (GA) พร้อมเปิดตัว Flash-Lite รุ่นประหยัด

17/06/2025 101
≈5:12
Gemini 2.5 Pro และ Flash เปิดใช้งานจริง (GA) พร้อมเปิดตัว Flash-Lite รุ่นประหยัด

Google ประกาศเมื่อวันที่ 17 มิถุนายน 2025 ว่า Gemini 2.5 Pro และ Flash พ้นสถานะทดลองใช้ (Preview) เข้าสู่การใช้งานทั่วไป (GA) อย่างเป็นทางการ พร้อมเปิดตัว Gemini 2.5 Flash-Lite ที่หน่วงเวลาต่ำและต้นทุนต่ำกว่าเดิม

เมื่อวันที่ 17 มิถุนายน 2025 Google ประกาศผ่านบล็อกทางการว่าโมเดล Gemini 2.5 Pro และ Gemini 2.5 Flash ได้เข้าสู่สถานะการใช้งานทั่วไปอย่างเป็นทางการ (General Availability หรือ GA) พ้นจากสถานะทดลองใช้ (Preview) ก่อนหน้านี้ พร้อมให้องค์กรและนักพัฒนานำไปใช้ในสภาพแวดล้อมเชิงพาณิชย์จริงได้ ในเวลาเดียวกัน Google ยังเปิดตัวโมเดลใหม่ล่าสุดและมีขนาดเบาที่สุดในตระกูลนี้ นั่นคือ Gemini 2.5 Flash-Lite ซึ่งชูจุดเด่นด้านความหน่วงต่ำและต้นทุนต่ำ เหมาะสำหรับงานที่ต้องเรียกใช้บ่อยครั้งจำนวนมาก แต่ไม่จำเป็นต้องได้คำตอบที่ละเอียดระดับเรือธง

ความหมายของการเข้าสู่สถานะ GA ครั้งนี้คือการเปลี่ยนผ่านสู่ "คำมั่นสัญญาด้านความน่าเชื่อถือ" ในช่วงทดลองใช้ Google ยังคงสิทธิ์ในการปรับเปลี่ยนหรือถอดโมเดลได้ตลอดเวลา หากองค์กรนำไปใช้ในผลิตภัณฑ์จริงต้องรับความเสี่ยงจากการเปลี่ยนแปลงเวอร์ชันเอง แต่สถานะ GA หมายถึง Google รับประกันอย่างเป็นทางการเรื่องความเสถียรของ API ระดับการให้บริการ และการสนับสนุนระยะยาวสำหรับเวอร์ชันนั้น ซึ่งเป็นเกณฑ์ที่ฝ่ายกำกับดูแลและจัดซื้อขององค์กรจำนวนมากกำหนดไว้ก่อนนำ AI ไปใช้งานจริง กล่าวอีกนัยหนึ่ง การประกาศครั้งนี้ไม่ใช่ความก้าวหน้าด้านความสามารถของโมเดลมากเท่ากับการที่ Google นำโมเดลรุ่น 2.5 ที่ทดลองใช้มาตั้งแต่เดือนเมษายน 2025 ขึ้นวางจำหน่ายอย่างเป็นทางการในสายการผลิต

ตรรกะการแบ่งงานของโมเดลทั้งสามรุ่น

ตระกูล Gemini 2.5 ในปัจจุบันมีโครงสร้างสามระดับที่ชัดเจน คือ Pro เน้นความแม่นยำสูงสุดและงานให้เหตุผลที่ซับซ้อน (เช่น การสร้างโค้ด การวิเคราะห์หลายขั้นตอน) Flash เน้นความสมดุลระหว่างความเร็วและต้นทุน ส่วน Flash-Lite ที่เพิ่งเปิดตัวนั้นบีบอัดความหน่วงและราคาลงไปอีกขั้น เหมาะกับงานที่ต้องตอบสนองทันทีและมีปริมาณการเรียกใช้มหาศาล เช่น การตัดสินใจเบื้องต้นเรื่องเจตนาของลูกค้าในหน้าแชทบอท การกรองเนื้อหา หรือการจัดหมวดหมู่เอกสารจำนวนมากในขั้นต้น แนวทางสายผลิตภัณฑ์สามระดับ "เรือธง-สมดุล-ประหยัด" นี้คล้ายคลึงกับตรรกะการแบ่งชั้นของ OpenAI ตอนเปิดตัว o3 และ o4-mini ในเดือนเมษายน 2025 สะท้อนให้เห็นว่าผู้ให้บริการโมเดล AI รายใหญ่ต่างทยอยเปลี่ยนจาก "โมเดลเดียวครองทุกงาน" ไปสู่กลยุทธ์ "กระจายการใช้งานตามความคุ้มค่าของแต่ละภารกิจ"

เทียบตำแหน่งกับคู่แข่งในช่วงเวลาเดียวกัน

ที่น่าสังเกตคือ การประกาศ GA ครั้งนี้เกิดขึ้นในช่วงที่การแข่งขันตลาดโมเดล AI เข้มข้นที่สุดช่วงหนึ่ง ในเดือนพฤษภาคมปีเดียวกัน Anthropic เพิ่งเปิดตัว Claude Opus 4 และ Sonnet 4, DeepSeek ออกอัปเดต R1-0528 และ Mistral เปิดตัว Medium 3 การที่ Google เลือกช่วงกลางเดือนมิถุนายนในการ "ยืนยันสถานะ" โมเดลรุ่น 2.5 อย่างเป็นทางการ ส่วนหนึ่งเป็นการตอบสนองความต้องการโมเดลที่มั่นคงสำหรับสภาพแวดล้อมการผลิตจริง อีกส่วนหนึ่งคือการใช้ Flash-Lite จับจองพื้นที่ "ต้นทุนต่ำ ปริมาณการใช้งานสูง" ซึ่งปัจจุบันยังมีคู่แข่งค่อนข้างน้อย เพราะโมเดลประหยัดของผู้ให้บริการส่วนใหญ่ยังคงเป็นเพียง "เวอร์ชันย่อของโมเดลเรือธง" มากกว่าจะเป็นสายผลิตภัณฑ์อิสระที่ออกแบบมาเพื่อความหน่วงและต้นทุนโดยเฉพาะ

ปฏิกิริยาจากวงการ: จาก "ใช้ได้ไหม" สู่ "กล้าใช้ไหม"

ชุมชนนักพัฒนาและบล็อกเทคโนโลยีขององค์กรหลายแห่งให้ความสนใจหลังการประกาศ ไม่ใช่เรื่องความสามารถของโมเดลที่ก้าวหน้าเพียงใด แต่เป็นเรื่อง "ความคาดเดาได้" ที่มาพร้อมสถานะ GA เช่น รอบการล็อกราคา ระยะเวลาแจ้งเตือนการเลิกใช้ (deprecation) และการมี SLA ระดับองค์กรหรือไม่ สะท้อนแนวโน้มการนำ AI ไปใช้ในช่วงกลางปี 2025 ที่เปลี่ยนจาก "การทดลองใช้ในช่วงแรก" ไปสู่ "การนำไปใช้จริงในระดับใหญ่" องค์กรให้ความสำคัญกับการฝังฟังก์ชัน AI ลงในระบบเดิมได้อย่างมั่นคง มากกว่าเพียงแค่ทดลองฟังก์ชันใหม่

สำหรับผู้บริหาร ข้อคิดสำคัญจากการประกาศครั้งนี้คือ หากทีมงานเคยชะลอการนำฟังก์ชันที่เกี่ยวข้องกับ Gemini ไปใช้จริงเพราะกังวลว่า "โมเดลยังอยู่ในช่วงทดลอง อาจเปลี่ยนแปลงได้ตลอดเวลา" ตอนนี้คือจังหวะที่ควรประเมินใหม่ และอาจพิจารณาว่าโมเดลต้นทุนต่ำอย่าง Flash-Lite เหมาะสมที่จะนำมาแทนที่งานตัดสินใจเบื้องต้นซ้ำๆ จำนวนมากที่เดิมทำโดยคนหรือกฎง่ายๆ หรือไม่ เพื่อให้งบประมาณมุ่งไปที่งานที่ต้องใช้การให้เหตุผลระดับสูงจริงๆ

แบบทดสอบ: ยืนยันความเข้าใจ
5 บทความ · ตอบถูก 80% ผ่าน บันทึกลงโปรไฟล์การเรียนรู้ เข้าสู่ระบบเพื่อทำแบบทดสอบ
ถาม AI: บทความนี้ใช้กับการบริหารของคุณอย่างไร?
เนื้อหาสร้างโดย AI จากบทความนี้ โปรดใช้วิจารณญาณในการพิจารณาความถูกต้อง
ตอนถัดไป・บันทึกเหตุการณ์ AI เพื่อผู้บริหาร Claude Artifacts อัปเกรด: สร้างแอปพลิเคชัน AI แบบโต้ตอบและแชร์ได้ด้วยประโยคเดียว

บทความที่เกี่ยวข้อง

เราใช้คุกกี้ที่จำเป็นเพื่อรักษาการเข้าสู่ระบบและภาษา และเก็บพฤติกรรมการใช้งานเพื่อปรับปรุงบริการ คุณเลือกเฉพาะที่จำเป็นได้ นโยบายความเป็นส่วนตัว