คอลัมน์ บันทึกเหตุการณ์ AI เพื่อผู้บริหาร ตอนที่ 197/303 ตอน ดูสารบัญคอร์ส

Gemini Omni Flash เปิดพรีวิวสำหรับนักพัฒนา เข้าถึงผ่าน Google AI Studio และ Gemini API จำกัดวิดีโอ 10 วินาที

30/06/2026 359
3:39
Gemini Omni Flash เปิดพรีวิวสำหรับนักพัฒนา เข้าถึงผ่าน Google AI Studio และ Gemini API จำกัดวิดีโอ 10 วินาที
ภาพ/Photo by Nubelson Fernandes on Unsplash

Google DeepMind เปิดตัว Gemini Omni Flash เวอร์ชันพรีวิวสำหรับนักพัฒนาเมื่อวันที่ 30 มิถุนายน 2026 เรียกใช้งานผ่าน Google AI Studio และ Gemini API ได้แล้ว โดยการสร้างวิดีโอจำกัดไว้ที่ 10 วินาทีต่อครั้ง เน้นการรวมเอาต์พุตหลายรูปแบบไว้ในโมเดลเดียวและตอบสนองเร็ว

เมื่อวันที่ 30 มิถุนายน 2026 Google DeepMind ประกาศเปิด "Gemini Omni Flash" โมเดลมัลติโมดัลรุ่นล่าสุดในสถานะพรีวิวสาธารณะสำหรับนักพัฒนา เปิดให้เรียกใช้งานผ่าน Google AI Studio และ Gemini API โดยรวมความสามารถสร้างข้อความ ภาพ เสียง และวิดีโอไว้ในจุดเชื่อมต่อโมเดลเดียว นักพัฒนาไม่ต้องเรียกใช้โมเดลแยกกันตามประเภทเอาต์พุตอีกต่อไป การพรีวิวครั้งนี้ยังระบุว่าฟีเจอร์สร้างวิดีโอมีขีดจำกัดอยู่ที่ 10 วินาทีต่อครั้ง ซึ่งเป็นมาตรการควบคุมต้นทุนการประมวลผลและความเสี่ยงด้านการตรวจสอบเนื้อหาในช่วงทดสอบสาธารณะ มิใช่ขีดจำกัดทางเทคนิคสูงสุดของโมเดล Omni Flash ยังคงจุดยืนของตระกูล "Flash" คือยอมลดคุณภาพบางส่วนเพื่อแลกกับความหน่วงต่ำและต้นทุนที่ถูกกว่า เจาะกลุ่มงานที่ต้องการเนื้อหาจำนวนมาก แบบเรียลไทม์ และต้นทุนต่ำ เช่น สติกเกอร์เคลื่อนไหวในแชทบอท คลิปทดสอบโซเชียลมีเดีย หรือคลิปสาธิตสินค้าอีคอมเมิร์ซ

ความหมายเชิงเทคนิคและเทียบกับคู่แข่ง

แต่เดิมการให้ AI สร้างคำอธิบาย ภาพประกอบ และคลิปสั้นพร้อมกัน นักพัฒนามักต้องเชื่อมต่อโมเดลหลายชุดแยกกัน ทำให้สไตล์ไม่สอดคล้องกันและต้นทุนเชื่อมต่อสูง Omni Flash รวมทั้งสามเอาต์พุตไว้ในกระบวนการอนุมานเดียว สอดคล้องกับทิศทางอุตสาหกรรมที่มุ่งสู่ "โมเดลเดียวหลายเอาต์พุต" แทนการต่อโมเดลหลายตัว เมื่อเทียบกับคู่แข่งบางรายที่เปิดสร้างวิดีโอได้ยาวหลายสิบวินาทีหรือถึงระดับนาที ขีดจำกัด 10 วินาทีของ Omni Flash ในช่วงพรีวิวถือว่าระมัดระวัง สะท้อนกลยุทธ์ "เปิดสิทธิ์เข้าถึงก่อน แล้วค่อยขยายความยาวทีหลัง" ของ Google DeepMind ที่ให้ความสำคัญกับการสังเกตรูปแบบการเรียกใช้งานและแรงกดดันด้านการตรวจสอบเนื้อหาเป็นอันดับแรก มากกว่าจะเร่งขยายตัวเลขสเปกในคราวเดียว

ปฏิกิริยาจากวงการ

ชุมชนนักพัฒนาให้ความสำคัญกับต้นทุนการเรียกใช้ ขีดจำกัดอัตรา และเงื่อนไขการใช้งานเชิงพาณิชย์มากกว่าคุณภาพการสร้างเนื้อหา หลายฝ่ายสะท้อนว่าขีดจำกัด 10 วินาทีแม้ไม่เอื้อต่อคลิปที่มีเรื่องราวสมบูรณ์ แต่เพียงพอสำหรับการ "สร้างร่างอย่างรวดเร็ว แล้วให้ทีมงานตัดต่อขยายผล" สำหรับผู้บริหาร สิ่งที่ควรจับตาจริง ๆ คือทิศทาง "เรียกใช้ครั้งเดียวได้หลายเอาต์พุต" ซึ่งอาจลดต้นทุนการเตรียมเนื้อหาร่างในอนาคต ควรให้ทีมภายในลองสมัครใช้งานช่วงพรีวิวเพื่อประเมินประโยชน์จริง

แบบทดสอบ: ยืนยันความเข้าใจ
5 บทความ · ตอบถูก 80% ผ่าน บันทึกลงโปรไฟล์การเรียนรู้ เข้าสู่ระบบเพื่อทำแบบทดสอบ
ถาม AI: บทความนี้ใช้กับการบริหารของคุณอย่างไร?
เนื้อหาสร้างโดย AI จากบทความนี้ โปรดใช้วิจารณญาณในการพิจารณาความถูกต้อง
ตอนถัดไป・บันทึกเหตุการณ์ AI เพื่อผู้บริหาร Claude Code และ Claude Cowork เข้าสู่ Claude for Government Desktop รุ่นทดสอบสาธารณะ

บทความที่เกี่ยวข้อง

เราใช้คุกกี้ที่จำเป็นเพื่อรักษาการเข้าสู่ระบบและภาษา และเก็บพฤติกรรมการใช้งานเพื่อปรับปรุงบริการ คุณเลือกเฉพาะที่จำเป็นได้ นโยบายความเป็นส่วนตัว