คอลัมน์ บันทึกเหตุการณ์ AI เพื่อผู้บริหาร ตอนที่ 197/217 ตอน ดูสารบัญคอร์ส

Gemini Omni Flash เปิดพรีวิวสำหรับนักพัฒนา เข้าถึงผ่าน Google AI Studio และ Gemini API จำกัดวิดีโอ 10 วินาที

30/06/2026 262
3:39
Gemini Omni Flash เปิดพรีวิวสำหรับนักพัฒนา เข้าถึงผ่าน Google AI Studio และ Gemini API จำกัดวิดีโอ 10 วินาที

Google DeepMind เปิดตัว Gemini Omni Flash เวอร์ชันพรีวิวสำหรับนักพัฒนาเมื่อวันที่ 30 มิถุนายน 2026 เรียกใช้งานผ่าน Google AI Studio และ Gemini API ได้แล้ว โดยการสร้างวิดีโอจำกัดไว้ที่ 10 วินาทีต่อครั้ง เน้นการรวมเอาต์พุตหลายรูปแบบไว้ในโมเดลเดียวและตอบสนองเร็ว

เมื่อวันที่ 30 มิถุนายน 2026 Google DeepMind ประกาศเปิด "Gemini Omni Flash" โมเดลมัลติโมดัลรุ่นล่าสุดในสถานะพรีวิวสาธารณะสำหรับนักพัฒนา เปิดให้เรียกใช้งานผ่าน Google AI Studio และ Gemini API โดยรวมความสามารถสร้างข้อความ ภาพ เสียง และวิดีโอไว้ในจุดเชื่อมต่อโมเดลเดียว นักพัฒนาไม่ต้องเรียกใช้โมเดลแยกกันตามประเภทเอาต์พุตอีกต่อไป การพรีวิวครั้งนี้ยังระบุว่าฟีเจอร์สร้างวิดีโอมีขีดจำกัดอยู่ที่ 10 วินาทีต่อครั้ง ซึ่งเป็นมาตรการควบคุมต้นทุนการประมวลผลและความเสี่ยงด้านการตรวจสอบเนื้อหาในช่วงทดสอบสาธารณะ มิใช่ขีดจำกัดทางเทคนิคสูงสุดของโมเดล Omni Flash ยังคงจุดยืนของตระกูล "Flash" คือยอมลดคุณภาพบางส่วนเพื่อแลกกับความหน่วงต่ำและต้นทุนที่ถูกกว่า เจาะกลุ่มงานที่ต้องการเนื้อหาจำนวนมาก แบบเรียลไทม์ และต้นทุนต่ำ เช่น สติกเกอร์เคลื่อนไหวในแชทบอท คลิปทดสอบโซเชียลมีเดีย หรือคลิปสาธิตสินค้าอีคอมเมิร์ซ

ความหมายเชิงเทคนิคและเทียบกับคู่แข่ง

แต่เดิมการให้ AI สร้างคำอธิบาย ภาพประกอบ และคลิปสั้นพร้อมกัน นักพัฒนามักต้องเชื่อมต่อโมเดลหลายชุดแยกกัน ทำให้สไตล์ไม่สอดคล้องกันและต้นทุนเชื่อมต่อสูง Omni Flash รวมทั้งสามเอาต์พุตไว้ในกระบวนการอนุมานเดียว สอดคล้องกับทิศทางอุตสาหกรรมที่มุ่งสู่ "โมเดลเดียวหลายเอาต์พุต" แทนการต่อโมเดลหลายตัว เมื่อเทียบกับคู่แข่งบางรายที่เปิดสร้างวิดีโอได้ยาวหลายสิบวินาทีหรือถึงระดับนาที ขีดจำกัด 10 วินาทีของ Omni Flash ในช่วงพรีวิวถือว่าระมัดระวัง สะท้อนกลยุทธ์ "เปิดสิทธิ์เข้าถึงก่อน แล้วค่อยขยายความยาวทีหลัง" ของ Google DeepMind ที่ให้ความสำคัญกับการสังเกตรูปแบบการเรียกใช้งานและแรงกดดันด้านการตรวจสอบเนื้อหาเป็นอันดับแรก มากกว่าจะเร่งขยายตัวเลขสเปกในคราวเดียว

ปฏิกิริยาจากวงการ

ชุมชนนักพัฒนาให้ความสำคัญกับต้นทุนการเรียกใช้ ขีดจำกัดอัตรา และเงื่อนไขการใช้งานเชิงพาณิชย์มากกว่าคุณภาพการสร้างเนื้อหา หลายฝ่ายสะท้อนว่าขีดจำกัด 10 วินาทีแม้ไม่เอื้อต่อคลิปที่มีเรื่องราวสมบูรณ์ แต่เพียงพอสำหรับการ "สร้างร่างอย่างรวดเร็ว แล้วให้ทีมงานตัดต่อขยายผล" สำหรับผู้บริหาร สิ่งที่ควรจับตาจริง ๆ คือทิศทาง "เรียกใช้ครั้งเดียวได้หลายเอาต์พุต" ซึ่งอาจลดต้นทุนการเตรียมเนื้อหาร่างในอนาคต ควรให้ทีมภายในลองสมัครใช้งานช่วงพรีวิวเพื่อประเมินประโยชน์จริง

แบบทดสอบ: ยืนยันความเข้าใจ
5 บทความ · ตอบถูก 80% ผ่าน บันทึกลงโปรไฟล์การเรียนรู้ เข้าสู่ระบบเพื่อทำแบบทดสอบ
ถาม AI: บทความนี้ใช้กับการบริหารของคุณอย่างไร?
เนื้อหาสร้างโดย AI จากบทความนี้ โปรดใช้วิจารณญาณในการพิจารณาความถูกต้อง
ตอนถัดไป・บันทึกเหตุการณ์ AI เพื่อผู้บริหาร Claude Code และ Claude Cowork เข้าสู่ Claude for Government Desktop รุ่นทดสอบสาธารณะ

บทความที่เกี่ยวข้อง

เราใช้คุกกี้ที่จำเป็นเพื่อรักษาการเข้าสู่ระบบและภาษา และเก็บพฤติกรรมการใช้งานเพื่อปรับปรุงบริการ คุณเลือกเฉพาะที่จำเป็นได้ นโยบายความเป็นส่วนตัว