คอลัมน์ บันทึกเหตุการณ์ AI เพื่อผู้บริหาร ตอนที่ 186/217 ตอน ดูสารบัญคอร์ส

Google I/O 2026: เปิดตัว Gemini 3.5 และ Gemini Omni อย่างเป็นทางการ ก้าวสู่ยุคสร้างวิดีโอจาก "อินพุตแบบใดก็ได้"

19/05/2026 260
6:30
Google I/O 2026: เปิดตัว Gemini 3.5 และ Gemini Omni อย่างเป็นทางการ ก้าวสู่ยุคสร้างวิดีโอจาก "อินพุตแบบใดก็ได้"

Google ประกาศในงาน I/O 2026 ว่าก้าวเข้าสู่ "ยุค Gemini แบบเอเจนต์" พร้อมเปิดตัว Gemini 3.5 (เสริมความสามารถด้านเอเจนต์และการเขียนโค้ด) และ Gemini Omni (แปลงภาพ ข้อความ วิดีโอ เสียง เป็นวิดีโอเดียวที่กลมกลืน)

ในงานประชุมนักพัฒนา Google I/O 2026 เมื่อวันที่ 19 พฤษภาคม 2026 นายซุนดาร์ พิชัย ซีอีโอของ Google ได้กล่าวปาฐกถาประกาศก้าวเข้าสู่ "ยุค Gemini แบบเอเจนต์" อย่างเป็นทางการ พร้อมเปิดตัวความคืบหน้าสำคัญสองเรื่อง ได้แก่ "Gemini 3.5" ที่เน้นความฉลาดระดับแนวหน้าและความสามารถด้านงานเอเจนต์และการเขียนโค้ด และโมเดลสร้างเนื้อหาใหม่ "Gemini Omni" ซึ่งผสานความสามารถด้านการให้เหตุผลของ Gemini เข้ากับเทคโนโลยีสื่อสร้างสรรค์ (generative media) ของ Google โดยสามารถนำวัตถุดิบอ้างอิงที่หลากหลาย ไม่ว่าจะเป็นภาพ ข้อความ คลิปวิดีโอที่มีอยู่แล้ว หรือเสียง มารวมเป็นวิดีโอเดียวที่กลมกลืนกัน พร้อมทั้งนำความเข้าใจฟิสิกส์ของโลกจริง (แรงโน้มถ่วง พลังงานจลน์ พลศาสตร์ของไหล) มาใช้เพื่อให้ภาพที่สร้างขึ้นสมจริงยิ่งขึ้น

ตัวเลขประสิทธิภาพพูดแทน: Gemini 3.5 Flash ไล่ตามและแซงหน้ารุ่นเรือธงก่อนหน้า

ผลการทดสอบมาตรฐานที่ Google เปิดเผยแสดงให้เห็นว่าโมเดลรุ่นเบา "Gemini 3.5 Flash" ทำคะแนนแซงหน้ารุ่นเรือธงก่อนหน้าอย่าง "Gemini 3.1 Pro" ในหลายรายการ ได้แก่ Terminal-Bench 2.1 ทำได้ 76.2% (เทียบกับ 3.1 Pro ที่ 70.3%), MCP Atlas ทำได้ 83.6% (เทียบกับ 78.2%), Finance Agent v2 ทำได้ 57.9% (เทียบกับ 43.0%) และ GDPval-AA ทำได้ 1656 Elo (เทียบกับ 1314) ส่วนการทดสอบความเข้าใจแบบหลายรูปแบบ CharXiv Reasoning ทำได้สูงถึง 84.2% นอกจากนี้ Google ยังระบุว่าความเร็วในการสร้างผลลัพธ์เร็วกว่าโมเดลแนวหน้าอื่นถึงสี่เท่า โดย Gemini 3.5 Flash พร้อมใช้งานเต็มรูปแบบตั้งแต่วันประกาศ ทั้งบน Gemini API, Google AI Studio, Google Antigravity, Vertex AI, Gemini App และโหมด AI ในการค้นหาของ Google

Gemini Omni: จาก "ข้อความสร้างวิดีโอ" สู่ "วัตถุดิบแบบใดก็ได้สร้างวิดีโอ"

ตลอดปีที่ผ่านมา เครื่องมือสร้างวิดีโอในตลาดส่วนใหญ่ยังใช้ข้อความพรอมต์เป็นอินพุตหลัก ความก้าวหน้าของ Gemini Omni อยู่ที่สามารถเข้าใจภาพ ข้อความ คลิปวิดีโอที่มีอยู่แล้ว และเสียงไปพร้อมกัน แล้วผสมผสานให้กลายเป็นวิดีโอใหม่ที่มีสไตล์และเนื้อหาสอดคล้องกัน พร้อมแก้ไขได้ด้วยคำสั่งง่ายๆ แบบสนทนา เช่น "เปลี่ยนมุมกล้องแบบภาพยนตร์" หรือ "เปลี่ยนฉากหลัง" ปัจจุบันเวอร์ชัน "Gemini Omni Flash" เปิดให้ผู้สมัครสมาชิก Google AI Plus, Pro และ Ultra ใช้งานผ่าน Gemini App และ Google Flow ได้แล้ว ส่วน YouTube Shorts Remix และแอป YouTube Create (สำหรับผู้ใช้อายุ 18 ปีขึ้นไป) ก็ใช้งานได้ฟรีเช่นกัน ขณะที่นักพัฒนาและลูกค้าองค์กรจะทยอยเข้าถึงผ่าน Gemini API และ Agent Platform API ในอีกไม่กี่สัปดาห์ข้างหน้า วิดีโอที่สร้างขึ้นทั้งหมดจะฝังลายน้ำดิจิทัล SynthID ของ Google ซึ่งสามารถตรวจสอบที่มาได้ผ่าน Gemini App, Chrome และการค้นหา

มุมมองวงการ: Google เดินหน้าทั้งด้านสร้างวิดีโอและงานวิจัยวิทยาศาสตร์

สื่อเทคโนโลยีส่วนใหญ่มองว่า Gemini Omni เป็นการตอบโต้เชิงบวกของ Google ต่อความเคลื่อนไหวล่าสุดของ OpenAI และผู้พัฒนาโมเดลสร้างวิดีโอรายอื่น เนื่องจากคู่แข่งส่วนใหญ่ในปัจจุบันยังจำกัดอยู่ที่อินพุตรูปแบบเดียว Google จึงเลือกใช้ "การผสานอินพุตแบบใดก็ได้" และ "ความสมจริงเชิงฟิสิกส์" เป็นจุดสร้างความแตกต่าง ในงานเดียวกันนี้ Google DeepMind ยังประกาศเชื่อมโยงเครื่องมือสร้างโลกเสมือนแบบโต้ตอบ Project Genie เข้ากับข้อมูลภาพ Google Street View ย้อนหลังเกือบ 20 ปี เพื่อสร้างโลกเสมือนที่อ้างอิงภูมิศาสตร์จริง พร้อมเปิดตัวชุดเครื่องมือวิจัยวิทยาศาสตร์ "Gemini for Science" ที่รวมระบบอย่าง AI Co-Scientist และ AlphaEvolve เข้าไว้ด้วยกัน นักวิเคราะห์เห็นว่าการเปิดใช้งานเต็มรูปแบบของ Gemini 3.5 Flash ส่งผลกระทบต่อนักพัฒนาที่มีอยู่ในทันทีมากกว่า (เกี่ยวข้องโดยตรงกับต้นทุนการเรียกใช้ API และความเร็วในการตอบสนอง) ส่วน Gemini Omni ยังต้องใช้เวลาสังเกตคุณภาพการสร้างจริง ประเด็นลิขสิทธิ์ และความเสถียรเชิงพาณิชย์อีกระยะหนึ่ง

ความหมายต่อผู้บริหาร

สำหรับผู้บริหารที่ต้องผลิตวิดีโอแนะนำสินค้า วิดีโออบรมพนักงาน หรือเนื้อหาการตลาดโซเชียลอยู่เป็นประจำ Gemini Omni Flash สามารถทดลองใช้ได้ทันทีผ่าน Gemini App และ Google Flow ที่พนักงานส่วนใหญ่ใช้งานอยู่แล้วในชีวิตประจำวัน โดยไม่ต้องรอทีมตัดต่อมืออาชีพ เพียงใช้ภาพถ่ายสินค้าที่มีอยู่และคำบรรยายเสียงสั้นๆ ก็อาจสร้างวิดีโอต้นแบบได้ พร้อมลายน้ำที่ช่วยตรวจสอบที่มาของเนื้อหา แนะนำให้ตรวจสอบขอบเขตสิทธิ์การใช้งานของแผนสมัครสมาชิกองค์กรและประเด็นลิขสิทธิ์ของวัตถุดิบก่อน แล้วค่อยพิจารณานำเข้าสู่กระบวนการผลิตเนื้อหาอย่างสม่ำเสมอ

แบบทดสอบ: ยืนยันความเข้าใจ
5 บทความ · ตอบถูก 80% ผ่าน บันทึกลงโปรไฟล์การเรียนรู้ เข้าสู่ระบบเพื่อทำแบบทดสอบ
ถาม AI: บทความนี้ใช้กับการบริหารของคุณอย่างไร?
เนื้อหาสร้างโดย AI จากบทความนี้ โปรดใช้วิจารณญาณในการพิจารณาความถูกต้อง
ตอนถัดไป・บันทึกเหตุการณ์ AI เพื่อผู้บริหาร Anthropic เปิดตัว Claude Opus 4.8 เสริมความน่าเชื่อถือและความซื่อตรง ลดอัตราการมองข้ามข้อบกพร่องของโค้ดลงราวสามในสี่

บทความที่เกี่ยวข้อง

เราใช้คุกกี้ที่จำเป็นเพื่อรักษาการเข้าสู่ระบบและภาษา และเก็บพฤติกรรมการใช้งานเพื่อปรับปรุงบริการ คุณเลือกเฉพาะที่จำเป็นได้ นโยบายความเป็นส่วนตัว