Google I/O 2024: เปิดให้ใช้งาน Gemini 1.5 ทั่วโลก, เปิดตัว Project Astra และ AI Overviews เปิดใช้งานในวงกว้าง
Google เปิดเผยความคืบหน้า AI หลายรายการในงาน I/O 2024 ได้แก่ Gemini 1.5 Pro เปิดให้ใช้งานทั่วโลก หน้าต่างบริบท 2 ล้านโทเคน โมเดลเบา Gemini 1.5 Flash ต้นแบบผู้ช่วย Project Astra และ AI Overviews ที่เริ่มใช้งานในวงกว้างในผลการค้นหาที่สหรัฐฯ
วันที่ 14 พฤษภาคม พ.ศ. 2567 Google ประกาศความคืบหน้าด้าน AI หลายรายการในงานประชุมนักพัฒนาประจำปี Google I/O ก่อนหน้านี้ Gemini 1.5 Pro เปิดให้นักพัฒนาเพียงบางกลุ่มทดลองใช้เท่านั้น แต่ครั้งนี้เปิดให้นักพัฒนาทั่วโลกใช้งานได้อย่างเป็นทางการ (GA) พร้อมขยายหน้าต่างบริบทให้กว้างขึ้นเป็น 2 ล้านโทเคน หมายความว่าโมเดลสามารถ “อ่านจบ” เอกสารทางเทคนิคทั้งเล่มหรือบันทึกการประชุมยาวหลายชั่วโมงได้ในครั้งเดียว และยังถามรายละเอียดต่อในบทสนทนาเดียวกันได้ พร้อมกันนี้ Google ยังเปิดตัว Gemini 1.5 Flash ซึ่งมีขนาดเล็กและเร็วกว่า เหมาะกับงานที่ต้องการความหน่วงต่ำและเรียกใช้งานจำนวนมาก
อีกจุดเด่นของงานนี้คือ Project Astra ต้นแบบพิสูจน์แนวคิดที่แสดงให้เห็นว่า AI ผู้ช่วยสามารถ “มองเห็น” สภาพแวดล้อมรอบตัวผู้ใช้ผ่านกล้องมือถือแบบเรียลไทม์ และตอบคำถามด้วยบทสนทนาธรรมชาติได้ทันที เช่น การชี้ไปที่อาคารนอกหน้าต่างแล้วถามว่า “นี่คืออะไร” แม้จะยังห่างไกลจากผลิตภัณฑ์เชิงพาณิชย์จริง แต่ก็สะท้อนทิศทางของ Google ที่มุ่งสู่ผู้ช่วย AI แบบหลายรูปแบบ เรียลไทม์ และพกพาติดตัว นอกจากนี้ Google ยังประกาศว่า AI Overviews (คำตอบสรุปที่ AI สร้างขึ้น) เริ่มเปิดใช้งานในผลการค้นหา Google ที่สหรัฐฯ อย่างกว้างขวาง และมีแผนขยายไปทั่วโลกครอบคลุมผู้ใช้กว่า 1 พันล้านคนภายในหนึ่งปี
ความหมายเชิงเทคนิค: จาก “ตอบคำถาม” สู่ “เข้าใจโลกรอบตัว”
หน้าต่างบริบท 2 ล้านโทเคนของ Gemini 1.5 และความสามารถในการมองเห็นแบบเรียลไทม์ของ Project Astra สะท้อนว่า Google กำลังเปลี่ยนจุดเน้นของ AI จาก “การโต้ตอบด้วยข้อความ” ไปสู่ “ความจำบริบทยาว” และ “การรับรู้สภาพแวดล้อม” ขนาด 2 ล้านโทเคนเกินกว่าปริมาณเอกสารที่องค์กรส่วนใหญ่ต้องจัดการในแต่ละวัน เอกสารยาวที่แต่ก่อนต้องตัดแบ่งและสรุปก่อนป้อนให้ AI สามารถส่งทั้งฉบับให้วิเคราะห์ได้โดยตรง ส่วน Project Astra แม้เป็นเพียงต้นแบบ แต่ทิศทางชัดเจนว่าผู้ช่วย AI จะไม่จำกัดอยู่แค่การพิมพ์สนทนาอีกต่อไป แต่จะเป็นเหมือนผู้ช่วยที่อยู่ข้างกายตลอดเวลาและเข้าใจสถานการณ์รอบตัว
เทียบกับคู่แข่ง: เดินหน้าคู่ขนานทั้งการค้นหาและโมเดล
ต่างจาก OpenAI ที่มุ่งเน้นการพัฒนาโมเดลและระบบนิเวศผ่าน GPT-4 Turbo และ GPT Store ครั้งนี้ Google เดินหน้าพร้อมกันทั้ง “โมเดลพื้นฐาน” (ตระกูล Gemini 1.5) และ “แอปพลิเคชันปลายทาง” (AI Overviews ในการค้นหา) ซึ่งตอกย้ำจุดแข็งที่ Google ครองช่องทางค้นหาที่ใหญ่ที่สุดในโลก ทำให้ความสามารถ AI ฝังเข้าไปในผลิตภัณฑ์ที่มีผู้ใช้ระดับพันล้านคนอยู่แล้วได้ทันที นี่คือไพ่ต่อรองที่แตกต่างจากผู้ให้บริการโมเดลล้วนๆ รายอื่น
ปฏิกิริยาในวงการ: จับตาผลกระทบต่อระบบนิเวศเนื้อหา
หลัง AI Overviews เปิดใช้งาน วงการสื่อและ SEO ต่างจับตาว่าการที่ AI ตอบคำถามให้โดยตรงจะลดการคลิกเข้าลิงก์เว็บไซต์ต้นทางหรือไม่ ซึ่งอาจกระทบอุตสาหกรรมเนื้อหาและการดึงลูกค้าเข้าสู่เว็บไซต์ของอีคอมเมิร์ซที่พึ่งพาทราฟฟิกจากการค้นหา การเปลี่ยนแปลงนี้ยังอยู่ในขั้นทดลองวงจำกัดในสหรัฐฯ แต่ถูกมองว่าเป็นตัวแปรสำคัญที่สุดของระบบนิเวศการค้นหาในปีถัดไป
สำหรับผู้บริหาร ความหมายที่ตรงที่สุดของข่าวนี้คือ ตรรกะการตลาดที่องค์กรพึ่งพา “การถูกมองเห็นในการค้นหา” อาจเปลี่ยนแปลงไปเพราะคำตอบสรุปจาก AI ทีมการตลาดและบริการลูกค้าควรติดตามความคืบหน้าของ AI Overviews ล่วงหน้า และพิจารณาความเป็นไปได้ที่เอกสารยาวหรือบันทึกการประชุมยาวในอนาคตจะส่งให้โมเดลบริบทขนาดใหญ่ประมวลผลได้โดยตรง
สมาชิกฟรีทำแบบทดสอบ คุยกับโค้ช AI ฟังบทความสะสมประวัติการเรียนรู้ สมัครรับ 100 พอยต์ทันที
สมัครฟรี