Mistral AI เปิดตัว Pixtral Large พร้อมอัปเกรดครั้งใหญ่ให้ Le Chat ในวันเดียวกัน
Mistral AI เปิดตัวโมเดลมัลติโมดัล Pixtral Large ขนาด 1.24 แสนล้านพารามิเตอร์ พร้อมอัปเกรด Le Chat เพิ่มฟังก์ชันค้นหาเว็บแบบเรียลไทม์และสร้างภาพด้วย Flux Pro
เมื่อวันที่ 18 พฤศจิกายน พ.ศ. 2567 Mistral AI บริษัทสตาร์ทอัพด้าน AI จากฝรั่งเศส ได้เปิดตัวโมเดลใหม่ชื่อ Pixtral Large ซึ่งเป็นโมเดลมัลติโมดัลแบบ open-weight ขนาด 1.24 แสนล้านพารามิเตอร์ พัฒนาต่อยอดจากโมเดล Mistral Large 2 ที่เปิดตัวก่อนหน้านี้ โดยสามารถเข้าใจทั้งข้อความและภาพในเวลาเดียวกัน เช่น การอ่านกราฟ สแกนเอกสาร หรือจดจำเนื้อหาในภาพถ่ายแล้วตอบกลับเป็นข้อความ ในวันเดียวกันนั้น Mistral ยังได้อัปเกรดแอปพลิเคชันแชท Le Chat ครั้งใหญ่ ด้วยการเพิ่มฟังก์ชันค้นหาเว็บแบบเรียลไทม์ ทำให้คำตอบสามารถอ้างอิงข้อมูลล่าสุดแทนที่จะพึ่งพาแค่ข้อมูลที่ใช้ฝึกโมเดลเท่านั้น พร้อมทั้งผนวกรวมโมเดล Flux Pro ของ Black Forest Labs เข้ามา ทำให้ผู้ใช้สามารถพิมพ์คำสั่งสร้างภาพได้โดยตรงในหน้าต่าง Le Chat โดยไม่ต้องสลับไปใช้เครื่องมือสร้างภาพอื่น
สิ่งที่น่าสนใจที่สุดของการเปิดตัวครั้งนี้ไม่ใช่ขนาดพารามิเตอร์ของ Pixtral Large แต่เป็นจังหวะที่ Mistral เลือกเปิดตัว “โมเดล+แอปพลิเคชัน” พร้อมกัน ในอดีต Mistral ถูกมองว่าเป็นผู้ให้บริการโมเดลพื้นฐานที่เน้นกลยุทธ์ open-weight และการอนุญาตใช้งานเชิงองค์กรเป็นหลัก แต่การใส่ฟังก์ชันค้นหาแบบเรียลไทม์และสร้างภาพเข้าไปใน Le Chat ครั้งนี้ สะท้อนความตั้งใจชัดเจนที่จะพัฒนา Le Chat ให้เป็นผู้ช่วย AI ที่ครบวงจร ไม่ใช่แค่หน้าต่างถาม-ตอบด้วยข้อความอีกต่อไป
ความหมายเชิงเทคนิค: มัลติโมดัลกลายเป็นมาตรฐานขั้นต่ำของการแข่งขันโมเดล AI
การที่ Pixtral Large เพิ่มความสามารถด้านภาพและข้อความ ถือเป็นการเติมเต็มจุดที่ผลิตภัณฑ์ของ Mistral ยังขาดอยู่ ก่อนหน้านี้ผู้เล่นหลักในอุตสาหกรรม เช่น GPT-4o ของ OpenAI หรือตระกูล Gemini ของ Google ต่างมีความสามารถมัลติโมดัลที่สมบูรณ์แล้ว สามารถประมวลผลทั้งข้อความ ภาพ และเสียงพร้อมกันได้ ขณะที่ Mistral Large 2 ซึ่งเป็นโมเดลเรือธงเดิมของ Mistral แม้จะทำผลงานได้ดีในงานด้านข้อความ แต่ยังขาดความสามารถด้านการเข้าใจภาพ การเปิดตัว Pixtral Large จึงถือเป็นก้าวสำคัญที่ช่วยให้ Mistral ไม่ตกขบวนในการประเมินจัดซื้อของภาคธุรกิจที่ต้องการฟังก์ชันครบครัน
เทียบกับคู่แข่ง: Le Chat เข้าสู่สนามแข่งขันกับผู้ช่วย AI แบบครบวงจรอย่าง ChatGPT
การรวมฟังก์ชันค้นหาและสร้างภาพเข้าไว้ใน Le Chat พร้อมกัน คือการวางตำแหน่งให้ตรงข้ามกับผลิตภัณฑ์อย่าง ChatGPT และ Gemini ที่มี “ถาม-ตอบ+ค้นหา+สร้างภาพ” เป็นฟังก์ชันมาตรฐานอยู่แล้ว ก่อนหน้านี้ผู้ใช้ที่ต้องการ “ค้นข้อมูลแล้ววาดภาพ” มักต้องสลับไปมาระหว่างเครื่องมือหลายตัว แต่หลังการอัปเดตครั้งนี้ ในทางทฤษฎี Le Chat สามารถทำงานตั้งแต่การตรวจสอบข้อมูลไปจนถึงการสร้างภาพประกอบได้ในบทสนทนาเดียว สะท้อนแนวโน้มชัดเจนของอุตสาหกรรมที่ว่าแชทบอทข้อความล้วนไม่เพียงพอต่อการรักษาผู้ใช้อีกต่อไป “ผู้ช่วย AI แบบครบวงจร” กำลังกลายเป็นมาตรฐานของผู้เล่นรายใหญ่ทุกราย
ปฏิกิริยาจากวงการ: แนวทาง open-weight ยังคงได้รับความสนใจ
เนื่องจาก Pixtral Large ยังคงยึดกลยุทธ์ open-weight ตามแบบฉบับของ Mistral ชุมชนนักพัฒนาส่วนใหญ่แสดงความยินดี เพราะมองว่าเป็นอีกทางเลือกของโมเดลมัลติโมดัลที่องค์กรและนักวิจัยสามารถนำไปติดตั้งและปรับแต่งเองได้ โดยไม่ต้องพึ่งพาผู้ให้บริการโมเดลปิดเพียงไม่กี่ราย อย่างไรก็ตาม ยังมีความเห็นว่าประสบการณ์การใช้งานจริงของฟังก์ชันค้นหาและสร้างภาพ รวมถึงคุณภาพของภาพที่สร้างขึ้นเทียบกับการใช้ Flux Pro โดยตรง ยังต้องรอการทดสอบเพิ่มเติมเพื่อยืนยัน
สำหรับผู้บริหาร ข้อคิดจากข่าวนี้คือช่องว่างการแข่งขันของเครื่องมือ AI กำลังหายไปอย่างรวดเร็ว การค้นหา การสร้างภาพ และความเข้าใจแบบมัลติโมดัล กำลังกลายเป็น “อุปกรณ์พื้นฐาน” มากกว่าจุดขายที่แตกต่าง หากองค์กรยังใช้เครื่องมือ AI ที่มีฟังก์ชันเดียวอยู่ ก็ควรพิจารณาว่าถึงเวลาเปลี่ยนไปใช้ผู้ช่วยแบบครบวงจรที่จัดการได้ทั้งการตรวจสอบข้อมูล การสนทนา และการสร้างภาพในที่เดียว เพื่อลดเวลาที่พนักงานต้องสลับไปมาระหว่างเครื่องมือหลายตัว
สมาชิกฟรีทำแบบทดสอบ คุยกับโค้ช AI ฟังบทความสะสมประวัติการเรียนรู้ สมัครรับ 100 พอยต์ทันที
สมัครฟรี