Mistral AI จับมือ NVIDIA เปิดตัวโมเดลโอเพนซอร์ส Mistral NeMo 12B
Mistral AI ร่วมกับ NVIDIA เปิดตัวโมเดลโอเพนซอร์สขนาด 1.2 หมื่นล้านพารามิเตอร์ Mistral NeMo รองรับหน้าต่างบริบทยาวถึง 128K โทเคน เผยแพร่ภายใต้ลิขสิทธิ์ Apache 2.0 พร้อม tokenizer ใหม่ชื่อ Tekken
เมื่อวันที่ 18 กรกฎาคม พ.ศ. 2567 บริษัทสตาร์ทอัพ AI สัญชาติฝรั่งเศส Mistral AI ร่วมกับ NVIDIA เปิดตัวโมเดลภาษาขนาดใหญ่แบบโอเพนซอร์สรุ่นล่าสุดในชื่อ «Mistral NeMo» ขนาด 1.2 หมื่นล้านพารามิเตอร์ (12B) ทางบริษัทระบุว่าความสามารถด้านการให้เหตุผล ความรู้รอบตัว และความแม่นยำด้านโค้ดของโมเดลนี้อยู่ในระดับแนวหน้าของอุตสาหกรรมเมื่อเทียบกับโมเดลขนาดเดียวกัน โมเดลรองรับหน้าต่างบริบท (context window) ยาวสูงสุดถึง 128,000 โทเคน ทำให้สามารถประมวลผลเอกสารยาว ฐานโค้ดขนาดใหญ่ หรือบทสนทนาต่อเนื่องยาวนานได้ในครั้งเดียว Mistral AI เผยแพร่ทั้งเวอร์ชันพื้นฐาน (base) และเวอร์ชันปรับแต่งตามคำสั่ง (instruct) ภายใต้ลิขสิทธิ์ Apache 2.0 ซึ่งเปิดให้นักวิจัยและองค์กรธุรกิจดาวน์โหลด ดัดแปลง และนำไปใช้เชิงพาณิชย์ได้อย่างอิสระ โดยไม่มีเงื่อนไขจำกัด
ที่น่าสังเกตคือ Mistral NeMo มาพร้อม tokenizer ใหม่ในชื่อ «Tekken» ซึ่งพัฒนาต่อยอดจาก Tiktoken โดยฝึกด้วยข้อมูลครอบคลุมกว่า 100 ภาษา ทางบริษัทระบุว่ามีประสิทธิภาพการบีบอัดข้อความหลายภาษาและโค้ดดีกว่า tokenizer รุ่นก่อน โดยเฉพาะในภาษาที่ไม่ใช่ภาษาอังกฤษ เช่น จีน เกาหลี อาหรับ และตระกูลภาษาอินเดีย
นัยทางเทคนิค: สัญญาณความร่วมมือเชิงลึกกับ NVIDIA
การเปิดตัวครั้งนี้มีทั้ง Mistral AI และ NVIDIA ร่วมประกาศ ถือเป็นส่วนหนึ่งของยุทธศาสตร์ที่ NVIDIA เดินหน้าบุกเบิก «ระบบนิเวศโมเดลโอเพนซอร์ส» อย่างต่อเนื่อง โดย NVIDIA สนับสนุนโครงสร้างพื้นฐานด้านการประมวลผลและปรับแต่งประสิทธิภาพโมเดล ส่วน Mistral AI สนับสนุนสถาปัตยกรรมโมเดลและข้อมูลฝึกฝน หน้าต่างบริบท 128K บนโมเดลขนาด 12B ซึ่งจัดว่าเป็น «ขนาดกลางถึงเล็ก» นั้นไม่ใช่เรื่องปกติ หมายความว่าองค์กรไม่จำเป็นต้องเลือกใช้โมเดลขนาดยักษ์หลายแสนล้านพารามิเตอร์ ก็สามารถได้รับความสามารถประมวลผลข้อความยาวได้เช่นกัน ช่วยลดต้นทุนการติดตั้งและการอนุมานลงอย่างมาก
เปรียบเทียบกับโมเดลขนาดใกล้เคียงกัน
ขนาด 12B พารามิเตอร์ถือเป็นจุดที่ลงตัว «สามารถติดตั้งบน GPU ระดับสูงเพียงตัวเดียว» เมื่อเทียบกับโมเดลโอเพนซอร์สอื่นในช่วงเวลาเดียวกัน Mistral NeMo ใช้หน้าต่างบริบทที่ใหญ่กว่าและ tokenizer ใหม่เป็นจุดขายที่แตกต่าง ขณะที่ลิขสิทธิ์ Apache 2.0 (เทียบกับคู่แข่งบางรายที่ใช้เงื่อนไขลิขสิทธิ์ที่จำกัดมากกว่า) ก็ทำให้องค์กรมีความกังวลด้านกฎหมายน้อยลงเมื่อนำไปใช้เชิงพาณิชย์ ถือเป็นเหตุผลสำคัญที่ทำให้ Mistral NeMo ถูกมองว่า «เป็นมิตรกับองค์กรธุรกิจ»
ปฏิกิริยาจากวงการ
ชุมชนโอเพนซอร์สให้การตอบรับเชิงบวกต่อประสิทธิภาพการบีบอัดข้อความหลายภาษาของ Tekken ชุมชนนักพัฒนานำโมเดลขึ้นให้ดาวน์โหลดทดสอบอย่างรวดเร็ว ขณะเดียวกันก็มีความเห็นว่านี่คือผลผลิตสาธารณะชิ้นแรกที่เป็นรูปธรรมจากความร่วมมือกับ NVIDIA หลัง Mistral AI ได้รับการลงทุนเชิงยุทธศาสตร์เมื่อไม่กี่เดือนก่อน ถือเป็นตัวชี้วัดรูปแบบความร่วมมือระหว่างสตาร์ทอัพกับบริษัทเทคโนโลยียักษ์ใหญ่ที่น่าจับตามอง
สำหรับผู้บริหาร โมเดลโอเพนซอร์สแบบ «ติดตั้งเองได้ ลิขสิทธิ์เปิดกว้าง» อย่าง Mistral NeMo หมายความว่าองค์กรที่มีความต้องการพิเศษด้านความเป็นส่วนตัวของข้อมูลหรือการปรับแต่งเฉพาะทาง (เช่น ไม่ต้องการให้ข้อมูลบทสนทนาลูกค้าถูกส่งขึ้นคลาวด์ของบุคคลที่สาม) ตอนนี้มีทางเลือกที่สามารถติดตั้งและปรับแต่งเองได้ แทนที่จะพึ่งพา API แบบเสียเงินเพียงอย่างเดียว ผู้บริหารอาจลองให้ทีมไอทีหรือทีมข้อมูลประเมินว่าภายในองค์กรมีกรณีใช้งานใดที่เหมาะกับการติดตั้งโมเดลโอเพนซอร์สเอง (เช่น ระบบตอบคำถามฐานความรู้บริการลูกค้า สรุปเอกสารภายใน) เพื่อลดต้นทุนส่วนเพิ่มของการนำ AI มาใช้ในระยะยาว
สมาชิกฟรีทำแบบทดสอบ คุยกับโค้ช AI ฟังบทความสะสมประวัติการเรียนรู้ สมัครรับ 100 พอยต์ทันที
สมัครฟรี