Meta เปิดตัว Llama 3.1 405B โมเดลโอเพนซอร์สรุ่นแรกที่อ้างว่าเทียบเท่าโมเดลปิดระดับแนวหน้า
วันที่ 23 กรกฎาคม พ.ศ. 2567 Meta เปิดตัวตระกูล Llama 3.1 โดยมีรุ่นเรือธง 405B พารามิเตอร์ ที่อ้างว่าเป็นโมเดลพื้นฐานแบบเปิดที่ใหญ่และแข็งแกร่งที่สุดในโลก ขยายบริบทเป็น 128k รองรับ 8 ภาษา พร้อมอัปเกรดรุ่น 8B และ 70B และเปิดให้ดาวน์โหลดน้ำหนักโมเดลผ่าน Hugging Face
เมื่อวันที่ 23 กรกฎาคม พ.ศ. 2567 Meta ได้เปิดตัวตระกูลโมเดล Llama 3.1 อย่างเป็นทางการ จุดที่ได้รับความสนใจมากที่สุดคือรุ่นเรือธงใหม่ 405B (4.05 แสนล้านพารามิเตอร์) พร้อมทั้งอัปเกรดรุ่น 8B และ 70B ที่มีอยู่เดิมไปพร้อมกัน หน้าต่างบริบท (context window) ของตระกูลใหม่นี้ขยายจากเดิม 8k เป็น 128k โทเค็น และเพิ่มการรองรับ 8 ภาษา ครอบคลุมความสามารถด้านความรู้ทั่วไป การควบคุมผลลัพธ์ คณิตศาสตร์ การเรียกใช้เครื่องมือ (tool calling) และการแปลหลายภาษา Meta ระบุอย่างเป็นทางการว่า 405B คือโมเดลพื้นฐานแบบเปิดที่เข้าถึงได้ (openly available) ที่ใหญ่และทรงพลังที่สุดในโลกขณะนี้ และเป็นโมเดลโอเพนซอร์สรุ่นแรกที่มีความสามารถในด้านดังกล่าวเทียบเคียงกับโมเดลปิดระดับแนวหน้าได้อย่างสูสี น้ำหนักโมเดลทั้งหมดถูกอัปโหลดขึ้น Hugging Face ให้ชุมชนดาวน์โหลดได้ฟรี และสามารถนำไปใช้งานผ่านระบบนิเวศพันธมิตรของ Meta ได้ทันที
นัยเชิงเทคนิค: ครั้งแรกที่ช่องว่างความสามารถระหว่างโมเดลปิดและเปิดถูกท้าทายอย่างเป็นทางการ
ที่ผ่านมาวงการเชื่อกันว่าโมเดลปิดชั้นนำอย่าง GPT-4 หรือ Claude มีความสามารถล้ำหน้าโมเดลโอเพนซอร์สไปหนึ่งยุค การเปิดตัว Llama 3.1 405B เป็นครั้งแรกที่ Meta ประกาศต่อสาธารณะว่าโมเดลโอเพนซอร์สของตนสามารถ “แข่งขันได้อย่างสูสี” กับโมเดลปิดระดับสูงในหลายตัวชี้วัด หน้าต่างบริบท 128k และความสามารถในการเรียกใช้เครื่องมือ หมายความว่าโมเดลโอเพนซอร์สก็รองรับการวิเคราะห์เอกสารยาว การให้เหตุผลหลายขั้นตอน และการเชื่อมต่อระบบภายนอกได้เช่นกัน ไม่ใช่แค่ระดับแชตบอทอีกต่อไป
เทียบกับรุ่นก่อนและตลาด: การเดิมพันสองด้านระหว่างขนาดและกลยุทธ์เปิด
เมื่อเทียบกับ Llama 3 ที่เปิดตัวเมื่อเดือนเมษายนปีเดียวกัน (มีเพียงระดับ 8B และ 70B) Llama 3.1 เพิ่มระดับ 405B เข้ามา ทำให้ขนาดพารามิเตอร์กระโดดขึ้นไปอยู่ในระดับเดียวกับโมเดลชั้นนำของวงการในขณะนั้น การที่ Meta เลือกเปิดโมเดลขนาดใหญ่ระดับนี้แบบเต็มรูปแบบ พร้อมเปิดให้ดาวน์โหลดน้ำหนักโมเดล ถือเป็นความแตกต่างชัดเจนจากกลยุทธ์ของ OpenAI, Anthropic และ Google ที่ปิดโมเดลเรือธงและให้บริการผ่าน API เท่านั้น ซึ่งยังตอกย้ำสถานะของ Meta ในฐานะผู้นำฝั่งโอเพนซอร์สต่อไป
ปฏิกิริยาจากวงการ: ตัวเร่งระบบนิเวศนักพัฒนาแบบทันที
เนื่องจากน้ำหนักโมเดลถูกอัปโหลดขึ้น Hugging Face โดยตรง บวกกับระบบนิเวศพันธมิตรของ Meta (ผู้ให้บริการคลาวด์ ผู้ให้บริการ inference ต่างๆ) รองรับการติดตั้งใช้งานพร้อมกัน นักพัฒนาแทบจะสามารถดาวน์โหลด ปรับแต่ง หรือรันโมเดลระดับสูงนี้แบบส่วนตัวได้ตั้งแต่วันเปิดตัว โดยไม่ต้องผูกติดกับราคาและนโยบายข้อมูลของผู้ให้บริการรายเดียว
สำหรับผู้บริหาร ข่าวนี้มีนัยว่า หากองค์กรพิจารณานำ Generative AI มาใช้ในอนาคต นอกจากการสมัครใช้ API แบบเสียเงินแล้ว โมเดลระดับสูงแบบ “สร้างเองควบคุมเอง” ก็กลายเป็นทางเลือกที่ใช้งานได้จริงแล้ว ควรนำมาพิจารณาร่วมด้วยเมื่อประเมินต้นทุนรวม อธิปไตยของข้อมูล และความต้องการปรับแต่งเฉพาะองค์กร
สมาชิกฟรีทำแบบทดสอบ คุยกับโค้ช AI ฟังบทความสะสมประวัติการเรียนรู้ สมัครรับ 100 พอยต์ทันที
สมัครฟรี