คอลัมน์ บันทึกเหตุการณ์ AI เพื่อผู้บริหาร ตอนที่ 60/217 ตอน ดูสารบัญคอร์ส

xAI เปิดตัวซูเปอร์คอมพิวเตอร์ «Colossus» ฐานฝึกโมเดล AI ด้วย GPU 100,000 ตัว

03/09/2024 184
3:19
xAI เปิดตัวซูเปอร์คอมพิวเตอร์ «Colossus» ฐานฝึกโมเดล AI ด้วย GPU 100,000 ตัว

xAI ของ Elon Musk ประกาศประกอบและเปิดใช้งานซูเปอร์คอมพิวเตอร์ Colossus ที่ใช้ GPU ของ NVIDIA ถึง 100,000 ตัว อ้างว่าเป็นระบบฝึก AI ที่ทรงพลังที่สุดในโลก และวางแผนขยายเป็น 200,000 ตัวภายในไม่กี่เดือน เพื่อฝึกโมเดล Grok รุ่นถัดไป

เมื่อวันที่ 3 กันยายน 2024 บริษัทสตาร์ทอัพด้าน AI ของ Elon Musk อย่าง xAI ประกาศว่าซูเปอร์คอมพิวเตอร์สำหรับฝึกโมเดล AI ที่มีชื่อรหัสว่า «Colossus» ได้ประกอบเสร็จสมบูรณ์และเปิดใช้งานอย่างเป็นทางการแล้ว ระบบนี้ติดตั้ง GPU ของ NVIDIA มากถึง 100,000 ตัว โดย Musk เองระบุผ่านโซเชียลมีเดียว่าเป็น «ระบบฝึก AI ที่ทรงพลังที่สุดในโลก» ในเวลาเดียวกัน xAI ยังเปิดเผยแผนที่จะขยายจำนวนชิปเป็น 200,000 ตัวภายในไม่กี่เดือนข้างหน้า โดย 50,000 ตัวจะเป็นชิป H200 รุ่นใหม่ล่าสุดของ NVIDIA เป้าหมายของ Colossus ชัดเจนคือเพื่อรองรับการฝึกโมเดล Grok รุ่นถัดไปที่มีขนาดใหญ่และมีความสามารถสูงขึ้น

ขนาดที่น่าทึ่ง

คลัสเตอร์ฝึกโมเดลที่ใช้ GPU ถึง 100,000 ตัว ถือเป็นหนึ่งในระบบฝึก AI ที่มีขนาดใหญ่ที่สุดเท่าที่เคยเปิดเผยต่อสาธารณะในเวลานั้น เมื่อเทียบกับคลัสเตอร์ฝึกโมเดลภาษาขนาดใหญ่ทั่วไปที่มักอยู่ในระดับหลักพันถึงสองสามหมื่นตัว การที่ xAI เลือกกองซ้อนถึง 100,000 ตัวในครั้งเดียว และประกาศชัดว่าจะเพิ่มเป็นสองเท่าเป็น 200,000 ตัว เท่ากับใช้กลยุทธ์ «พลังประมวลผลมาก่อน» เข้าปะทะโดยตรงกับ OpenAI, Google, Meta ที่ลงทุนด้าน AI มายาวนาน สะท้อนว่าแม้ xAI จะก่อตั้งช้ากว่า แต่ด้วยความสามารถของ Musk ในการระดมทุนและซัพพลายเชน (รวมถึงประสบการณ์โครงสร้างพื้นฐานจาก Tesla และ SpaceX) ทำให้พยายามชดเชยเวลาที่เสียไปด้วยขนาดฮาร์ดแวร์

สงครามพลังประมวลผลกับคู่แข่ง

การเปิดตัว Colossus เท่ากับขยายสนามแข่งขัน AI จาก «อัลกอริทึมโมเดล» ไปสู่ «ใครจะได้และติดตั้ง GPU มากกว่ากันเร็วกว่ากัน» สอดคล้องกับปฏิกิริยาของอุตสาหกรรมต่อภาวะชิป NVIDIA ขาดแคลนในช่วงนั้น ที่แต่ละบริษัทต่างแย่งซื้อชิป H100 และ H200 เพื่อขยายกำลังการฝึกโมเดล แนวทางของ xAI แสดงให้เห็นว่าแม้ไม่มีธุรกิจคลาวด์หรือกระแสเงินสดมหาศาลรองรับ แต่หากสามารถรวบรวมทรัพยากรและสร้างโครงสร้างพื้นฐานได้อย่างรวดเร็ว ก็ยังมีโอกาสไล่ตามหรือแซงหน้าผู้บุกเบิกในด้านขนาดพลังประมวลผลได้ ทำให้หลายฝ่ายจับตาความก้าวหน้าของโมเดลตระกูล Grok มากขึ้น

ความหมายต่อผู้บริหาร

เรื่องราวของ Colossus เตือนผู้บริหารว่าการแข่งขัน AI ไม่ได้อยู่แค่ «ใครมีโมเดลฉลาดกว่า» โครงสร้างพื้นฐาน (พลังประมวลผล ซัพพลายเชน การระดมทุน) ก็เป็นปัจจัยชี้ขาดเช่นกัน เมื่อองค์กรประเมินการนำเครื่องมือ AI หรือผู้ให้บริการมาใช้ ควรพิจารณาขนาดและความต่อเนื่องของการลงทุนด้านพลังประมวลผลเบื้องหลังด้วย เพราะมักบ่งชี้ถึงความเร็วในการพัฒนาโมเดลในอนาคต

แบบทดสอบ: ยืนยันความเข้าใจ
5 บทความ · ตอบถูก 80% ผ่าน บันทึกลงโปรไฟล์การเรียนรู้ เข้าสู่ระบบเพื่อทำแบบทดสอบ
ถาม AI: บทความนี้ใช้กับการบริหารของคุณอย่างไร?
เนื้อหาสร้างโดย AI จากบทความนี้ โปรดใช้วิจารณญาณในการพิจารณาความถูกต้อง
ตอนถัดไป・บันทึกเหตุการณ์ AI เพื่อผู้บริหาร OpenAI เปิดตัว o1-preview และ o1-mini โมเดลให้เหตุผลแบบ "คิดก่อนตอบ" รุ่นแรก

บทความที่เกี่ยวข้อง

เราใช้คุกกี้ที่จำเป็นเพื่อรักษาการเข้าสู่ระบบและภาษา และเก็บพฤติกรรมการใช้งานเพื่อปรับปรุงบริการ คุณเลือกเฉพาะที่จำเป็นได้ นโยบายความเป็นส่วนตัว