คอลัมน์ บันทึกเหตุการณ์ AI เพื่อผู้บริหาร ตอนที่ 47/217 ตอน ดูสารบัญคอร์ส

Stability AI เปิดตัวโมเดลสร้างเสียงแบบโอเพนซอร์ส Stable Audio Open พิมพ์คำสั่งก็สร้างเสียงประกอบและดนตรีได้

05/06/2024 239
5:04
Stability AI เปิดตัวโมเดลสร้างเสียงแบบโอเพนซอร์ส Stable Audio Open พิมพ์คำสั่งก็สร้างเสียงประกอบและดนตรีได้

Stability AI เปิดตัวโมเดล AI สร้างเสียงแบบโอเพนซอร์ส Stable Audio Open สร้างจังหวะกลอง ทำนอง เสียงบรรยากาศ ยาวสุดประมาณ 47 วินาทีจากข้อความ เปิดให้ดาวน์โหลดใช้เชิงพาณิชย์ได้ฟรี

เมื่อวันที่ 3 กรกฎาคม 2024 Stability AI ได้เปิดตัวโมเดลสร้างเสียงแบบโอเพนซอร์สรุ่นใหม่ชื่อ Stable Audio Open โดยโมเดลนี้เน้นการสร้าง "คลิปเสียงสั้น" ความยาวสูงสุดประมาณ 47 วินาที บริษัทวางตำแหน่งให้เป็นเครื่องมือสร้างวัตถุดิบสำหรับเสียงประกอบและงานผลิตดนตรี ไม่ใช่การแต่งเพลงเต็มรูปแบบ ผู้ใช้เพียงพิมพ์คำสั่งข้อความ เช่น "จังหวะกลองสแนร์" "ทำนองซินธิไซเซอร์" หรือ "เสียงฝนตกบรรยากาศ" โมเดลก็จะสร้างไฟล์เสียงที่ตรงกับคำสั่งนั้น สามารถนำไปใช้ประกอบวิดีโอ เกม พอดแคสต์ หรือเสียงพื้นหลังในการนำเสนอสินค้าได้ทันที ที่สำคัญกว่านั้นคือ Stability AI เลือกเปิดเผยน้ำหนักโมเดล (model weights) ให้นักวิจัยและองค์กรต่างๆ ดาวน์โหลดฟรี ปรับแต่ง และนำไปใช้เชิงพาณิชย์ได้ ต่อยอดจากกลยุทธ์ "โอเพนซอร์สมาก่อน" ที่บริษัทเคยใช้กับโมเดลสร้างภาพ Stable Diffusion

ความหมายเชิงเทคนิค: จาก "เพลงเต็มเพลง" สู่ "วัตถุดิบระดับส่วนประกอบ"

ตลอดปีที่ผ่านมา วงการ AI สร้างเสียงมักถูกพูดถึงในแง่ของผลิตภัณฑ์ที่แต่งเพลงเต็มรูปแบบพร้อมเนื้อร้องและเสียงร้อง (เช่น Suno, Udio) แต่ Stable Audio Open เลือกเดินเส้นทางต่าง โดยมุ่งเน้นจังหวะกลอง ทำนองเครื่องดนตรี เสียงบรรยากาศ และเสียงประกอบ (Foley) ซึ่งเป็นวัตถุดิบระดับ "ชิ้นส่วน" มากกว่าผลงานสำเร็จรูป ตำแหน่งนี้ตรงกับความต้องการจริงของงานผลิตวิดีโอ เกม และโฆษณา ที่ผู้สร้างมักต้องการไม่ใช่เพลงเต็มเพลงหนึ่งเพลง แต่เป็นคลังเสียงสั้นๆ จำนวนมากที่นำไปผสมได้อย่างอิสระและไม่ต้องกังวลเรื่องค่าลิขสิทธิ์ ข้อจำกัดความยาว 47 วินาทีก็สะท้อนการออกแบบที่เน้น "วัตถุดิบ" มากกว่า "ผลงานสำเร็จ"

เทียบกับคู่แข่ง: ไพ่โอเพนซอร์สเดิมพันที่ระบบนิเวศ ไม่ใช่ผลิตภัณฑ์เดี่ยว

เมื่อเทียบกับ Suno, Udio ที่เป็นบริการสร้างเพลงเต็มรูปแบบแบบปิดและเก็บค่าสมาชิก การที่ Stability AI เลือกเปิดน้ำหนักโมเดล เท่ากับย้ายสนามแข่งขันจาก "เพลงของใครไพเราะกว่า" ไปสู่ "ใครสร้างระบบนิเวศนักพัฒนาได้ใหญ่กว่า" องค์กรและนักพัฒนาอิสระสามารถฝังโมเดลนี้เข้าในผลิตภัณฑ์ของตนเองได้โดยตรง เช่น ซอฟต์แวร์ตัดต่อวิดีโอ ปลั๊กอินเกมเอนจิน หรือฟีเจอร์สร้างเสียงพื้นหลังในแพลตฟอร์มอีคอมเมิร์ซ โดยไม่ต้องผูกติดกับผู้ให้บริการ SaaS รายเดียว ทั้งยังลดความกังวลเรื่องลิขสิทธิ์เมื่อต้องสร้างเสียงประกอบจำนวนมาก แนวทางนี้คล้ายคลึงกับตอนที่ Stable Diffusion เปิดโมเดลสร้างภาพแล้วก่อให้เกิดแอปพลิเคชันและโมเดลปรับแต่งจำนวนมากตามมา

ปฏิกิริยาในวงการ: ข้อกังวลด้านลิขสิทธิ์ยังคงเป็นประเด็นที่หลีกเลี่ยงไม่ได้

ทันทีที่โมเดลสร้างเสียงเปิดตัว วงการดนตรีและฝ่ายลิขสิทธิ์ก็ตอบสนองอย่างรวดเร็วตามเคย ประเด็นที่มาของข้อมูลฝึกฝนและความเป็นไปได้ที่จะเกี่ยวข้องกับมาสเตอร์เทปสตูดิโอหรือคลังเสียงที่มีลิขสิทธิ์อยู่แล้ว กลายเป็นจุดสนใจของการวิพากษ์วิจารณ์ Stability AI เคยถูกฟ้องร้องหลายครั้งในประเด็นลิขสิทธิ์ข้อมูลฝึกฝนสำหรับโมเดลสร้างภาพมาก่อน จึงมีแนวโน้มสูงที่โมเดลสร้างเสียงจะถูกตรวจสอบในลักษณะเดียวกัน ในขณะเดียวกัน ชุมชนนักพัฒนากลับต้อนรับรูปแบบ "เปิดน้ำหนักโมเดล ติดตั้งเองได้ ไม่ต้องจ่ายเป็นรายครั้ง" เพราะเห็นว่าช่วยลดต้นทุนการนำ AI เสียงมาใช้สำหรับสตูดิโอขนาดเล็กและกลาง

ความหมายต่อผู้บริหาร

สำหรับธุรกิจค้าปลีก ร้านอาหาร อีคอมเมิร์ซ และโรงแรมที่ต้องการเสียงประกอบสั้นๆ เพลงพื้นหลัง หรือเสียงบรรยากาศหน้าร้าน/บูธจัดแสดงจำนวนมาก เครื่องมือโอเพนซอร์สแบบนี้หมายถึงต้นทุนการผลิตวิดีโอโปรโมท เสียงพื้นหลังไลฟ์สด และดนตรีบรรยากาศร้านค้าในอนาคตอาจลดลงอย่างมาก แต่ก็ต้องระวังขอบเขตลิขสิทธิ์ของเนื้อหาที่สร้างขึ้นและการจัดการเสียงที่เป็นเครื่องหมายการค้า เพื่อไม่ให้สื่อการตลาดมีความเสี่ยงด้านการปฏิบัติตามกฎหมาย

แบบทดสอบ: ยืนยันความเข้าใจ
5 บทความ · ตอบถูก 80% ผ่าน บันทึกลงโปรไฟล์การเรียนรู้ เข้าสู่ระบบเพื่อทำแบบทดสอบ
ถาม AI: บทความนี้ใช้กับการบริหารของคุณอย่างไร?
เนื้อหาสร้างโดย AI จากบทความนี้ โปรดใช้วิจารณญาณในการพิจารณาความถูกต้อง
ตอนถัดไป・บันทึกเหตุการณ์ AI เพื่อผู้บริหาร Apple เปิดตัว "Apple Intelligence" จับมือ OpenAI นำ ChatGPT ผนวกเข้า iPhone

บทความที่เกี่ยวข้อง

เราใช้คุกกี้ที่จำเป็นเพื่อรักษาการเข้าสู่ระบบและภาษา และเก็บพฤติกรรมการใช้งานเพื่อปรับปรุงบริการ คุณเลือกเฉพาะที่จำเป็นได้ นโยบายความเป็นส่วนตัว