專欄 AI 管理編年史 第 67/217 講 查看課程目錄

Stability AI 發表 Stable Diffusion 3.5:開放授權的最強影像模型系列

22/10/2024 194
4:16
Stability AI 發表 Stable Diffusion 3.5:開放授權的最強影像模型系列

Stability AI 於2024年10月22日發表Stable Diffusion 3.5系列,包含81億參數的Large版與4步驟出圖的Large Turbo版即日上架Hugging Face,25億參數的Medium版預告10月29日跟進,全系列採開放社群授權、年營收百萬美元以下商業使用免費。

2024年10月22日,圖像生成模型廠商Stability AI正式發表Stable Diffusion 3.5系列模型,官方宣稱這是目前最強大的開放(open)影像生成模型家族。此次一次推出三個版本:Stable Diffusion 3.5 Large、Stable Diffusion 3.5 Large Turbo,兩者即日起可在Hugging Face平台下載;較輕量的Stable Diffusion 3.5 Medium則預告於一週後、10月29日跟進釋出。

規格與功能:從專業級到消費級都有對應版本

Stable Diffusion 3.5 Large擁有81億參數,官方定位為適合專業級用途,可輸出高達1百萬畫素等級的高解析度圖像,適合廣告視覺、產品攝影修圖等對畫質要求較高的場景。Large Turbo則是Large的蒸餾(distilled)版本,透過模型壓縮技術大幅減少生成步數,僅需4個推論步驟即可產出高品質圖像,換算下來大幅縮短等待時間,適合需要快速產出草圖、大量迭代的工作流程。稍後上市的Medium版本僅25億參數,設計目標是能在一般消費級顯示卡或筆電上直接運行,降低了硬體門檻。

授權模式:低於百萬美元營收即可商用免費

此次發表的另一個重點是授權策略。全系列採用開放的Stability AI社群授權(Community License),個人與研究等非商業用途完全免費;即使是商業用途,只要企業年營收在100萬美元以下,同樣可以免費使用模型權重。這個門檻設計明顯是瞄準中小企業與個人創作者、獨立開發者,讓他們無需授權金即可將模型整合進產品或服務中,等企業成長到一定規模後才需要另外洽談商業授權,是相對友善的漸進式收費思路。

與前代及市場競品的比較

相較於Stable Diffusion此前版本,3.5系列在架構與訓練資料上進行了更新,官方強調生成品質、提示詞理解準確度與圖像多樣性都有提升,尤其在人物姿態、手部細節等過去生成式AI長期的弱點上有針對性優化。以「開放模型」的定位來看,Stable Diffusion 3.5延續了Stability AI一貫與OpenAI DALL-E、Midjourney等封閉式付費服務區隔的策略——後者不開放模型權重、只能透過API或介面使用,而Stability AI選擇讓開發者能下載、微調、甚至私有部署模型,這對希望掌控資料隱私或需要客製化微調的企業與開發者社群而言,是明顯的差異化賣點。三個版本並行釋出、涵蓋從專業到消費級的策略,也反映廠商希望同時滿足速度、品質、硬體成本三種不同的取捨需求。

對管理者的意義

對於行銷、電商、社群經營或需要大量視覺素材的管理者而言,這類開放且免費商用的高品質影像模型,代表產出宣傳圖、產品示意圖、社群貼文配圖的成本門檻正持續下降;即便公司內部沒有專職設計人力,只要具備基本技術整合能力,也能評估導入這類工具來加速視覺內容的產製週期,值得留意後續開源社群釋出的介面工具是否更易於非技術人員使用。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 OpenAI 推出 Predicted Outputs:靠「預測答案」讓 GPT-4o 改稿快 3–5 倍

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策