專欄 AI 管理編年史 第 97/217 講 查看課程目錄

OpenAI 把圖片生成直接塞進 GPT-4o,一夜爆紅的吉卜力風潮

25/03/2025 267
3:10
OpenAI 把圖片生成直接塞進 GPT-4o,一夜爆紅的吉卜力風潮

OpenAI 於2025年3月25日宣布圖片生成能力原生整合進GPT-4o,取代DALL·E 3成為新一代圖片生成器,能精準渲染文字、透過對話反覆修圖,並因吉卜力動畫風格圖片在社群爆紅。

OpenAI 於2025年3月25日宣布,將圖片生成能力直接整合進 GPT-4o 模型,推出號稱「至今最先進」的圖片生成器。這項功能不再是獨立的 DALL·E 3 系統,而是原生內建於 GPT-4o 本身,並開始在 ChatGPT 與 Sora 中,向所有 Plus、Pro、Team 及免費用戶開放。

根據官方說明,新的生成方式能產出更精準、更真實的圖像,最大突破之一是能正確渲染文字——這是過去 DALL·E 系列圖片生成器長期的弱點,常出現扭曲、錯字的招牌與標語。由於能力內建於對話模型本身,使用者可以像聊天一樣,透過自然語言反覆調整、修改圖片,GPT-4o 也能延續對話上下文與先前上傳的圖片,維持系列圖像的一致性。

技術意義:從「呼叫外部工具」到「模型原生能力」

過去 ChatGPT 產生圖片,本質上是文字模型呼叫另一個獨立的 DALL·E 模型來完成,兩者是分工合作的兩套系統。這次的改變是把圖片生成能力「焊」進 GPT-4o 這個多模態模型本體,模型能同時理解文字脈絡、先前的圖片、以及使用者的修改意圖,一次到位地生成或編修圖像。這也是為什麼使用者能像聊天一樣持續微調圖片,而不是每次都重新下一個獨立的生成指令。

業界反應:吉卜力風潮意外成為現象級傳播

這項功能上線後,因為能夠將真實照片轉換成吉卜力工作室(Studio Ghibli)動畫風格的圖像,在社群媒體上引發大規模分享與討論,許多用戶把自己、家人、寵物的照片轉成宮崎駿式畫風後貼上社群平台,形成一波自發性的病毒式傳播。這種現象也連帶引出關於藝術風格模仿與版權界線的公開討論,成為這次功能發布之外的另一個話題。

對管理者的意義

圖片生成從「需要另外開工具、另外下指令」變成「聊天當下就能做」,意味著行銷、社群小編、門市或門店的視覺內容製作門檻大幅降低——不必等設計資源,主管與第一線同仁自己就能在對話中快速產出宣傳圖、菜單視覺或活動海報草稿,值得評估是否能補上團隊在快速視覺內容產製上的缺口。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 Meta 發表 Llama 4:開源模型首度導入混合專家架構

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策