OpenAI 發表 Codex 研究預覽版:AI 寫程式代理正式上線
OpenAI 於 2025 年 5 月 16 日發表 Codex 研究預覽版,由專為軟體工程優化的 codex-1 模型驅動,能在雲端沙箱自主撰寫功能、修錯、提交 PR,初期開放 Pro/Enterprise/Team 訂閱用戶使用。
OpenAI 於 2025 年 5 月 16 日發表 Codex 研究預覽版,定位為目前最強大的 AI 程式撰寫代理。Codex 由 codex-1 模型驅動,是針對軟體工程任務優化過的 o3 推理模型版本,官方稱其產出的程式碼比原始 o3 更「乾淨」、更精準遵循指令,且會反覆測試至通過才交付。
Codex 能撰寫新功能、回答既有程式碼庫問題、修錯,並主動提出可供審閱的 Pull Request。每項任務都在獨立雲端沙箱執行,沙箱預先載入使用者的程式碼庫,讓 Codex 在完整脈絡下工作。簡單任務通常耗時 1 到 30 分鐘,且不佔用使用者電腦與瀏覽器資源。初期僅開放 ChatGPT Pro、Enterprise、Team 訂閱用戶,Plus 用戶稍後跟進。
技術意義:從輔助建議到自主代理
過去的 AI 寫程式工具多停留在「人問、AI 答」或「AI 建議、人採納」。Codex 的關鍵差異在於任務自主性:下達目標後,Codex 會在沙箱裡獨立規劃、撰寫、測試、修正,直到通過驗證才以 PR 交回人審核,代表 AI 角色從「副駕駛」邁向「可獨立作業的初階工程師」,也是 o3 推理能力收斂到軟體工程垂直任務的具體案例。
與前代比較及業界反應
相較過去偏重即時補全或單輪問答的工具,Codex 強調「完整任務閉環」:接收需求→沙箱執行→自我測試→產出可審閱結果;獨立沙箱也把 AI 執行動作與本機環境隔開,降低誤操作風險並可平行處理多工。首波只開放付費層級較高用戶,反映 OpenAI 一貫先在企業用戶驗證穩定性、再逐步下放的分階段放量策略。
對管理者的意義
對管理技術團隊的主管而言,Codex 意味著小型修復、單一功能開發有機會被部分自動化,工程師角色將更偏向任務定義與程式碼審閱,而非逐行寫碼;提早了解能力邊界與審核機制,有助評估未來團隊分工與投資優先順序。
大家怎麼說 · 3 則留言