OpenAI 发布 Codex 研究预览版:AI 写代码代理正式上线
OpenAI 于 2025 年 5 月 16 日发布 Codex 研究预览版,由专为软件工程优化的 codex-1 模型驱动,能在云端沙箱自主编写功能、修 bug、提交 PR,首批开放 Pro/Enterprise/Team 订阅用户使用。
OpenAI 于 2025 年 5 月 16 日发布 Codex 研究预览版,定位为目前最强大的 AI 编程代理。Codex 由 codex-1 模型驱动,是针对软件工程任务优化过的 o3 推理模型版本,官方称其生成的代码比原始 o3 更“干净”、更精准遵循指令,并会反复测试至通过才交付。
Codex 能编写新功能、回答现有代码库问题、修 bug,并主动提出可供审阅的 Pull Request。每项任务都在独立云端沙箱执行,沙箱预先加载用户的代码库,让 Codex 在完整上下文下工作。简单任务通常耗时 1 到 30 分钟,且不占用用户电脑与浏览器资源。首批仅开放 ChatGPT Pro、Enterprise、Team 订阅用户,Plus 用户随后跟进。
技术意义:从辅助建议到自主代理
过去的 AI 编程工具多停留在“人问、AI 答”或“AI 建议、人采纳”。Codex 的关键差异在于任务自主性:用户下达目标后,Codex 会在沙箱里独立规划、编写、测试、修正,直到通过验证才以 PR 交回人工审核,意味着 AI 角色从“副驾驶”迈向“可独立作业的初级工程师”,也是 o3 推理能力收敛到软件工程垂直任务的具体案例。
与前代比较及业界反应
相较过去偏重实时补全或单轮问答的工具,Codex 强调“完整任务闭环”:接收需求→沙箱执行→自我测试→产出可审阅结果;独立沙箱也把 AI 执行动作与本地环境隔开,降低误操作风险并可并行处理多任务。首批只开放付费层级较高用户,反映 OpenAI 一贯先在企业用户中验证稳定性、再逐步下放的分阶段放量策略。
对管理者的意义
对管理技术团队的主管而言,Codex 意味着小型修复、单一功能开发有机会被部分自动化,工程师角色将更偏向任务定义与代码审阅,而非逐行写代码;提早了解能力边界与审核机制,有助于评估未来团队分工与投资优先顺序。