Codex: Codex 简介与核心概念
最后更新:2026-08-31
Codex 是 OpenAI 推出的 云端软件工程智能体(AI Agent),官方口号是 "One agent for everywhere you code"——一个 Agent 覆盖所有编码场景。

💡 提示:Codex 不是聊天工具,而是能自主完成开发任务的 Agent——写代码、修 Bug、跑测试、提 PR,全流程自动化。
📋 前置知识:掌握至少一门编程语言,了解基本命令行操作即可
1. 你将学到
- Codex 的定位:Agent 而非 Chat
- 五大核心能力
- 三代 AI 编程工具的演进
- 四种使用方式
- 核心概念:Prompt / Thread / Context / Sandbox
关于代码示例的输出
本课程的代码示例采用确定性/非确定性分离模式,这是 AI Agent 工具教程的行业最佳实践:
| 标记 | 含义 | 你的输出 |
|---|---|---|
| 输出: | 确定性结果(安装、配置、计数等) | 应与示例基本一致 |
| 交互流程: | Agent 行为流程(LLM 调用、工具选择等) | 实际文本会不同,但流程相似 |
| 验证方法: | 练习题的检查方式 | 按描述步骤验证 |
💡 为什么不一样? 传统编程
1 + 1 = 2(永远相同),Agent 工具 agent.chat("分析代码") = ???(每次不同)。这是 AI Agent 工具的本质特性,不是 Bug。
2. 一个开发团队的真实故事
(1) 痛点:AI 编程工具的局限
Alice 是一家创业公司的技术负责人,她的团队尝试了多种 AI 工具:
- GitHub Copilot:代码补全方便,但只能做局部补全
- ChatGPT:回答不错,但代码需要手动复制粘贴
- Cursor:IDE 集成好,但复杂重构做不了
产品经理 Bob 提出新需求:
"我们需要把整个认证模块从 Session 迁移到 JWT,涉及 20+ 文件,确保所有测试通过。"
(2) Codex 的解法
Alice 使用 Codex,一句话启动迁移:
BASH
codex "将认证模块从 Session 迁移到 JWT,确保所有测试通过"
Codex 自主完成:
- 读取项目结构,定位所有认证相关文件
- 逐个修改认证逻辑
- 运行测试套件
- 根据失败结果修复代码
- 循环迭代直到所有测试通过
TEXT
📖 仅展示
Files modified: 23
Tests run: 47
Tests passed: 47
Iterations: 3
Time: ~6 minutes
3. 三代 AI 编程工具的演进
| 阶段 | 定位 | 代表产品 | 核心能力 |
|---|---|---|---|
| 第一代 | 代码补全 | GitHub Copilot | 根据上下文补全代码片段 |
| 第二代 | 对话写代码 | ChatGPT | 对话式生成代码,需手动复制 |
| 第三代 | 自主执行 | OpenAI Codex | 自主完成整个开发任务 |
前两代工具的本质是辅助,Codex 的本质是执行——AI 从工具变成了协作者。
4. Codex 是什么
(1) 核心定义
Codex 是一个 AI 编程 Agent,能自主理解、编写、调试与审查代码,可并行处理多项开发任务。
| 特性 | 说明 |
|---|---|
| 定位 | 云端软件工程 Agent |
| 核心 | 自主执行开发任务 |
| 运行 | 云端沙箱 + 本地 CLI |
| 合并 | 2026 年 7 月后并入 ChatGPT |
(2) Agent 与 Chat 的本质区别
graph LR
A[用户指令] --> B[Chat 模式]
A --> C[Agent 模式]
B --> B1[生成回答]
B1 --> B2[用户手动执行]
C --> C1[理解意图]
C1 --> C2[执行操作]
C2 --> C3[验证结果]
C3 --> C4{成功?}
C4 -->|否| C2
C4 -->|是| C5[汇报结果]
| 维度 | Chat 工具 | Agent (Codex) |
|---|---|---|
| 交互方式 | 一问一答 | 自主迭代 |
| 代码操作 | 输出代码片段 | 直接修改项目文件 |
| 上下文 | 用户手动提供 | 自动读取代码库 |
| 验证 | 用户手动验证 | 自动运行测试 |
| 错误处理 | 用户自行修正 | 自主修正并重试 |
5. 五大核心能力
| 能力 | 说明 |
|---|---|
| 编写代码 | 描述需求,生成匹配意图的代码,自动适应项目结构 |
| 理解代码库 | 阅读整个仓库,解释架构、业务逻辑和模块关系 |
| 代码审查 | 识别潜在 Bug、边界条件遗漏、性能瓶颈和安全风险 |
| 调试修复 | 读取错误日志 → 定位问题 → 给出修复补丁,全流程自动化 |
| 自动化任务 | 重构、测试、迁移、CI/CD 配置,均可一键委托 |
▶ 示例 1: 五大能力实战
BASH
# 编写代码
codex "实现用户注册 API,包含邮箱验证和密码强度检查"
# 理解代码库
codex "解释 src/auth/ 目录的架构设计"
# 代码审查
codex "审查 PR #42 的代码,关注安全性和性能"
# 调试修复
codex "修复 user.service.ts 中的空指针异常,确保测试通过"
# 自动化任务
codex "将所有 API 测试从 Jest 迁移到 Vitest"
6. 四种使用方式
| 方式 | 说明 | 适用场景 |
|---|---|---|
| App(桌面应用) | macOS/Windows 桌面客户端 | 完整功能、多项目并行 |
| IDE 扩展 | VS Code / Cursor / Windsurf 插件 | 深度集成开发环境 |
| CLI(命令行) | 终端交互式工具 | 终端爱好者、脚本自动化 |
| Web(云端) | chatgpt.com/codex 网页版 | 远程访问、并行任务 |
▶ 示例 2: Alice 的选择
PYTHON
def choose_codex_mode(task_type, team_size):
if task_type == "refactor" and team_size > 3:
return "Web - 并行委派多个任务"
elif task_type == "debug":
return "IDE - 边写代码边调试"
elif task_type == "automate":
return "CLI - 脚本集成自动化"
else:
return "App - 全功能工作台"
7. 核心概念速览
| 概念 | 说明 | 关键要点 |
|---|---|---|
| Prompt | 你提交给 Codex 的任务描述 | 清晰描述 + 包含验证步骤 |
| Thread | 单个任务会话 | 本地线程 / 云端线程 |
| Context | Codex 可使用的上下文 | 文件引用 + 对话历史 |
| Sandbox | 安全隔离机制 | Read-only / Workspace-write / Full-access |
| Approval | 审批策略 | ask / approve / deny |
8. 适用计划
| 计划 | 价格 | Codex 功能 |
|---|---|---|
| Free | 免费 | 探索 Codex,快速编码任务 |
| Plus | $20/月 | Web、CLI、IDE、云端集成 |
| Pro | $200/月 | 10x-20x 更高限额、优先处理 |
| Business | 按用量付费 | 更大 VM、SAML SSO、MFA |
| Enterprise | 联系销售 | SCIM、EKM、RBAC、审计日志 |
9. 开发者角色的转变
引入 Codex 后,开发者的工作重心发生变化:
| 传统角色 | Codex 时代角色 |
|---|---|
| 亲自编写每行代码 | 拆解任务、描述需求 |
| 手动调试修复 | 审查 Codex 的修复结果 |
| 逐文件重构 | 把控架构方向 |
Codex 不擅长全局系统设计,架构决策仍是人类的主场。
10. 适用与不适用场景
适合
- 独立开发者 / 小型团队:人手不足,委托重复性任务
- 大规模重构:框架迁移、代码升级
- 遗留系统理解:无文档的历史代码库
- 快速原型验证:数分钟生成可运行原型
- 测试覆盖补全:批量补充单元测试
不适合
- 需要深度领域知识的核心算法设计
- 强依赖非公开内部文档的决策
- 需要频繁人工确认的高风险生产操作
❓ 常见问题
Q Codex 和 ChatGPT 有什么区别?
A ChatGPT 是聊天工具,只输出文字回答;Codex 是 AI Agent,能自主执行开发任务——读文件、改代码、跑测试、提 PR。2026 年 7 月后 Codex 并入 ChatGPT,成为其应用。
Q Codex 会偷偷上传我的代码吗?
A Codex CLI 在本地运行,只有 prompt 和必要上下文发送给模型;Codex Web/App 在云端沙箱运行,代码会在沙箱中处理。OpenAI 声称不会用 API 数据训练模型。
Q 没有网络能用 Codex 吗?
A 不能。Codex 需要连接 OpenAI API,离线无法工作。
Q Codex 支持哪些编程语言?
A 理论上支持所有编程语言——能读写任何文本文件、执行任何 shell 命令。对 TypeScript/Python/Go 等主流语言支持最佳。
Q Codex 和 Claude Code 哪个好?
A Codex 背靠 OpenAI 生态,与 ChatGPT 深度集成;Claude Code 集成度更高、Agent 能力强但只支持 Claude 模型。选择取决于你的模型偏好和使用场景。
📖 小节
- Codex 是第三代 AI 编程工具,核心是自主执行而非辅助
- 五大能力:编写代码、理解代码库、代码审查、调试修复、自动化任务
- 四种使用方式:App / IDE / CLI / Web
- 核心概念:Prompt / Thread / Context / Sandbox / Approval
- 开发者角色从"编写者"转向"任务拆解者 + 结果审查者"
📝 作业
- 基础题(难度⭐):列举 Codex 与 ChatGPT 在编程辅助方面的三个核心区别。
- 进阶题(难度⭐⭐):为你的项目选择 Codex 的使用方式,写出选择理由。
- 挑战题(难度⭐⭐⭐):设计一个工作流,说明哪些任务适合用 Codex Agent,哪些适合手动编码,给出决策依据。