Codex的配置和使用
本文最后更新于 2026年8月24日 下午
本文主要分享了我个人在Codex使用过程中关注到的配置和使用技巧,主要摘自Codex官方文档。
codex
概述
Codex 是 OpenAI 的软件开发编码代理。ChatGPT Plus、Pro、Business、Edu 和 Enterprise 套餐均包含 Codex。它可以帮助您:
- 编写代码 :描述您想要构建的内容,Codex 会生成符合您意图的代码,并适应您现有的项目结构和约定。
- 理解不熟悉的代码库 :Codex 可以读取和解释复杂的或遗留的代码,帮助您了解团队如何组织系统。
- 代码审查 :Codex 分析代码以识别潜在的错误、逻辑错误和未处理的边界情况。
- 调试和修复问题 :当出现故障时,Codex 可以帮助追踪故障、诊断根本原因并提出有针对性的修复方案。
- 自动化开发任务 :Codex 可以运行重构、测试、迁移和设置等重复性工作流程,以便您可以专注于更高层次的工程工作。
开发者角色的变化:
引入 Codex 后,开发者的工作重心正在发生结构性转变——从亲自编写每一行代码"到拆解任务、审查结果、把控架构方向。
开发者核心职责的三个转变:任务拆解(把模糊需求分解为可执行的具体指令)、架构决策(Codex 不擅长全局系统设计,这仍是人类的主场)、结果审查(确保 Codex 生成的代码符合业务逻辑和质量标准)。
官方链接
- Codex官方:https://openai.com/codex
- Codex文档:https://developers.openai.com/codex
- Github开源:https://github.com/openai/codex
- 官方用例:https://developers.openai.com/codex/use-cases
定价
使用方式
Codex 提供四种使用方式,满足不同场景需求:
| 方式 | 说明 | 适用场景 |
|---|---|---|
| App(桌面应用) | macOS/Windows 桌面客户端 | 完整功能、多项目并行 |
| IDE 扩展 | VS Code、Cursor、Windsurf 插件 | 深度集成开发环境 |
| CLI(命令行) | 终端交互式工具 | 终端爱好者、脚本自动化 |
| Web(云端) | chatgpt.com/codex 网页版 | 远程访问、并行任务 |
定价
- 达到使用上限会发生什么?我们希望您能够完成正在进行的工作。如果您在当前回合中达到使用限额,the agent仍可在合理使用限额的约束下继续处理该回合。
- ChatGPT Plus 和 Pro 用户达到使用上限后,可以购买额外的积分继续使用,而无需升级现有套餐。
- 所有用户还可以使用 API 密钥运行额外的本地任务,使用费用按以下方式收取: 标准 API 费率 。
安装
Codex 可以修改你的代码库,因此建议在每次执行任务前后创建 Git 检查点,以便在需要时轻松回滚更改。
App
-
下载安装。
-
打开codex并使用您的 ChatGPT 帐户或 OpenAI API 密钥登录。
如果您使用 OpenAI API 密钥登录, 某些功能可能无法使用 。
-
选择 Codex 要在哪个项目文件夹中运行。
-
选择项目后,请确保选择 “本地” ,以便 Codex 可以在您的计算机上运行,并向 Codex 发送您的第一条消息。你可以向 Codex 咨询任何关于项目或电脑方面的问题。示例:Tell me about this project
-
完成。
IDE扩展
- Visual Studio Code
- Cursor
- Windsurf
- Visual Studio Code Insiders
CLI
Codex CLI 可在 macOS、Windows 和 Linux 系统上使用。在 Windows 系统上,您可以使用 Windows 沙箱在 PowerShell 中原生运行 Codex,或者在需要 Linux 原生环境时使用 WSL2。有关设置详情,请参阅 Windows 设置指南。
-
安装:
1
2
3
4
5
6
7# macOS or Linux
curl -fsSL https://chatgpt.com/codex/install.sh | sh
curl -fsSL https://chatgpt.com/codex/install.sh | sh # 升级
# Windows
powershell -ExecutionPolicy ByPass -c "irm https://chatgpt.com/codex/install.ps1 | iex"
powershell -ExecutionPolicy ByPass -c "irm https://chatgpt.com/codex/install.ps1 | iex" # 升级您也可以使用 npm 或 Homebrew 安装 Codex CLI:
1
2
3
4
5npm install -g @openai/codex
npm install -g @openai/codex # 升级
brew install --cask codex
brew upgrade --cask codex # 升级 -
在终端运行
codex即可开始使用。系统会提示您使用 ChatGPT 帐户或 API 密钥登录。 -
身份验证成功后,您可以要求 Codex 在当前目录中执行任务。
-
完成。
Cloud
-
请访问 chatgpt.com/codex 。您还可以通过在 GitHub pull request 评论中标记
@codex将任务委托给 Codex(需要登录 ChatGPT)。 -
在开始你的第一个任务之前,请先设置 Codex 环境。打开 chatgpt.com/codex 的环境设置,并按照步骤连接 GitHub 仓库。
-
环境准备就绪后,即可通过 Codex 界面启动编码任务。您可以查看日志实时监控进度,也可以让任务在后台运行。
-
任务完成后,请在差异视图中查看建议的更改。您可以根据结果进行迭代,或直接在 GitHub 仓库中创建拉取请求。
-
Codex 还提供了更改预览。您可以直接接受 PR,也可以在本地检出分支来测试更改:
1
2git fetch
git checkout <branch-name> -
完成。
迁移到codex
使用导入流程,您可以将其他agents的指令、设置、技能、插件、项目和最近的聊天记录导入 Codex。Codex 会直接导入受支持的项目,并允许您完成任何需要授权的导入插件或连接的设置。
导入操作不会更改或删除您现有的代理设置。
导入流程
- 在 Codex 应用中,打开Settings 。
- 在 General 下,找到 Import other agent setup。
- 选择Import。
- 选择要从中导入的代理,然后选择 Continue。
- 在 Select items to import 中,选择 Continue 以导入所有内容,或选择 Customize 以选择特定项目。
- 如果要自定义导入,请选择要导入的项目,然后选择 Confirm。
- 导入完成后,打开已导入的项目或线程继续工作。
导入类型
| Imported item | Codex destination |
|---|---|
| Instruction files | AGENTS.md |
settings.json |
config.toml |
| Skills | Codex skills |
| Plugins | Codex plugins |
| Existing project folders | Codex projects using the same folders |
| Chat sessions from the last 30 days | Codex threads |
| MCP server configuration | Codex MCP configuration |
| Hooks | Codex hooks |
| Slash commands | Codex skills |
| Subagents | Codex agents |
配置
开发者工具
当已经安装了一些常用的开发者工具时,Codex 能发挥最佳效果:
- Git :为 Codex 应用中的审阅面板提供支持,并允许您检查或还原更改。
- Node.js :代理程序用来更高效地执行任务的常用工具。
- Python :代理程序用来更高效地执行任务的常用工具。
- .NET SDK :在构建原生 Windows 应用程序时非常有用。
- GitHub CLI :为 Codex 应用提供 GitHub 特有的功能。
您可以使用默认的 Windows 程序包管理器 winget 安装它们,只需将以下命令粘贴到集成终端中,或者让 Codex 来安装它们:
1 | |
配置文件
Codex 将用户级配置存储在 ~/.codex/config.toml 中。要将设置限定到特定项目或子文件夹,请在您的仓库中添加 .codex/config.toml 文件。
CLI、IDE 和 Codex 应用共享相同的configuration layers。
- 调整模型在得到支持时所应用的推理努力程度:
model_reasoning_effort = "high"
记忆
记忆功能让 Codex 可以将之前线程中的有用上下文延续到后续工作中。启用记忆功能后,Codex 可以记住稳定的偏好设置、重复的工作流程、技术栈、项目规范和已知陷阱,这样您就无需在每个线程中重复相同的上下文。
启用:
-
在 Codex App中,在设置中启用“记忆”功能。
-
对于基于配置的设置,请将功能标志添加到
config.toml中:1
2[features]
memories = true -
等等。
网络代理
App
斜杠命令
| Slash command | Description |
|---|---|
/feedback |
打开反馈对话框提交反馈,并可选择包含日志。 |
/goal |
为 Codex 设定一个持续努力的目标;首先使用 /plan 来制定目标。 |
/init |
为当前项目生成 AGENTS.md 框架。 |
/mcp |
打开 MCP 状态查看已连接的服务器。 |
/plan |
切换计划模式,进行多步骤计划。 |
/review |
启动代码审查模式,以审查未提交的更改或与基础分支进行比较。 |
/status |
显示线程 ID、上下文使用情况和速率限制。 |
CLI
配置
-
Codex CLI 和 IDE 扩展使用同一个
config.toml配置文件 。要指定模型,请在配置文件中添加model条目。如果您未指定模型,Codex 应用、CLI 或 IDE 扩展将默认使用推荐模型。1
model = "gpt-5.5" -
等等。
命令行选项
斜杠命令
恢复对话
Codex 会将您的会话记录存储在本地,这样您就可以从上次中断的地方继续,而无需重复上下文。如果您想使用相同的存储库状态和指令重新打开之前的会话,请使用 resume 命令。
codex resume会启动一个最近交互式会话选择器。选中某个会话即可查看其摘要,按 Enter 即可重新打开该会话。codex resume --all显示当前工作目录之外的会话,因此您可以重新打开任何本地运行。codex resume --last会跳过选择器,直接跳转到当前工作目录中的最近会话(添加--all可忽略当前工作目录过滤器)。codex resume <SESSION_ID>指向特定的运行。您可以从选择器、/status或~/.codex/sessions/下的文件中复制 ID。
自动补全
安装 shell 生成的自动补全脚本,加快日常使用速度:
1 | |
在 shell 配置文件中运行补全脚本,为新会话设置补全功能。例如,如果您使用 zsh ,可以将以下内容添加到 ~/.zshrc 文件的末尾:
1 | |
启动一个新的会话,输入 codex ,然后按 Tab 查看命令补全。如果出现 command not found: compdef 错误,请在 ~/.zshrc 文件中的 eval "$(codex completion zsh)" 这行代码之前添加 autoload -Uz compinit && compinit ,然后重启 shell。
tips
-
使用
/clear清除终端并开始新的聊天,或者按 Ctrl + L 清除屏幕而不开始新的对话。 -
使用 Up / Down 在编辑器中浏览草稿历史记录;Codex 恢复先前的草稿文本和图像占位符。
-
按 Ctrl + R 从the composer中搜索prompt的历史记录,然后按 Enter 接受匹配项或按 Esc 取消。
-
按 Ctrl + C 或使用
/exit关闭交互式会话。 -
使用
/model命令可以在会话期间切换模型,或者在启动 CLI 时指定一个模型codex --model gpt-5.5。 -
请附上屏幕截图或设计规范,以便 Codex 可以读取图像详情以及您的提示信息。您可以将图像粘贴到交互式编辑器中,也可以通过命令行提供文件。
1
2codex -i screenshot.png "Explain this error"
codex --image img1.png,img2.jpg "Summarize these diagrams"Codex 接受 PNG 和 JPEG 等常见格式。两个或多个图像请使用逗号分隔的文件名,并结合文本说明以提供上下文信息。
-
您可以直接在命令行界面 (CLI) 中让 Codex 生成或编辑图像。这适用于图标、横幅、插图、精灵图和占位图等素材。如果您希望 Codex 转换或扩展现有素材,请在提示信息中附上参考图像。
-
在命令行界面 (CLI) 中输入
/review即可打开 Codex 的审阅预设。CLI 会启动一个专用的审阅器,读取您选择的差异并报告优先级排序的、可操作的发现,而不会触及您的工作树。默认情况下,它使用当前会话模型;您可以在config.toml中设置review_model来覆盖默认模型。 -
Codex 自带一个原生网络搜索工具。对于 Codex CLI 中的本地任务,Codex 默认启用网络搜索,并从网络搜索缓存中提供搜索结果。
-
审批模式定义了 Codex 在无需确认的情况下可以执行的操作范围。在交互式会话中使用
/permissions可以根据您的舒适度变化切换模式。- 自动 (默认)模式允许 Codex 读取工作目录内的文件、编辑文件和运行命令。但它在访问工作目录之外的任何内容或使用网络之前仍然会询问。
- 只读模式使 Codex 保持咨询模式。它可以浏览文件,但在您批准方案之前,不会进行任何更改或执行命令。
- 完全访问权限赋予 Codex 在您的计算机上执行操作的权限,包括网络访问,而无需事先请求。请谨慎使用此权限,并且仅在您信任存储库和任务时才使用。
-
在撰写较长的提示时,切换到完整编辑器,然后将结果发送回the composer可能会更容易一些。在提示输入中,按 Ctrl + G 打开由
VISUAL环境变量定义的编辑器(如果未设置VISUAL,则打开EDITOR)。 -
在编辑器中输入
@以打开对工作区根目录的模糊文件搜索;按 Tab 或 Enter 将突出显示的路径拖放到您的邮件中。 -
Codex 运行时,按 Enter 可将新指令注入当前回合,按 Tab 可将后续输入排队等待下一回合。排队的输入可以是普通提示符、斜杠命令(例如
/review)或!shell 命令。Codex 会在运行时解析排队的斜杠命令。 -
在行首添加
!即可运行本地 shell 命令(例如,!ls)。Codex 会将输出视为用户提供的命令结果,并仍然应用您的批准和沙箱设置。 -
在消息编辑器为空时,连续按两次 Esc 即可编辑您之前的用户消息。继续按 Esc 可返回上一条消息,然后按 Enter 从该点开始创建分支。
-
从任意目录启动 Codex,使用
codex --cd <path>即可设置工作根目录,无需先运行cd。当前路径会显示在 TUI 界面的头部。 -
当您需要协调多个项目之间的更改时,可以使用
--add-dir公开更多可写根目录(例如,codex --cd apps/frontend --add-dir ../backend --add-dir ../shared)。 -
在启动 Codex 之前,请确保您的环境已经设置完毕,以免它浪费代币来探测要激活的内容。例如,预先加载 Python 虚拟环境(或其他语言环境),启动任何所需的守护进程,并导出您预期使用的环境变量。
-
要使用特定模型启动新的 Codex CLI 线程,或者为
codex exec指定模型,可以使用--model/-m标志。1
codex -m gpt-5.5
提示技巧
- Codex 能够验证其工作成果时,就能生成更高质量的输出。请提供重现问题、验证功能以及运行代码检查和提交前检查的步骤。
- 将复杂的工作分解成更小、更专注的步骤,Codex 就能更好地处理。更小的任务便于 Codex 测试,也便于您进行审核。如果您不确定如何拆分任务,请让 Codex 生成一个方案。
一个好的默认做法是在提示中包含以下四项内容:
- 目标: 你想要改变什么或建立什么?
- 上下文: 哪些文件、文件夹、文档、示例或错误与此任务相关?您可以使用 @ 符号提及特定文件作为上下文。
- 限制: Codex 应该遵循哪些标准、架构、安全要求或惯例?
- 完成条件: 任务完成之前应该满足哪些条件,例如测试通过、行为改变或错误不再重现?
有效 Prompt 的原则:
| 原则 | 说明 | 示例 |
|---|---|---|
| 包含验证步骤 | Codex 能验证工作时输出质量更高 | "写一个函数,包含测试用例验证它处理空列表" |
| 拆解复杂任务 | 小任务更容易测试和审查 | "第一步:创建模型;完成后告诉我再继续第二步" |
| 提供上下文 | 引用相关文件和图片 | "参考 src/auth.py 的风格,实现类似功能" |
tips:
- 提交提示时,请包含 Codex 可以使用的上下文信息,例如相关文件和图像的引用。Codex IDE 扩展会自动将打开的文件列表和选定的文本范围作为上下文。
- Prompt 应该用中文还是英文?Codex 支持多语言,但英文通常效果最好。使用中文时,确保描述足够详细和明确。
用例
工作流程
每个工作流程都包含:
- 何时使用它以及哪种 Codex 界面最适合它(IDE、CLI 或云端)。
- 步骤及示例用户提示。
- 背景说明 :Codex 自动识别的内容与您应该附加的内容。
- 验证 :如何检查输出结果。
Fix a bug
请向 Codex 提供复现步骤,以及您怀疑存在问题的文件:
1 | |
背景说明:
- 请您提供:重现步骤和限制条件(这些比高层次的描述更重要)。
- Codex 提供:命令输出、发现的调用点以及它触发的任何堆栈跟踪。
确认:
-
Codex 应该在修复后重新运行重现步骤。
-
如果您有标准的检查流程,请让它运行该流程:
1
After the fix, run lint + the smallest relevant test suite. Report the commands and results. -
等等。
在这个仓库中构建一个经典的贪吃蛇游戏
1 | |
用最小的改动,高置信度地查找并修复代码库中的错误
1 | |
个性化
项目指南AGENTS.md
概述
AGENTS.md为 Codex 提供持久的项目指南,该指南会随您的代码库一起传输,并在代理开始工作之前应用。请保持其简洁性。
您可以使用它来设置 Codex 在代码仓库中每次都要遵循的规则,例如:
- 构建和测试命令
- 审查预期
- 仓库特定约定
- 目录特定说明
一份好的 AGENTS.md 文件应包含以下内容:
- 仓库布局和重要目录
- 如何运行该项目
- 构建、测试和代码检查命令
- 工程惯例和PR预期
- 约束和禁止规则
- 完成工作的含义以及如何验证工作
当代理程序对您的代码库做出错误假设时,请在
AGENTS.md中进行更正,并要求代理程序更新AGENTS.md,以使修复生效。将其视为一个反馈循环。
CLI 中的 /init 斜杠命令是一个快速启动命令,它会在当前目录下生成一个初始的 AGENTS.md 文件。
Codex 可以从多个位置加载指南:一个位于 Codex 主目录中的全局文件(供您作为开发人员使用),以及团队可以提交的特定于代码库的文件。距离工作目录越近的文件优先级越高。使用全局文件来控制 Codex 与您沟通的方式(例如,审查风格、详细程度和默认值),并保持存储库文件专注于团队和代码库规则。
1 | |
| Layer | Global | Repo |
|---|---|---|
| AGENTS | ~/.codex/AGENTS.md |
AGENTS.md in repo root or nested directories |
| Skills | $HOME/.agents/skills |
.agents/skills in repo |
示例
codex的windows桌面版真的只有在wsl中才是“满血”,才有最佳体验吗?
1 | |
插件
插件将技能、应用程序集成和 MCP 服务器捆绑到 Codex 的可重用工作流程中。插件可以包含:
- Skills: 针对特定类型工作的可重用指令。Codex 可以根据需要加载这些指令,从而遵循正确的步骤,并使用正确的参考资料或辅助脚本来完成任务。
- Apps: 连接到 GitHub、Slack 或 Google Drive 等工具,以便 Codex 可以读取这些工具中的信息并在其中执行操作。
- MCP servers: 为 Codex 提供访问更多工具或共享信息的服务,通常来自本地项目之外的系统。
如果您想保留已安装的插件但将其关闭,请设置其条目。 将 ~/.codex/config.toml 中的 enabled = false 改为重启 Codex:
1 | |
列表:
- Computer Use。在提示词中提及 @Computer 或 @AppName,或者直接让 Codex 使用 Computer Use。
- Codex Security 是一个 Codex 安全审查插件,它可以扫描代码中的漏洞,验证合理的发现,并在可审查的工作区中提供证据和补救指导。使用它可以查找您拥有或有权评估的代码中的安全问题,防止它们进入生产环境。
skills
概述
技能赋予 Codex 可重用功能,从而实现可重复的工作流程。技能通常是可重用工作流程的最佳选择,因为它们支持更丰富的指令、脚本和参考资料,同时还能在不同任务中保持可重用性。
技能已加载并对代理可见(至少其元数据可见),因此 Codex 可以隐式地发现并选择它们。这既能保证丰富的工作流程可用,又不会预先引入过多上下文信息。
技能可以是全局的(位于您的用户目录中,供您作为开发者使用),也可以是特定于代码仓库的(提交到 .agents/skills 目录中,供您的团队使用)。如果工作流程适用于某个特定项目,请将代码仓库技能放在 .agents/skills 目录中;如果您希望所有代码仓库都拥有相同的技能,请使用您的用户目录。
技能采用渐进式披露机制来高效管理上下文:Codex 首先加载每个技能的名称、描述和文件路径。只有在决定使用某个技能时,Codex 才会加载完整的 SKILL.md 指令。
Skills是可重用工作流的创作格式。Plugins 是 Codex 中可重用技能和应用程序的可安装分发单元。使用skills设计工作流本身,然后在需要其他开发者安装时将其打包成plugin。
- Skills 是编写格式,适合本地开发和仓库内的团队共享。当你需要将技能分发给其他开发者、打包多个技能、或与应用集成一起发布时,使用 Plugins 格式。
Codex 支持两种技能激活方式:
- 显式调用:在提示词中直接引用技能。在 CLI 或 IDE 中,使用 /skills 命令或输入 $ 符号来指定一个技能。显式调用时,Codex 不需要做任何匹配判断,直接加载完整 SKILL.md 并执行。
- 隐式匹配:当你发出的任务描述与某个技能的 description 字段匹配时,Codex 会自动选择该技能。隐式匹配的准确性完全取决于 description 字段的编写质量。
按照当前的需求搜索相关skill并安装。
收集整理
- https://github.com/openai/plugins:此仓库包含精选的 Codex 插件示例集合。
- https://github.com/anthropics/skills:此仓库包含 Anthropic 为 Claude 实现的技能。
通用
-
https://github.com/JuliusBrussee/caveman:为什么用那么多token?少token就能搞定——Claude Code skill,用原始人说话就能减少65%的token。
-
-
https://github.com/mattpocock/skills/tree/main/skills/productivity/grill-me:为完善计划或设计而进行的反复访谈。
- 或superpowers里的skill brainstorming。
-
-
/to-prd的升级版?
-
可以用来写需求文档,在
/grill-me完成后调用。
-
-
https://github.com/mattpocock/skills/tree/main/skills/engineering/to-tickets:将计划、规范或您正在进行的对话拆分成问题跟踪器中的一系列工单。每个工单都会声明其阻塞边界 ——即其他必须完成才能开始执行的工单。
- /to-issues的升级版?
-
...
-
-
https://github.com/Panniantong/Agent-Reach:赋予你的 AI 代理整个互联网的视野。只需一个命令行界面,零 API 费用,即可阅读和搜索 Twitter、Reddit、YouTube、GitHub、Bilibili、小红书等内容。
编程
- https://github.com/obra/superpowers:Superpowers 是一套完整的软件开发方法论,适用于您的编码代理,它建立在一组可组合的技能和一些初始指令之上,以确保您的代理能够使用这些技能和指令。
- https://github.com/multica-ai/andrej-karpathy-skills:一份文件中包含四项原则,直接针对这些问题:编码前请三思、简单至上、Surgical Changes、目标驱动型执行
- https://github.com/OthmanAdi/planning-with-files:一种基于文件的持久化规划技能,适用于 AI 编码代理。
写作
- https://github.com/blader/humanizer:一款便携式代理技能,能够消除文本中人工智能生成的痕迹,使其听起来更自然、更像人类的语言。
- https://github.com/Shubhamsaboo/awesome-llm-apps/tree/main/awesome_agent_skills/technical-writer
学术研究
- https://github.com/Imbad0202/academic-research-skills:一套全面的 Claude Code 技能,用于学术研究,涵盖从研究到发表的整个流程。
- https://github.com/handsomestWei/patent-disclosure-skill:中国专利.skill,从项目文档到可交付的技术交底书,专利点挖掘、联网国知局查新、脱敏成文与自检闭环。
- https://github.com/zLanqing/codex-claude-academic-skills:本仓库包含三个面向学术科研人员的Skills,覆盖从文献阅读、论文写作到科学计算的完整研究工作流。
- https://github.com/Norman-bury/research-writing-skill:把"论文写作"从一次性聊天,升级成可追踪、可恢复、可复用的工程化协作流程。
- https://github.com/imbad0202/academic-research-skills:一套全面的 Claude Code 技能,用于学术研究,涵盖从研究到发表的整个流程。
创作
- https://github.com/op7418/guizang-ppt-skill:一个适配 Claude Code / Codex 等 Agent 环境的网页 PPT 技能,用于生成单文件 HTML 横向翻页 PPT、PPT 配图和多平台封面。
powershell
- https://github.com/aloth/PowerSkills
- https://github.com/Misaka-Mikoto-Tech/agent-skills/tree/main/skills/powershell-safe-invocation
- https://github.com/hmohamed01/powershell-expert
其它
-
https://github.com/anthropics/skills/tree/main/skills/skill-creator:创造新技能,修改和改进现有技能,并衡量技能表现。
-
https://github.com/vercel-labs/skills/tree/main/skills/find-skills:帮助用户发现和安装agent skills。
子代理
Codex 可以通过并行生成专门的代理来运行子代理工作流程,以便它们可以同时探索、处理或分析工作。子代理工作流通过将繁琐的工作从主线程中移出来提供帮助:
- 让主要代理人专注于需求、决策和最终结果。
- 并行运行专门的子代理 ,用于探索、测试或日志分析。
- 返回子代理的摘要, 而不是原始中间输出。
Codex 不会自动生成子代理,只有在您明确要求使用子代理或并行代理工作时才会使用子代理。实际上,手动触发意味着使用直接指令,例如“生成两个代理”、“并行委派这项工作”或“每个点使用一个代理”。一个好的子代理提示应该解释如何划分工作,Codex 是否应该等待所有代理完成再继续,以及要返回什么摘要或输出。
1 | |
1 | |
管理:
- 在 CLI 中使用
/agent可以在活动代理线程之间切换并检查正在运行的线程。 - 直接请求 Codex 控制正在运行的子代理、停止子代理或关闭已完成的代理线程。
自定义模型提供商
远程连接
远程连接功能允许您从其他设备或计算机使用 Codex。您可以使用 ChatGPT 移动应用中的 Codex,在已连接的 Mac 或 Windows 设备上使用 Codex,也可以从其他支持 Codex 应用的设备继续工作,或者将 Codex 应用连接到 SSH 主机上的项目。
- 在主机上的项目中创建新线程,或继续现有线程。
- 发送后续指示,回答问题,并指导正在进行的工作。
- 批准命令和其他操作。
- 查看输出结果、差异、测试结果、终端输出和屏幕截图。
- 当 Codex 完成任务或需要您关注时,您将收到通知。
- 在已连接的主机和线程之间切换。
自动化
App内自动化
非交互模式
非交互模式允许您从脚本(例如,持续集成 (CI) 作业)运行 Codex,而无需打开交互式 TUI。您可以使用 codex exec 来调用它。
exec 单次执行后退出,适合自动化脚本;交互模式持续对话,适合日常开发。
Codex SDK
如果您通过 Codex CLI、IDE 扩展或 Codex Web 使用 Codex,您也可以通过编程方式控制它。
wsl
问题与解决
reconnecting 5/5
codex 如果遇到了 reconnecting 5/5,请注意检查自己是否开了 tun,推荐开 tun 会恢复正常。如果不行可以尝试:
- 定义代理环境变量 参考贴文: https://linux.do/t/topic/2350446
- 关闭 websocket 配置里加 supports_websockets = false
tips
模型选择
- 网友:主模型用 Sol,默认 High;简单任务降到 Medium,困难任务升到 Extra High;关闭 Max 和 Ultra;用 LazyCodex 把子 Agent 自动分配给 Sol 和 Luna。
- 用高级模型、高推理程度出方法,用中、低模型按方案写实现。
- 使用用高级模型、高推理程度可能会出现过度设计、冗余设计等问题。
推理强度
因为翻译原因 Max 和 Ultra 都被翻译成了“极高”,目前来看主要区别在于 Ultra 会用多个子代理而 Max 不会。Ultra 很慢,很消耗 token。
关于GPT-5.6Sol的推理努力:从最低设置开始,只要能完成任务就行,只有在任务真正需要更多思考时才调高。
-
轻度 & 低:快速、范围明确的任务
-
中度:规划、分析,或几个活动部件
-
高 & 超高:更难的工作,涉及多个步骤、权衡、研究或仔细验证
-
Max和Utra有点不同:
- Max:一个模型花更长时间处理一个难题
- Utra:多个子代理并行处理一个更大问题的不同部分。ultra 和其他 reasoning effort 不一样,sol 最高 effort 是 max,ultra 是 max 的 multi agent。
哦,还有,就像任何新模型一样,推理级别无法直接从GPT-5.5映射到GPT-5.6。如果你习惯了5.5,在熟悉的任务上试着从比平时低一级的设置开始,只有在结果需要时才增加。
线程
- 一个线程就是一个单独的会话:它包含你的提示信息,以及随后的模型输出和工具调用。一个线程可以包含多个提示信息。例如,你的第一个提示信息可能要求 Codex 实现某个功能,而后续的提示信息可能要求它添加测试。
- 当 Codex 正在积极处理某个线程时,该线程就处于“运行”状态。您可以同时运行多个线程,但请避免两个线程修改相同的文件。您也可以稍后通过输入另一个提示符来恢复线程。
- 线程既可以在本地运行,也可以在云端运行:
- 本地线程在您的计算机上运行。Codex 可以读取和编辑您的文件并运行命令,因此您可以查看更改并使用现有工具。为了降低工作区外发生意外更改的风险,本地线程在沙箱中运行。
- 云线程在一个隔离的环境中运行。Codex 会克隆你的代码仓库并检出它正在处理的分支。当你想要并行运行任务或从其他设备委派任务时,云线程非常有用。要将云线程与你的代码仓库一起使用,请先将代码推送到 GitHub。你也可以从本地计算机委派任务 ,包括你当前的工作状态。
- 每个项目使用一个线程,而不是每个任务使用一个线程。这会导致上下文臃肿,随着时间的推移,结果会越来越差。
使用
- 使用计划模式: 对于大多数用户而言,这是最简单有效的选择。计划模式允许 Codex 收集背景信息、提出澄清问题,并在实施前制定更完善的计划。使用
/plan或 Shift + Tab 切换。 - 请 Codex 对您进行面试: 如果您对想要实现的功能有一个大致的想法,但不确定如何准确描述,可以先请 Codex 向您提问。告诉它挑战您的假设,并在编写代码之前将模糊的想法转化为具体的概念。
- 不要仅仅要求 Codex 做出更改。还要要求它在需要时创建测试,运行相关检查,确认结果,并在接受更改之前审查更改内容。
- 开发一个新项目,先让codex理解一遍你的代码库效果更好。
ask模式是只读模式,适合在动手之前先理解现有代码的结构和逻辑。例如:codex -a ask "这个项目是如何处理用户认证的?梳理完整的认证流程"。
- Codex 额度它按 5 小时滚动窗口来算,重置节奏其实可以自己卡。比如你每天习惯下午 2 点到 6 点集中用 Codex,如果你 2 点才发第一条消息,窗口要到 7 点才结束中间额度用完,就只能干等。但如果你上午 11 点先发一句“你好”,窗口就从 11 点开始算,下午 4 点额度刷新,你 2 点到 6 点这段时间,就能吃到两个窗口期。别等Codex额度用完才想起滚动窗口
- 这个玩法还可以交给自动化处理,在左边栏找到“自动化”,新建一个每天触发的任务,时间设成你开始干活前 3 小时,随便发一句消息即可。
- 等等。
其它
- IDE 扩展会自动将您打开的文件包含在上下文中。在命令行界面 (CLI) 中,您通常需要显式指定路径(或者使用
/mention附加文件,并使用@ path自动补全)。 - 使用 PLANS.md 模板: 对于更高级的工作流程,您可以配置 Codex 以遵循
PLANS.md或执行计划模板,从而处理耗时更长或包含多个步骤的任务。更多详情,请参阅执行计划指南。 - 工作流程稳定后,您可以设置 Codex 在后台自动运行。在 Codex 应用中,自动化功能允许您为重复性任务选择项目、提示、频率和执行环境。
- 上下文窗口满了怎么办?开始新会话(/new),或让 Codex 自动压缩历史记录。
- 发现windows powershell (也就是5.1)默认编码不是utf-8,大模型总是要读两遍后,手动升级到了 powershell (7.6)并设置为 UTF-8 编码为默认。codex的windows桌面版真的只有在wsl中才是“满血”,才有最佳体验吗?
- 如果使用的是 Powershell 5.x 建议升级到 Powershell 7.x,对 UTF-8 支持会更好。修改 Powershell 7 默认编码为 UTF-8