AONIR JOURNAL

Codex 桌面版怎么用:从打开项目到审查第一份改动

大家常说的“Codex 桌面版”,是 ChatGPT 桌面应用里的 Codex 工作区。它真正有用的地方不是一次生成多少代码,而是能在同一个项目里连续完成阅读、修改、运行检查和交付差异。新手先用 Local 做一件能复现、能验收的小修复;看懂 Review 后,再把并行任务交给 Worktree,把环境可复现的远程任务交给 Cloud。

Codex 桌面版任务输入区以及 Local、Worktree、Cloud 三种运行环境选项点击查看大图
IMAGE VIEWER

Codex 桌面版任务输入区以及 Local、Worktree、Cloud 三种运行环境选项

1588 × 812
FIG. 01

新建 Codex 任务时,可以选择 Local、Worktree 或 Cloud 运行环境。

开始阅读
THE ESSENTIALS

先别研究模型,先把这条工作链跑通

  1. 第一次用 Local,并且只打开具体项目目录;不要把桌面或个人主目录当工作区。

  2. 开始前先看 git status。Review 会显示整个 Git 工作区的变化,不只显示 Codex 本轮修改。

  3. 任务写清目标、复现方式、不能动的边界和验收命令,不需要“你是世界级工程师”这类角色包装。

  4. 总结只能告诉你 Codex 认为自己做完了;差异、终端输出和实际页面才是证据。

  5. Worktree 用来隔离本机并行工作,Cloud 用来运行环境可复现的远程任务;它们都不是更强的模型档位。

AT A GLANCE

三种环境的差别,不在“聪明程度”

选择环境,本质上是在选择代码放在哪里、你怎样验收,以及出了问题能不能复现。

左右滑动查看完整表格

环境它实际修改哪里什么时候用真实代价
Local当前本地检出目录你在电脑前,需要马上预览、调试或运行本机服务会和已有未提交改动处在同一个 Git 工作区
Worktree电脑上的另一份 Git 检出目录后台或并行任务,想先隔离修改再决定是否接回 Local只支持 Git 项目;依赖和被忽略的本地文件可能缺失
CloudOpenAI 托管容器中的仓库副本仓库状态可远程取得、安装步骤清楚、适合离线交付的任务看不到未推送的本机状态;需要配置环境,代理执行阶段默认无网络

先说人话:Codex 桌面版到底替你做什么

普通聊天最常见的用法,是贴一段代码、拿到一段建议,再由你自己搬回项目。Codex 的不同不在于“回答更像程序员”,而在于它可以围绕一个真实目录连续工作:先读项目规则和相关文件,再修改、运行命令、查看结果,最后把差异留给你处理。

这条工作链才是桌面版的价值。比如修复一个手机端横向滚动问题,真正费时间的往往不是写两行 CSS,而是找到溢出的元素、确认桌面端不受影响、运行构建、查看改动范围,再处理审查意见。Codex 可以把这些步骤串起来,但接受哪一行代码、是否提交和何时发布,仍然是你的决定。

打开项目后,先做两分钟准备

只打开这次要处理的项目目录,不要直接选择桌面、下载目录或个人主目录。项目边界越清楚,Codex 越不容易读到无关文件,你也越容易判断一次权限请求是否合理。

接着看一眼 git status。这个动作很朴素,却能避免最常见的误会:桌面版 Review 展示的是当前 Git 工作区里的全部变化,包括你自己原来没提交的修改,并不只统计 Codex 本轮写下的内容。已有工作如果重要,先保存、提交,或者至少记清哪些文件本来就脏。

  • 问题能否稳定复现;如果可以,记下最短复现步骤。
  • 项目实际使用什么测试、构建或预览命令。
  • 哪些文件、接口、数据或现有改动绝对不能碰。
  • 完成后你准备用页面、测试结果还是代码差异验收。
需要协助配置 Codex?了解部署服务

第一个任务,别让它“随便做个网站”

让 Codex 从空目录生成一个落地页,看起来很惊艳,却几乎测不出它是否理解真实项目。更好的第一次任务,是修一个你已经能看到、结果只有“通过”或“没通过”的小问题。选择 Local,因为你需要用现有浏览器、开发服务器和本机环境马上验收。

下面这段可以直接改成自己的任务。它没有角色扮演,也没有要求“深度思考”;每句话都在减少跑偏空间。

  • 目标:修复 375px 宽度下出现的横向滚动。
  • 复现:运行现有开发服务器,打开指定页面,把视口调到 375px。
  • 先做:找出真正溢出的元素并说明原因,确认后再修改。
  • 边界:不要改变桌面布局,不新增依赖,不顺手重构无关组件。
  • 完成:运行项目现有构建和相关测试;最后列出改动文件、执行过的命令,以及仍需人工查看的地方。

它工作时,盯住权限、证据和跑偏信号

第一次保持默认权限就够了。正常的小修复通常只需要读写项目目录、运行本地命令;如果它突然要求访问项目外目录、开启网络或执行高风险命令,先看清理由,不要因为想让任务继续就一律允许。官方的默认沙箱本来就是为了把写入范围限制在工作区,并在越界时停下来询问。

一个靠谱的执行过程通常能看到几类证据:它读了项目规则和相关文件,找到了复现路径,修改范围不大,并且实际运行了检查。相反,如果还没定位原因就开始批量改文件、为了一个小问题新增依赖,或者反复宣称“已修复”却拿不出命令输出,就应该立即用后续消息把它拉回来。

  • 权限请求与任务有关吗?能否只批准这一次,而不是永久放宽。
  • 读取的文件是否围绕问题,还是开始扫描无关目录。
  • 新增依赖是否真的必要,现有工具能否完成。
  • 测试或构建是确实执行了,还是只在最终总结里写了“应该通过”。

Review 不是“看起来差不多”:按这个顺序查

任务结束后先忽略那段流畅的总结,打开 Review,从文件列表开始看。第一问不是“代码优不优雅”,而是“它为什么动了这些文件”。范围不对,后面的实现再漂亮也不值得继续审。

Review 面板可以查看未暂存、已暂存、提交、分支或最近一轮的差异,也可以按文件或代码块暂存、撤回。对具体一行有疑问时,直接留下行内评论,再发送“处理这些评论,保持改动范围不变”,通常比重新描述整个任务更精准。

  • 范围:是否只改了任务需要的文件,有没有顺手格式化或重构一大片。
  • 行为:删掉的判断、错误处理和兼容逻辑是否仍然需要。
  • 证据:测试、类型检查、构建和页面验证分别运行了什么,结果是什么。
  • 残留:调试日志、临时文件、无用依赖和被跳过的检查是否还在。

Worktree 真正有用的时刻:你还要继续干自己的事

Worktree 不是“更安全的 Local”按钮,而是同一个 Git 仓库的另一份检出目录。它最适合这种场景:你正在 Local 启动开发服务器和改当前功能,同时想让 Codex 在后台尝试另一个独立任务。完成后可以留在 Worktree 创建分支,也可以使用 Handoff 把聊天和代码接回 Local。

第一次用 Worktree 最常见的失败不是 Codex 不会写,而是项目根本跑不起来。新的检出目录可能没有 node_modules,也不会自动拥有被 Git 忽略的 .env 文件。把安装和初始化命令写进本地环境的 setup script;确实需要复制的忽略文件,可以谨慎列进 .worktreeinclude。不要为了省事把整个密钥目录都复制过去。

Cloud 不是更强的 Local,它只是在别处运行

Cloud 会在 OpenAI 托管的容器中检出你选择的仓库分支或提交,运行 setup script,然后让代理修改和验证代码。它不会看到你电脑上尚未推送的文件,也不会继承一个只能在你本机复现的临时状态。代理阶段的网络访问默认关闭,需要时必须在环境中明确配置。

因此,Cloud 适合输入和验收都能从仓库重建的任务,例如运行完整测试、处理明确的 CI 失败、做范围清楚的跨文件修改。依赖本地数据库、未提交素材、已登录浏览器或只在你电脑上出现的问题,先留在 Local;否则你会花更多时间解释环境,而不是解决问题。

  • 适合:仓库已推送,安装命令明确,任务可以通过测试或差异验收。
  • 不适合:问题只在本机出现,依赖未提交文件、个人登录状态或特殊硬件。
  • 先确认:运行时版本、setup script、必要环境变量和网络白名单都已配置。

做到第三个任务,再写 AGENTS.md

很多新手一开始就折腾模型、Skills、MCP 和自动化,结果项目本身连测试命令都没告诉 Codex。更有效的顺序是先做两三个真实任务,记录它重复犯的错误,再把稳定规则写进 AGENTS.md。这个文件会自动进入 Codex 的项目上下文,内容越具体越有用。

不要写“保持高质量”“认真思考”这类无法验收的口号。写清目录、命令、边界和完成定义。只有一套流程已经手动跑通多次,才值得整理成 Skill;只有任务不需要你临场判断,才考虑定时运行。

  • 项目从哪个目录运行,哪些目录只是生成物。
  • 测试、构建、格式化和本地预览分别使用什么命令。
  • 哪些接口、迁移、密钥文件或用户已有改动不能擅自碰。
  • 任务结束前必须检查什么,最终汇报需要包含哪些证据。

Free / Go 能不能用:先看任务规模与额度

OpenAI 当前把 Codex 纳入 Free、Go、Plus、Pro、Business、Edu 和 Enterprise。官方将 Free 定位为体验快速编程任务,将 Go 定位为轻量编程任务;是否需要升级,应该看真实任务规模与额度是否够用,而不是因为看到 Codex 就先付费。

先完成三个真实任务:一个小修复、一次测试补充、一次只读代码审查。如果工作链已经顺手,但任务经常在完成前被额度打断,再比较 Plus。Codex 的消耗会随任务大小和复杂度变化,并计入账号的 agentic 用量;部分 Plus / Pro 账户可以另购 credits,不能把它和 API 余额混为一谈。

升级只能改变可用额度和部分能力,不会替你补齐复现步骤、项目规则或验收标准。上下文混乱时,换更高套餐仍然会得到混乱的改动。

比较 ChatGPT Free、Plus 与 Pro
A FEW MORE THINGS

你可能还想知道

01Codex 桌面版是一个独立应用吗?

本文所说的“Codex 桌面版”,指 ChatGPT 桌面应用里的 Codex 工作区。打开桌面应用后选择 Codex,再打开本地项目并选择 Local、Worktree 或 Cloud。官方界面名称可能随版本调整。

02第一次使用 Codex 应该选 Local、Worktree 还是 Cloud?

通常先选 Local,因为你可以直接使用现有依赖、开发服务器和本机预览。需要让 Codex 在后台隔离修改时再用 Worktree;仓库已推送、环境可重建并且任务不依赖本机状态时,才考虑 Cloud。

03为什么项目在 Worktree 里跑不起来?

Worktree 是一份新的 Git 检出目录,通常不会自动拥有依赖目录,也不会复制被 Git 忽略的 .env 等本地文件。可以用桌面版本地环境的 setup script 安装依赖,并通过 .worktreeinclude 只复制确实需要的忽略文件。

04Review 面板只显示 Codex 修改的代码吗?

不是。Review 反映的是当前 Git 仓库状态,也会包含你自己或其他工具留下的未提交修改。开始任务前先检查 git status;审查时可切换未暂存、已暂存、提交、分支或最近一轮的差异。

05ChatGPT 免费版可以使用 Codex 吗?

可以。OpenAI 当前计划页已把 Codex 列入 Free 和 Go:Free 适合快速编程任务,Go 适合轻量编程任务。先用现有额度完成几个真实任务;只有额度开始打断稳定工作时,再比较 Plus。

BEHIND THIS GUIDE

有据可查,方便追溯

编辑说明

本文于 2026 年 8 月 30 日重新核对 OpenAI Codex 官方手册与计划说明。文中的“Codex 桌面版”指 ChatGPT 桌面应用里的 Codex 工作区;Free / Go 当前也包含 Codex,界面名称、额度与功能范围以文末官方文档和你的实际账号为准。

  1. OpenAI:Codex 的 Local、Worktree 与 Cloud 环境
  2. OpenAI:Worktree、Handoff 与忽略文件
  3. OpenAI:本地环境、Setup Script 与 Actions
  4. OpenAI:Review 面板与代码审查
  5. OpenAI:Cloud 环境如何运行
  6. OpenAI:Codex 安全、沙箱与权限审批
  7. OpenAI:Codex 使用习惯与 AGENTS.md
  8. OpenAI:Codex 各计划与使用定位