CHAPTER 02 · 2.1–2.4
教材版本:v1.0 · 官方资料核验:2026-08-13 · 当前界面与账号可用性以读者实际状态为准。
这一章不把 Codex 讲成一个“按下按钮就替你完成一切”的神奇工具。我们从一个普通人每天都可能遇到的小工作开始:有一份通知和一份零散记录,想知道哪些已经确定、哪些还缺答案、接下来要找谁确认。
你会跟着同一个虚构案例练习,但本章只做一次对话中的只读资料盘点。允许读的材料只有通知与要求.md、零散记录.md;明确不读取补充问题.md。Codex 只在对话中输出盘点结果,不创建、修改、追加、移动、重命名或删除任何文件,不联网,不访问目录外内容。
先导体验(不编号)
先不要背“Agent”“权限”“工作流”这些词。打开练习包,只提出一句普通问题:“哪些已经确定,哪些还没有答案?”然后要求 Codex 只读通知与要求.md、零散记录.md,在对话中列出已知信息、缺失信息、待确认问题和本次实际使用的文件。
你先观察三件事:它有没有只使用两份材料;它有没有把建议、猜测误写成事实;它有没有试图创建文件、联网或访问其他材料。此时不要追求答案漂亮,先追求范围清楚。等你看到一次“给材料—读材料—交结果—人核对”的过程,再回头给它取名字,这样“闭环”就不再是一个空术语。
2.1 本章要解决什么
官方来源: ChatGPT Work and Codex;Moving to the new ChatGPT desktop app;ChatGPT desktop app
本节要回答
Codex 和普通聊天究竟差在哪里?一次任务从愿望开始,经过哪些步骤才会变成可以检查的结果?本节先给出全章地图,后面每一节都只展开其中一部分。
先用白话解释
完整闭环可以写成:
用户目标 → Codex 理解与拆解 → 读取最小必要材料 → 提出问题或计划 → 在允许范围内执行 → 生成结果 → 人工验收 → 记录结论和下一步。
这里的“闭环”不是说 Codex 自己循环到永远,而是说一件事不能在“我发出一句话”和“它回了一段话”之间断掉。你要能回答:它看了什么、做了什么、得到了什么、谁判断可以用。
第一次出现五个词时,先不要用专业含义,直接翻成白话:
- 边界=这次可以看什么、能做什么、什么不能碰、遇到什么必须停。
- 材料=这次允许给 Codex 看的文字或文件。
- 动作=允许 Codex 做的事。
- 结果=得到的对话文字或文件,但不等于正确。
- 人工验收=人打开、对照原文、检查后决定通过、退回、待确认。
“边界”比“权限”更容易让初学者看懂,因为它同时包含允许和停止;“材料”不只指文件,也可以是你粘贴的文字,但必须能说明来源;“动作”要写动词,读取、创建、修改、联网和发送不是同一件事;“结果”是交付线索,不是事实保证;“人工验收”也不是点一下“完成”,而是人真正检查后作出判断。
本书的任务级人工范围确认属于教材方法 M:人在任务卡、任务指令或过程记录中确认本次输入、唯一目标输出、禁止项和停止点。它不是产品系统弹窗,产品也不保证在当前本地项目目录 内逐文件询问。这里的 本地项目目录 可以先理解为“这次被明确圈定的本地工作文件夹和工作范围”,不是整台电脑;系统权限提示只有实际出现时才按提示审阅,不能把教材方法画成产品会弹出的逐文件批准框。
你会看到/跟做
拿先导体验的两份材料做一张手写流程:
- 目标:弄清哪些已确定、哪些没有答案。
- 材料:通知与要求.md、零散记录.md。
- 动作:只读、分类、标注来源、列出缺口。
- 结果:对话中的盘点文字。
- 验收:人回到两份原文逐条核对。
不要在这一步创建“资料盘点.md”。本章的练习输出留在对话里;读者可以在项目外手工记学习笔记,但那不是 Codex 本次产物。
预期结果
完成本节后,你能用一句话说明闭环:“我给 Codex 两份指定材料,让它只读盘点并在对话中输出;我再回原文核对,不把它说完成当成验收。”如果你只能说“它帮我整理了”,说明目标、材料或验收还没有说清楚。
最小练习与验收
请在纸上写出五行:边界、材料、动作、结果、人工验收。每行都必须有本案例的具体内容,而不是写“按要求处理”。验收标准是:别人看到这五行,能知道不能读补充问题.md、不能联网、不能创建文件,也知道最后由谁对照原文。
常见误区(预警 / 补救 / 证据)
- 常见坑:把“有一段回答”当作闭环完成。预警:说不出本次实际读了哪些文件。最小补救/停止点:回到材料清单,暂停后续动作。复查证据:对话中列出两份文件,且原文核对点可定位。
- 常见坑:把教材方法 M 当成产品必然弹窗。预警:等待“每个文件批准”却没有真实系统提示。最小补救/停止点:改用任务级人工范围确认,不凭空等待或绘制弹窗。复查证据:任务说明写清输入、唯一输出和停止点。
下一节
下一节把 Chat、Work、Codex 放回官方当前说明中,先区分产品面,再决定这次普通资料盘点为什么适合用 Codex。
2.2 Chat、Work 与 Codex:工作方式上的根本区别
官方来源: ChatGPT Work and Codex;Moving to the new ChatGPT desktop app;ChatGPT desktop app
本节要回答
Chat、Work、Codex 是不是三个“能力等级”?为什么同一个账号在不同工作面看到的入口、历史或工具可能不同?为什么不能把一次界面记录观察写成所有读者都会看到的菜单?
先用白话解释
按 2026-08-13 官方核验批次的当前说明,Chat 偏快速问答和一般对话,Work 面向较长的研究、分析和可审阅交付物,Codex 面向软件开发与技术工作;新桌面端的 Chat、Work 位于 ChatGPT 下,Codex 有独立视图和历史。这个说明有条件:Work 是否出现、Codex 是否可用、入口长什么样,都可能受计划、工作区、角色、地区和当天版本影响。
因此不要把它们理解成“Chat 最弱、Work 中等、Codex 最强”。更实用的判断是:你现在要处理的是贴在对话里的文字,还是本地文件、连续任务和可追踪结果?如果只是解释一个概念,普通聊天够用;如果要在指定本地材料范围内推进任务并留下可核对线索,Codex 更合适;如果你的账号没有某个工作面,就不能靠教程文字把它“推导出来”。
本节的官方当前信息、教材方法 M 和界面记录必须分开。官方当前信息负责解释产品面;教材方法 M 负责说明怎样安全交代任务;界面记录只说明对应日期、版本、产品面和匿名账号条件下的观察。
你会看到/跟做
打开当前桌面端时,不要急着截图,先写四项观察记录:产品面名称、当前账号可见入口、历史是否分开、是否能看到本地项目或文件工作入口。界面记录记录必须标明核验日期、产品面和账号条件,不能写成通用菜单结论。

图 2-1 · CUR-02-02。当前官方公开界面素材,用于认识 Chat、Work 与 Codex 的产品面关系;具体入口以当前账号可见界面和官方来源为准。
如果看不到 Work,正确做法不是把 Work 从教程里删掉,也不是断言“所有账号都没有 Work”,而是记录“本账号、本计划、本工作区在该日期未见入口”,并回到官方页面重新核验适用条件。
预期结果
你能说清三层关系:官方产品面是条件性的;本书选择 Codex 是为了练习受范围约束的本地资料任务;界面记录只说明对应日期与条件。你不会再用“我看到了一个按钮”推出“所有人都有这个能力”。
最小练习与验收
写三句不带夸张的判断:
- “官方当前说明把 Chat、Work、Codex 分成不同工作面,但入口有条件。”
- “本书用 Codex 练习资料整理,是作者的学习安排,不是官方推荐所有人都这样做。”
- “界面记录只说明核验日期、产品面和条件,不能代替其他账号的观察。”
验收时检查每句是否包含条件,不要出现“必然”“所有账号”“自动拥有”。
常见误区(预警 / 补救 / 证据)
- 常见坑:把 Chat、Work、Codex 写成人人相同的固定菜单。预警:教程没有日期、版本、计划或工作区条件。最小补救/停止点:删掉具体按钮断言,保留官方文字和待实测标记。复查证据:来源标题、核验批次和账号条件分开记录。
- 常见坑:把 Codex 写成“自动操作整台电脑”。预警:任务没有输入范围或停止点。最小补救/停止点:回到五词表,明确材料和动作。复查证据:任务卡中只有指定输入和唯一目标。
下一节
知道该在哪个工作面之后,还要把“帮我整理一下”变成机器和人都能执行、也能验收的任务。
2.3 从用户需求到机器任务
官方来源: Permissions
本节要回答
为什么“帮我整理一下这些资料”听起来合理,却不够让 Codex 稳定工作?怎样把愿望变成目标、材料、禁止项、输出和验收都清楚的任务?
先用白话解释
模糊愿望通常缺五件事。第一,它没有告诉 Codex 整理到什么程度;第二,它没有列出允许读取的文件;第三,它没有说哪些动作禁止;第四,它没有规定交回什么;第五,它没有规定人怎么判断。
把本案例改写成任务,不需要复杂术语:
“只读通知与要求.md、零散记录.md,整理家庭资料整理入门活动中已经确定的信息、材料没有给出的信息和需要进一步确认的问题;每条事实标出来源;建议和猜测单独标记;不得读取补充问题.md,不得联网,不得访问目录外,不得创建或修改文件;只在对话中输出,最后列出本次实际使用的文件,供我回原文验收。”
这句话不是为了让 Codex 猜得更聪明,而是把人原本脑中的隐含要求变成可观察的约束。目标写“只读资料盘点”,比写“做成一个完整方案”更容易检查;材料写两个文件名,比写“看一下资料”更容易追责;输出写“对话四部分”,比写“给我一个结果”更不容易越界。
你会看到/跟做
先把模糊句拆成五列:
- 目标:回答哪些已确定、哪些缺失、哪些待确认。
- 材料:通知与要求.md、零散记录.md。
- 禁止项:不读补充问题.md;不联网;不访问目录外;不做文件动作。
- 输出:对话中的已知信息、缺失信息、待确认问题、实际使用文件。
- 人工验收:每条事实能回到原文,建议/猜测没有伪装成事实,材料名单准确。
再试着故意写一条错误任务:“请整理所有资料并顺便把活动方案写好。”你会发现它同时扩大了材料范围、改变了目标、增加了未授权决策,还没有告诉你怎么验收。把它改回只读盘点,才是本章的学习动作。
还可以做一个“删词检查”。把任务里的“全部”“顺便”“专业一点”“尽快”“合理安排”圈出来。这些词往往不是不能用,而是必须继续解释:全部是指哪几份材料,顺便增加了哪一种动作,专业的判断标准是什么,尽快有没有明确日期,合理安排由谁决定。没有解释的形容词和副词,会把选择权偷偷交给模型。初学者最稳妥的写法,是先把它们换成可观察的动作,例如“按原文分成已知、建议、猜测、待确认四栏”,而不是要求“整理得更专业”。
最后做一次反向阅读:假设你完全不知道这个活动,只看任务文字,能否回答“看什么、做什么、不做什么、交回什么、谁来判定”?如果其中一项要靠口头补充,任务还没有封口。反向阅读不是写作技巧,而是提前发现歧义的低成本验收;它能在 Codex 读取任何材料之前,阻止范围悄悄变大。
预期结果
一个陌生读者拿到任务文字,不需要询问“哪些文件”“要不要联网”“交文件还是交对话”“建议算不算事实”。如果仍需要大量口头补充,说明任务还停留在愿望阶段。
最小练习与验收
将下面三句各改一次,并保留改动理由:
- “帮我看看这两份材料。”
- “把它整理得专业一点。”
- “顺便查查网上有没有类似活动。”
验收要看:第一句补了目标和输出;第二句补了评价标准并避免无边界改写;第三句明确这是联网扩展,当前练习应停止而不是默认执行。
常见误区(预警 / 补救 / 证据)
- 常见坑:目标从盘点滑成方案决策。预警:出现“确定时间、人数、负责人”但材料没有这些事实。最小补救/停止点:停止补写,把未知改成待确认。复查证据:输出中能指向原文,缺失项没有新数字。
- 常见坑:把“所有资料”当材料范围。预警:Codex询问是否扫描整个文件夹。最小补救/停止点:只给两份白名单,明确不读第三份。复查证据:实际使用文件只有两行。
下一节
任务写清楚后,Codex 会先理解、追问或给出计划;下一节说明这三种表现分别意味着什么,以及为什么模型名称不等于质量。
2.4 Codex 先做什么:理解、追问、计划
官方来源: Models;Model guidance(API)
本节要回答
Codex 什么时候可以直接读,什么时候应该先问,什么时候要先给计划?看到模型名称、推理档位或一段计划时,为什么仍然不能跳过验收?
先用白话解释
一次任务开始时,Codex 可能出现三种正常反应:
- 任务足够清楚,它直接说明将读取哪些材料并开始只读处理。
- 关键条件缺失,它先追问,例如“输出留在对话还是写文件?”“是否允许读取第三份材料?”
- 任务有多个阶段或外部风险,它先给计划,让人确认顺序和停止点。
这三种反应没有谁天然更高级。关键是它有没有把不确定性说出来。计划是一张路线图,不是已经走完的路;理解是一种解释,不是材料核对;追问是一种暂停,不代表任务已经完成。
模型和推理档位也不能替代这三件事。官方当前 Models 页面说明,可见模型和推理强度会随产品面、账号、计划、工作区设置和实际可用性变化。模型名称与推理强度是两个不同选择;更高的推理强度可能增加分析时间和资源消耗,但不保证事实正确,也不能替代来源核对和人工验收。
你会看到/跟做
分别给同一个任务加三种起始指令:
- 直接处理:“范围已锁定,只读两份文件,先列出你实际会使用的材料。”
- 先追问:“在开始前,请只问会改变材料范围、输出形式或停止点的问题。”
- 先计划:“请给出三步只读计划,每步写输入、动作和停止条件,不执行文件动作。”
观察 Codex 是否遵守“只问必要问题”“计划不扩大范围”“不把模型选择当质量证明”。涉及产品能力时,以页面所列官方来源和当前实际界面为准。
图 2-2 · DIA-02-04。教学图,说明模型与推理档位是不同的选择;非产品界面。
预期结果
你能把“我看到一个计划”解释为过程线索,把“我看到一个模型名称”解释为可见选择,把“我得到一段结果”解释为待验收产物。你不会因为模型叫某个名字、推理档位很高,就放弃回原文核对。
最小练习与验收
写一段计划,必须包含“读取两份材料—分类信息—标出缺失—对话输出—人回原文核对”五步。然后在计划下写一句“计划不是完成,模型选择不是验收”。验收标准是计划提出的范围不包含写入文件、联网或扫描目录外;实际是否发生这些动作,仍由人核对本次可见输入、工具活动和真实系统提示,缺少证据标待确认。
常见误区(预警 / 补救 / 证据)
- 常见坑:把长计划当完成。预警:计划很完整,却没有任何实际使用文件和原文证据。最小补救/停止点:要求先停在计划,重新确认材料和输出。复查证据:计划与最终实际动作逐项对照。
- 常见坑:把某种模型分工写成官方通用推荐。预警:把个人工作方法写成所有读者都必须使用的菜单或流程。最小补救/停止点:回到当前可见模型、任务风险和人工验收。复查证据:官方能力与个人方法分开说明。
下一节
计划确定后,最常见的问题是“材料到底从哪里来”。下一节把粘贴、附件、ChatGPT 项目 和本地 project 分开。