‹ 返回笔记 · Back to notes

现场手记

第 1 章 · 1.10|推理强度、Max 与 Ultra

Chapter 01 · 1.10 — Reasoning effort, Max, and Ultra

不要把不同产品层的用语硬套成一条刻度。

ChatGPTCodex桌面端学习手册

CHAPTER 01 · 1.10

推理强度、Max 与 Ultra

新版推理强度、Max 与 Ultra 的边界
图 1-10 · DIA-01-V2-05。Light–Extra High、Max 与 Ultra 的当前层级边界(教学图,非实机截图)。

本节要回答: 轻、中、高、最高、极高、Max、Ultra 到底是不是同一条从低到高的刻度?

先给最重要的答案:不是一条唯一刻度

这一点必须讲清楚:新版桌面端的推理档、Max、Ultra 和 API 参数不是一张一一对应表。 你在中文界面里听到的“轻、中、高、极高、最高、Ultra”,先要问“它出现在哪个产品层”,不能直接排成一条全球通用的等级尺。

你可能看到的说法新版桌面端中的正确理解当前能严谨说明的区别初学者怎样用不要据此推断
轻 / Light当前桌面端、Work 与 IDE 的较低推理档;CLI 常写作 Low。适合范围清楚、快速、低成本的任务。用于短摘要、明确提取、已定义好的检查。“Light 就是所有产品中的 low,或一定是默认”。
中 / Medium当前模型控制中的平衡档。在速度与更深规划之间折中;官方建议先从默认 / Medium 起步。多约束整理、初步分析、第一次可验收任务。同名就必然是完全相同的内部参数。
高 / High当前模型控制中的较深推理档。适合多步骤、多个来源或有权衡的困难工作。出现可复现的遗漏、事实混淆或复杂代码解释失败时,再做同任务对照。所有任务都会因更高而更好。
极高 / Extra High当前模型控制中的最高常规推理档之一。继续给单个任务更多规划与检查空间。只在 High 的同任务对照仍显示明显推理不足时使用。它与 API 的 xhigh 天然一一对应,或任何账户都能看见。
最高 / Max单个所选模型的额外推理时间,不是 Extra High 的翻译。适合最难、质量远重于等待与用量的单一问题;若看不到,官方说明需要先在应用设置中启用。先用代表性难题与 Extra High 比一次,再决定是否值得。它是日常默认,或与 Ultra 相同。
Ultra使用多个子代理并行推进可拆分的复杂工作。它超出单代理“多想一会儿”的范围;适合可分成有意义子任务的大任务。只用于能说明子任务如何拆分、如何验收、为什么值得额外用量的工作。Ultra 等于 Max,或任何任务都适合开。

官方依据: Models 说明桌面端模型 / 推理控制、Light / Medium / High / Extra High 的用途、Max 与 Ultra 的差异,以及 Ultra 的设置入口。API 参数仍有自己的技术文档,但不能拿来替代桌面端菜单。

OpenAI 当前桌面端:推理档与工作状态控制
图 1-10A · CUR-01-12-01。当前官方桌面端演示在输入区右侧显示 Medium,并同时显示模型、权限和 Work locally。它只证明新版控制区的关系;截图中的 Medium 不是对你账户的推荐或可用性保证。

先记录原文,再做选择

如果你的界面显示的是“轻 / 中 / 高 / 极高 / 最高”而不是英文,学习记录应同时写下:应用产品(Chat、Work 还是 Codex)、原文标签、当前模型名、日期和任务类型。这样以后界面改名,仍能知道自己比较的是什么。

这张表直接回答“最高和极高有什么区别”:先分辨产品含义。 Extra High 仍是单一任务的常规推理档;Max 给单个所选模型更多推理时间;Ultra 用多个子代理处理可拆分工作。它们都可能消耗更多时间与用量,但不是同一个旋钮。

如果你看不到 Max,不要把“没有”当成安装故障或随便改配置;先核对当前设置、工作区与可用性。官方当前模型页把 Ultra 的可见开关写为 Settings > Configuration > Ultra in model picker slider。这只是入口事实,不是第 1 章建议你现在开启 Ultra 的理由。

为什么“更高”不等于“更好”

更长的推理通常会消耗更多时间和使用量。它可能让复杂问题的探索、验证和约束遵守更好,也可能只是让简单任务等待更久。当前桌面端模型指南建议从默认 / Medium 开始,只有任务需要更深规划或分析时再提高;Max 留给最难的单一问题,Ultra 留给可有意义拆分的大任务。Models

跟做:努力强度的选择阶梯

  1. 快速/默认: 概念解释、短摘要、检查清单、低风险草稿。目标是验证任务卡是否清楚。
  2. 中等: 需要理解多条约束、做结构化整理、做一次初步分析。先作为复杂任务的平衡起点。
  3. 高或更高: 已有证据显示任务因推理不足出现事实混淆、遗漏约束或复杂代码解释失败。
  4. Extra High / Max: 只在你能说明“问题很难、质量收益值得额外等待和用量”时试用;每次试用后留下一次对照记录。
  5. Ultra: 先写出可拆分的子问题、每个子问题的输出和最终人工验收点;否则不启用。

贯穿案例:不要一次改两个变量

给北岸读书会任务做对照时,以下两种做法的证据质量不同:

做法能得出什么不能得出什么
同模型、同提示,只从 Medium 改到 High。这一次更长推理有没有提高事实边界。另一个模型是否更好。
同时换 Sol、换 High、改提示、增加文件。只能得到一个新结果。质量变化由哪一个因素造成。

最小练习与验收

写一句“我什么时候才会从当前努力档提升”的规则。

参考答案示例: “只有同一任务出现可描述的事实错误或约束遗漏,并且我能用同一份材料、提示和验收表比较时,才提升一个努力档。” 常见误区:maxUltraExtra High 当成同义词,或把更高档当作永久默认。 下一节: 理解用量:推理档位的代价会在实际额度上体现。


把这篇记录接到下一步

读完以后,可以继续追问这篇文章,也可以回到策展目录,或通过标签追同一条线索。

追问这篇 回到目录 浏览标签