CCODEX 实战手册
2026.09 更新

CHAPTER 04 · 约 3 分钟

模型、用量与上下文

分清模型、推理强度和速度;看懂剩余额度与上下文压缩。

Windows 桌面版更新 · 2026-09-03点击截图可放大

选择模型

点击输入框右下方的模型名称。展开“高级”后,可以分别选择模型、推理强度和速度。

模型怎样选
5.6 Sol需求还不明确、分析复杂、需要反复判断或打磨质量的任务。
5.6 Terra日常工作,兼顾能力、速度和成本。
5.6 Luna要求清楚、重复性强的提取、分类、格式转换等任务。
模型与高级选项位置:输入框右下角的模型名称。菜单随版本更新,旧型号不代表当前仍可用。

不确定时可以从默认模型开始。不要只用一次回答,就判断某个模型在所有任务上都好或都差。

推理强度与速度

这两个设置不是一回事。

  • 推理强度:决定模型在回答前投入多少推理。复杂任务可以调高,但通常更慢、用量也更多。先用默认强度,遇到需要深入分析的问题再提高。
  • 速度:标准、快速等选项控制服务速度。快速模式可能有额外用量成本,以菜单提示为准,并不等于换了一个更聪明的模型。

选完后,看输入框下方是否显示了你要的模型和强度。

查看剩余用量

点击左下角账号菜单,展开“剩余用量”,可以看到当前可用的额度窗口。也可以到“设置 → 使用情况和计费”查看。

剩余用量中的两个窗口位置:左下角账号菜单 → 剩余用量。百分比和恢复时间以自己的账号为准。

5 小时额度与周额度需要分别看。达到其中一个限制,就可能暂时无法继续;恢复时间以界面显示为准,不能理解成“明天一定全部恢复”。

同一账号在不同聊天里工作,并不会各自获得一套独立额度。长任务、较高推理强度和更大的上下文,都可能增加消耗。

上下文压缩

聊天越来越长时,Codex 可能自动压缩上下文,把前面的内容整理成摘要后继续。你也可以在输入框输入 /,从命令菜单寻找压缩上下文的入口。

压缩的是当前对话上下文,不是清空用量,也不是重置额度。压缩过程中等待它完成即可,不必反复发送同一句话。

需要长期遵守的要求,不要只埋在聊天里。通用偏好写进自定义指令,项目规则写进 AGENTS.md,第 8 章会讲。

官方文档与延伸阅读