选择模型
点击输入框右下方的模型名称。展开“高级”后,可以分别选择模型、推理强度和速度。
| 模型 | 怎样选 |
|---|---|
| 5.6 Sol | 需求还不明确、分析复杂、需要反复判断或打磨质量的任务。 |
| 5.6 Terra | 日常工作,兼顾能力、速度和成本。 |
| 5.6 Luna | 要求清楚、重复性强的提取、分类、格式转换等任务。 |
不确定时可以从默认模型开始。不要只用一次回答,就判断某个模型在所有任务上都好或都差。
推理强度与速度
这两个设置不是一回事。
- 推理强度:决定模型在回答前投入多少推理。复杂任务可以调高,但通常更慢、用量也更多。先用默认强度,遇到需要深入分析的问题再提高。
- 速度:标准、快速等选项控制服务速度。快速模式可能有额外用量成本,以菜单提示为准,并不等于换了一个更聪明的模型。
选完后,看输入框下方是否显示了你要的模型和强度。
查看剩余用量
点击左下角账号菜单,展开“剩余用量”,可以看到当前可用的额度窗口。也可以到“设置 → 使用情况和计费”查看。
5 小时额度与周额度需要分别看。达到其中一个限制,就可能暂时无法继续;恢复时间以界面显示为准,不能理解成“明天一定全部恢复”。
同一账号在不同聊天里工作,并不会各自获得一套独立额度。长任务、较高推理强度和更大的上下文,都可能增加消耗。
上下文压缩
聊天越来越长时,Codex 可能自动压缩上下文,把前面的内容整理成摘要后继续。你也可以在输入框输入 /,从命令菜单寻找压缩上下文的入口。
压缩的是当前对话上下文,不是清空用量,也不是重置额度。压缩过程中等待它完成即可,不必反复发送同一句话。
需要长期遵守的要求,不要只埋在聊天里。通用偏好写进自定义指令,项目规则写进 AGENTS.md,第 8 章会讲。