Codex 能在工作中切换模型吗?——避免 GPT-6 Astra 一口气烧光周额度的“只让 Astra 做探索”方案

阅读功能说明

收听会朗读正文;速读会按顺序显示短语,速度可调。语言练习可对照已有的不同语言版本。收藏保存在本浏览器中,可从播放器的收藏列表再次打开。

分享这篇文章

分享这篇文章

广告
广告

GPT-6 Astra 很强,但“最强模型=所有任务都用它”并不一定是最好的用法。

OpenAI 明确说明,Work 与 Codex 的用量会受到模型、任务复杂度、上下文、推理设置、速度和工具调用等因素影响,而且 Astra 可能比 GPT-5.6 Sol 更快消耗套餐内额度。[1][2]

Codex 提供 /model,可以选择当前使用的模型和推理强度。[3]

但要注意:它不是在一个已经运行的 turn 中把 Astra 实时热切换成 Sol。 “在提示词执行期间切换模型,并让下一条排队提示使用新模型”曾被作为单独的功能请求讨论。[4]

所以实际操作更接近:

先用 Sol → 当前 turn 结束 → 遇到难点切到 Astra → 解决 → 再切回 Sol。

1. 能切换模型,不等于自动路由

/model能让你选模型和推理强度。[3] 但这不代表 Codex 会自动替你判断:小改动用 Luna、普通实现用 Sol、未知故障用 Astra、方向确定后再自动回 Sol。

让 Astra 修 README 里的一个标点,差不多等于开 F1 赛车去买牛奶。能做到,但没必要天天这么干。

2. 为什么 Astra 容易快速消耗额度

截至 2026 年 9 月 6 日,OpenAI 官方 API 价格如下。[5]

模型 输入/100万 token 输出/100万 token
GPT-6 Astra $10 $50
GPT-5.6 Sol $4 $20
GPT-5.6 Terra $2 $12
GPT-5.6 Luna $0.20 $1.20

Astra 的 API 单价是 Sol 的 2.5 倍。但不能据此推导“ChatGPT 周额度一定以 2.5 倍速度下降”。套餐内 Work/Codex 额度与 API 计费不是同一个概念,实际消耗还取决于任务复杂度、上下文、推理、速度与工具调用等。[1][2]

3. Astra 最值得用在“探索”

最适合 Astra 的不是单纯“大任务”,而是一开始不知道答案的任务:

  • 对未知故障提出多个竞争假设
  • 从整个仓库中推断结构性问题
  • 找到反复出现 bug 的共同原因
  • 从大量候选中筛选最值得验证的方向
  • 根据失败日志设计下一轮实验
  • 比较复杂架构取舍并做最终判断

OpenAI 将 Astra 定位为面向复杂推理、编码、浏览、软件工程和多阶段工作流的最高能力模型。[6]

4. 最实用的是 Sol → Astra → Sol

第一步,用 Sol/Terra/Luna 便宜地收集文件、日志、测试结果和候选位置。

第二步,把信息压缩后交给 Astra,例如:“剩 7 个候选,3 种修复已经失败,根据这些日志给下一轮假设排序。”

第三步,再让 Sol/Terra 执行大量测试、实现和基准验证。

只有证据仍无法收敛时,再把结果交给 Astra 做第二轮探索。

这样 Astra 就不是逐个看 100 个文件的普通工人,而是证据准备好后才叫来的研究负责人。

5. 一个简单的模型分工

工作 优先模型
简单搜索、格式化、重复修改 Luna / Terra
常规实现、评审、普通 bug 修复 Sol
未知原因探索、复杂架构、假设生成、最终难题 Astra

核心不是“最聪明的模型包办一切”,而是只在 Astra 能真正改变决策质量的地方花 Astra 额度。

6. 不要只数消息,直接看用量

OpenAI 建议通过使用量面板确认到底是哪一个额度已耗尽、剩余信用和重置时间。Codex CLI 运行中也可使用 /status。[2]

某些 Agent 体验可能共享同一个使用量池,因此“我只发了几十条消息”并不是可靠的估算方式。[2]

7. “每天重置 Astra”目前不是标准机制

如果专门拿 Astra 做探索,最想要的当然是:每天早上自动满血。

但当前标准机制仍是包含 5 小时和周周期在内的显示额度窗口。[2]

符合条件的 Plus/Pro 个人账户可能看到付费即时周重置。购买后,5 小时与周额度都会立即恢复,但它不是额外赠送一周额度,而是把正常周额度提前;重置后的第一次 Work/Codex 请求会开启新的 7 天周期。[7]

部分用户还可能拥有可保存的重置,使用完整重置后同样会刷新两个窗口并改变下一次周重置日期。[8]

8. 还要检查 CLI 版本

Astra 目前要求 Codex CLI 0.153.0 或更新版本。[1]

9. 结论

Codex 可以在同一会话中切换模型,但正确理解是在 turn 之间根据任务切换,而不是把正在运行的 turn 实时换引擎。

最合理的用法是:

日常用 Sol,轻量重复工作用 Terra/Luna,探索、假设生成、未知故障、复杂设计和最终判断才用 Astra,用完马上切回。

真正重要的能力,不只是会用最强模型,还包括知道哪里根本不需要最强模型。


参考资料(8条)

  1. OpenAI Help Center — ChatGPT Work and Codex help.openai.com
  2. OpenAI Help Center — Using Codex with your ChatGPT plan / ChatGPTプランでCodexを使う help.openai.com
  3. openai/codex — codex-rs/tui/src/slash_command.rs (/model: choose model and reasoning effort) github.com
  4. openai/codex Issue #20842 — Switch model mid-prompt github.com
  5. OpenAI Developers — Models developers.openai.com
  6. OpenAI Developers — Model guidance / GPT-6 Astra developers.openai.com
  7. OpenAI Help Center — Paid weekly Work and Codex rate limit resets help.openai.com
  8. OpenAI Help Center — How banked Codex resets work help.openai.com

今天读这篇

每一篇都回答读完本文后常有的下一个问题。

浏览全部文章更多「AI」文章

分享这篇文章

广告

再来一篇?有没有好玩的?

读完顺便看看:几篇相近的,还有几篇完全不同但很有意思的。

  1. 平安贵族女性为什么很少轻易露脸用“家族账号”来理解
  2. 空调开到21℃还是热在丰桥约200年老店“きく宗”等了40分钟豆腐田乐,结果江户、昭和、令和全挤在同一栋房子里
  3. AURA原来是“微风”从《葬送的芙莉莲》的断头台阿乌拉,到情趣酒店的“日常已经不在了吧”
  4. 一次50万日元级的8天海外游,还是几十次好吃的?YouTube时代的“卡比式旅行”

查找其他文章

所有文章

Mendoi-chan

本站运营者

Mendoi-chan

把工作与日常生活中的麻烦整理成清晰的结构和下一步行动。