Astra为什么把每周额度烧光了?——Low超过Sol High,效率刚提升3~4倍,油箱却已经空了

9月7日,OpenAI的Tibo给出直接的reasoning effort校准:GPT-6 Astra Low的表现优于GPT-5.6 Sol High。如果以前用Sol High已经满意,他建议在Astra上用Low或Medium。

广告
广告

截至2026年9月7日。 这不是“Astra不够强”的故事,恰恰相反:它很强,也很快,所以大家愿意使劲用。然后使用量像漏水一样往下掉。等额度快没了,官方说:“我们把长任务的效率修好了。” 用户的第一反应自然是:很好,那之前烧掉的油呢?

1. 剧情:强 → 快 → 额度死亡 → 油耗修复 → 已经没额度

9月7日,OpenAI的Tibo给出直接的reasoning effort校准:GPT-6 Astra Low的表现优于GPT-5.6 Sol High。如果以前用Sol High已经满意,他建议在Astra上用Low或Medium。

Low、Medium、High不是跨模型统一的绝对智力等级。Astra Low不是“低智商Astra”,而是新引擎轻踩油门也能超过旧引擎拉到High时的水平。

所以用户会想:那Astra Low直接当默认不就完了?更强、更快。 基本没错。问题在油表。

2. “容量”和“订阅额度”不是一回事

如果容量指context,Astra并不比Sol更大。OpenAI规格显示,两者都是1.05M token上下文窗口、最大128K token输出。

但长上下文的计费处理并不完全相同。Enterprise token-based rate card通常对超过272K输入的long context设置额外倍率,同时明确写出:Codex中的GPT-6 Astra在超过272K时不收取额外long-context倍率。这不是容器更大,而是大容器的计量方式不同。

5小时与每周subscription额度则是另一块表。OpenAI说明,Astra可能因为任务、输入输出、reasoning和Fast模式而比Sol更快消耗额度。

3. “像喝水一样喝额度”背后有价格和Fast

API公开价格是Astra输入$10/1M、输出$50/1M;Sol是$4/$20,单token为2.5倍。但API价格不能直接当作所有ChatGPT周额度百分比的公式。

有用户说,平时Sol Medium约消耗10%周额度的工作,Astra Low用了约50%。这是个人体验,不是普遍benchmark。

另一个用户说关闭2x speed后效率明显改善。官方机制也支持这一点:Work/Codex当前rate card里,GPT-6 Astra Fast按Standard的2.5倍计算。速度不是免费的。油门踩到底再问油为什么少得快,价格表会安静地看着你。

4. “快”不只是感觉——Tibo说内部计划因此提前了约6个月

如果Astra只是新模型,油耗不好就换回Sol即可。但9月5日Tibo说,Astra在公开前是OpenAI的重要竞争优势,内部生产力提升到足以把部分计划从明年年中提前到DevDay,大约提前6个月。

这是OpenAI内部自述,不是独立审计的生产力研究。但它解释了为什么速度如此重要。Agent工作看得不只是单题正确率,还看长任务完工时间、重试次数、工具使用和context保持。

因此Astra的价值可能不是benchmark多一分,而是同一天能完成多少件完整工作。这就让人忍不住用。然后额度就没了。陷阱设计得相当优雅。

5. 然后OpenAI直接修了long tail

几小时后,Tibo宣布针对使用ChatGPT账号登录Astra的power users long tail改善usage。

  • 不降低质量;
  • long tail效率改善;
  • 适用情况下,subscription扣量可最多减少3~4倍。

这不代表所有任务一律变成四分之一,而是long-tail场景的最大改善。

只作算术说明:如果前面50%的案例完整获得3~4倍改善,会变成约12.5~16.7%。这不是预测或保证,只表示修复量级。

6. 最大的喜剧:未来省油,不会把昨天的油倒回来

  1. Astra上线。
  2. Low已经强过Sol High。
  3. 因为快,所以狠狠干。
  4. 周额度蒸发。
  5. “long tail现在最多省3~4倍。”
  6. 谢谢,但是油箱已经空了。

9月7日的调整改善的是未来扣量,并没有宣布自动恢复修复前已经消耗的subscription usage。

所以技术上优秀的修复会得到一个合理的人类反应:旧油耗先吃掉的油,能不能先还我?

7. 于是“蒂博,快重置”成为必然结局

9月5日刚有先例。为庆祝Astra上线,Tibo宣布给Plus、Pro、Business用户发full banked reset。OpenAI官方说明,使用它会同时刷新5小时和每周Codex使用窗口,并改变周重置日期。

Banked reset不是永久增量,而是一次性促销重置;未来继续发放并无保证。9月7日上午接近中午(日本时间)检查Tibo最新信息时,可以看到Low/Medium建议和3~4倍改善,但没有看到9月5日之后的新reset公告。

Tibo: 油耗修好了。
用户: 很好。
Tibo: 质量没降。
用户: 更好。
Tibo: 最多省3~4倍。
用户: 那昨天被吃掉的周额度呢?
Tibo: ……
用户: 蒂博,重置快点。

8. 实际使用结论:Astra Low + Standard很像强力默认档

  • 日常重任务:Astra Low + Standard
  • Low真的过不去:Astra Medium
  • 时间比额度贵:Fast,当前Astra Fast按Standard的2.5倍计量
  • 单价和额度寿命优先:Sol依然有价值

能力、速度、context容量和额度效率是不同维度。Astra可以更强、更快,context和Sol一样,同时在某些情况下更耗额度;但它在Codex长context上有倍率例外,9月7日又大幅改善了长session最糟的一端。

知道新车省油了。请先给我加满一箱,让我重新测。

核对过的公开资料


广告
Mendoi-chan

作者

Mendoi-chan

把工作与日常生活中的麻烦整理成清晰的结构和下一步行动。

关于本站
广告

最新文章

  1. 1AI智能体会让人类变得不再必要吗?用环境设计和趋势感知打造“老板被工厂赶出去”的自治媒体
  2. 2长时间运行的 AI Agent 要不要记录进度?用 Heartbeat 避免“是不是停了?”
  3. 3用一部手机把“高级工程师级”的开发交给AI,结果搬家先结束了——AI代理时代,不会亲自写代码到底有多大问题?
  4. 4AI文章自动化危险吗?把实时反应、可靠证据、持续改进和自有网站连成“活的媒体系统”
  5. 5工厂比1,500篇文章先建起来了:探索、结构化、改进和自动化如何被AI复利式放大

推荐阅读

广告