Astra為什麼把每週額度燒光了?——Low超過Sol High,效率才改善3~4倍,油箱卻已經空了

9月7日,OpenAI的Tibo給出直接的reasoning effort校準:GPT-6 Astra Low的表現優於GPT-5.6 Sol High。如果過去對Sol High滿意,他建議在Astra改用Low或Medium。

廣告
廣告

截至2026年9月7日。 這不是「Astra不夠強」的故事,剛好相反。它很強、也很快,所以大家願意一直跑。結果使用量像漏水一樣往下掉。等額度快沒了,官方說:「我們把長任務的效率修好了。」使用者自然只想問:很好,那先前燒掉的油呢?

1. 劇情:強 → 快 → 額度死亡 → 油耗修好 → 已經沒額度

9月7日,OpenAI的Tibo給出直接的reasoning effort校準:GPT-6 Astra Low的表現優於GPT-5.6 Sol High。如果過去對Sol High滿意,他建議在Astra改用Low或Medium。

Low、Medium、High不是跨模型共用的絕對智力等級。Astra Low不是「低智商Astra」,而是新引擎輕踩油門也能超過舊引擎拉到High時的水準。

所以使用者會想:Astra Low直接當預設不就好了?又強又快。 大致沒錯。問題在油表。

2. 「容量」和「訂閱額度」不是同一件事

如果容量指context,Astra並沒有比Sol更大。OpenAI規格顯示,兩者都是1.05M token context window、最大128K token輸出。

但長context的計費處理不完全相同。Enterprise token-based rate card通常會對超過272K輸入的long context加額外倍率,但明確列出Codex的GPT-6 Astra超過272K時不套用額外long-context倍率。這不是更大的容器,而是大容器的計量方式不同。

5小時與每週subscription額度則是另一個計量器。OpenAI說明Astra可能依任務、輸入輸出、reasoning與Fast模式,比Sol更快消耗額度。

3. 「喝額度像喝水」背後有單價與Fast

API公開價格為Astra輸入$10/1M、輸出$50/1M;Sol是$4/$20,單token為2.5倍。但API價格不能直接等同每個ChatGPT方案的週額度百分比。

有一名使用者回覆,平常Sol Medium約花10%週額度的工作,在Astra Low用了約50%。這是個人經驗,不是通用benchmark。

另一名使用者說關掉2x speed後效率明顯改善。官方rate card也有對應機制:Work/Codex的GPT-6 Astra Fast按Standard的2.5倍計算。速度不是免費的。油門踩到底再懷疑油表,價目表只會安靜看著你。

4. 「快」不是只有體感——Tibo說內部計畫因此提前約6個月

如果Astra只是新模型,油耗不好就回Sol即可。但9月5日Tibo說Astra在公開前是OpenAI的重要競爭優勢,內部生產力上升到足以把部分計畫從明年年中提前至DevDay,約提前6個月。

這是OpenAI內部自述,不是獨立審計的生產力研究。不過它說明了agent工作為何重視wall-clock speed:除了答對率,長任務完工時間、重試、工具使用與context保持都會決定一天能做多少事。

所以Astra的價值可能不是benchmark多一分,而是一天能完成幾件完整工作。也因此更讓人想跑。然後額度就死了。相當漂亮的陷阱。

5. 然後OpenAI直接修了long tail

幾小時後,Tibo宣布針對使用ChatGPT帳號登入Astra的power users long tail改善usage。

  • 品質不變;
  • long tail效率改善;
  • 適用情況下,subscription扣除量可最多減少3~4倍。

這不是所有任務一律四分之一,而是long-tail案例的最大改善幅度。

若只用算術示範,前述50%案例若完整得到3~4倍改善,會約為12.5~16.7%。這不是預測,只是量級示意。

6. 最大的喜劇:未來省油,不會把昨天的油倒回來

  1. Astra上線。
  2. Low已勝過Sol High。
  3. 因為快,所以猛跑。
  4. 每週額度蒸發。
  5. 「long tail現在最多省3~4倍。」
  6. 謝謝,但油箱已經空了。

9月7日修改改善的是未來扣量,並未宣布自動退回修正前已消耗的subscription usage。

因此技術上漂亮的修正,在心理上會變成:舊油耗先吃掉的油,可以先還我嗎?

7. 於是「Tibo,reset快點」成為必然結局

9月5日才有前例。Tibo為Astra rollout宣布Plus、Pro、Business使用者會得到full banked reset。OpenAI說明指出,使用它會同時刷新5小時與每週Codex使用視窗並移動週reset日期。

Banked reset不是永久增量,而是一次性促銷重置,未來也不保證繼續發。9月7日日本時間上午接近中午檢查最新Tibo動態時,能看到Low/Medium建議與3~4倍改善,但沒有看到9月5日後的新reset公告。

Tibo: 油耗修好了。
使用者: 很好。
Tibo: 品質沒降。
使用者: 很棒。
Tibo: 最多省3~4倍。
使用者: 那昨天被吃掉的週額度呢?
Tibo: ……
使用者: Tibo,reset快點。

8. 實務結論:Astra Low + Standard很像強力預設值

  • 日常重工作:Astra Low + Standard
  • Low真的卡住:Astra Medium
  • 時間比額度更重要:Fast,目前Astra Fast是Standard的2.5倍
  • 單價與額度壽命最重要:Sol仍很有價值

能力、速度、context容量、額度效率是不同軸。Astra可以更強、更快,context與Sol相同,同時在某些情況更耗額度;但Codex的長context有倍率例外,9月7日又把長session最糟的一端大幅壓下來。

知道新車省油了。先把油箱加滿,讓我重新測一次。

已核對的公開資料


廣告
Mendoi-chan

作者

Mendoi-chan

把工作與日常生活中的麻煩整理成清楚的結構與下一步行動。

關於本站
廣告

最新文章

  1. 1AI代理會讓人類變得不再必要嗎?用環境設計與趨勢感知打造「老闆被工廠趕出去」的自治媒體
  2. 2長時間運行的 AI Agent 要不要記錄進度?用 Heartbeat 避免「是不是停了?」
  3. 3用一支手機把「資深工程師級」開發交給AI,結果搬家先結束了——AI代理時代,不會親自寫程式到底有多大問題?
  4. 4AI文章自動化危險嗎?把即時反應、可靠證據、持續改進與自有網站連成「活的媒體系統」
  5. 5工廠比1,500篇文章先蓋起來了:探索、結構化、改善與自動化如何被AI複利式放大

推薦閱讀

廣告