截至2026年9月7日。 這不是「Astra不夠強」的故事,剛好相反。它很強、也很快,所以大家願意一直跑。結果使用量像漏水一樣往下掉。等額度快沒了,官方說:「我們把長任務的效率修好了。」使用者自然只想問:很好,那先前燒掉的油呢?
1. 劇情:強 → 快 → 額度死亡 → 油耗修好 → 已經沒額度
9月7日,OpenAI的Tibo給出直接的reasoning effort校準:GPT-6 Astra Low的表現優於GPT-5.6 Sol High。如果過去對Sol High滿意,他建議在Astra改用Low或Medium。
Low、Medium、High不是跨模型共用的絕對智力等級。Astra Low不是「低智商Astra」,而是新引擎輕踩油門也能超過舊引擎拉到High時的水準。
所以使用者會想:Astra Low直接當預設不就好了?又強又快。 大致沒錯。問題在油表。
2. 「容量」和「訂閱額度」不是同一件事
如果容量指context,Astra並沒有比Sol更大。OpenAI規格顯示,兩者都是1.05M token context window、最大128K token輸出。
但長context的計費處理不完全相同。Enterprise token-based rate card通常會對超過272K輸入的long context加額外倍率,但明確列出Codex的GPT-6 Astra超過272K時不套用額外long-context倍率。這不是更大的容器,而是大容器的計量方式不同。
5小時與每週subscription額度則是另一個計量器。OpenAI說明Astra可能依任務、輸入輸出、reasoning與Fast模式,比Sol更快消耗額度。
3. 「喝額度像喝水」背後有單價與Fast
API公開價格為Astra輸入$10/1M、輸出$50/1M;Sol是$4/$20,單token為2.5倍。但API價格不能直接等同每個ChatGPT方案的週額度百分比。
有一名使用者回覆,平常Sol Medium約花10%週額度的工作,在Astra Low用了約50%。這是個人經驗,不是通用benchmark。
另一名使用者說關掉2x speed後效率明顯改善。官方rate card也有對應機制:Work/Codex的GPT-6 Astra Fast按Standard的2.5倍計算。速度不是免費的。油門踩到底再懷疑油表,價目表只會安靜看著你。
4. 「快」不是只有體感——Tibo說內部計畫因此提前約6個月
如果Astra只是新模型,油耗不好就回Sol即可。但9月5日Tibo說Astra在公開前是OpenAI的重要競爭優勢,內部生產力上升到足以把部分計畫從明年年中提前至DevDay,約提前6個月。
這是OpenAI內部自述,不是獨立審計的生產力研究。不過它說明了agent工作為何重視wall-clock speed:除了答對率,長任務完工時間、重試、工具使用與context保持都會決定一天能做多少事。
所以Astra的價值可能不是benchmark多一分,而是一天能完成幾件完整工作。也因此更讓人想跑。然後額度就死了。相當漂亮的陷阱。
5. 然後OpenAI直接修了long tail
幾小時後,Tibo宣布針對使用ChatGPT帳號登入Astra的power users long tail改善usage。
- 品質不變;
- long tail效率改善;
- 適用情況下,subscription扣除量可最多減少3~4倍。
這不是所有任務一律四分之一,而是long-tail案例的最大改善幅度。
若只用算術示範,前述50%案例若完整得到3~4倍改善,會約為12.5~16.7%。這不是預測,只是量級示意。
6. 最大的喜劇:未來省油,不會把昨天的油倒回來
- Astra上線。
- Low已勝過Sol High。
- 因為快,所以猛跑。
- 每週額度蒸發。
- 「long tail現在最多省3~4倍。」
- 謝謝,但油箱已經空了。
9月7日修改改善的是未來扣量,並未宣布自動退回修正前已消耗的subscription usage。
因此技術上漂亮的修正,在心理上會變成:舊油耗先吃掉的油,可以先還我嗎?
7. 於是「Tibo,reset快點」成為必然結局
9月5日才有前例。Tibo為Astra rollout宣布Plus、Pro、Business使用者會得到full banked reset。OpenAI說明指出,使用它會同時刷新5小時與每週Codex使用視窗並移動週reset日期。
Banked reset不是永久增量,而是一次性促銷重置,未來也不保證繼續發。9月7日日本時間上午接近中午檢查最新Tibo動態時,能看到Low/Medium建議與3~4倍改善,但沒有看到9月5日後的新reset公告。
Tibo: 油耗修好了。
使用者: 很好。
Tibo: 品質沒降。
使用者: 很棒。
Tibo: 最多省3~4倍。
使用者: 那昨天被吃掉的週額度呢?
Tibo: ……
使用者: Tibo,reset快點。
8. 實務結論:Astra Low + Standard很像強力預設值
- 日常重工作:Astra Low + Standard
- Low真的卡住:Astra Medium
- 時間比額度更重要:Fast,目前Astra Fast是Standard的2.5倍
- 單價與額度壽命最重要:Sol仍很有價值
能力、速度、context容量、額度效率是不同軸。Astra可以更強、更快,context與Sol相同,同時在某些情況更耗額度;但Codex的長context有倍率例外,9月7日又把長session最糟的一端大幅壓下來。
知道新車省油了。先把油箱加滿,讓我重新測一次。
已核對的公開資料
- OpenAI Models: https://developers.openai.com/api/docs/models
- GPT-6 Astra: https://developers.openai.com/api/docs/models/gpt-6-astra
- ChatGPT Work and Codex: https://help.openai.com/en/articles/20001275
- ChatGPT rate card: https://help.openai.com/en/articles/11481834
- Enterprise rate card: https://help.openai.com/en/articles/20001415
- Banked resets: https://help.openai.com/en/articles/20001498
- Tibo — Astra Low vs Sol High: https://x.com/thsottiaux/status/2096688770523467947
- Tibo — long-tail usage improvement: https://x.com/thsottiaux/status/2096717905614524491
- Tibo — Sep. 5 full banked reset: https://x.com/thsottiaux/status/2096035437299237298
- Tibo — six-month productivity shift: https://x.com/thsottiaux/status/2096101429832552872
