Claude用了3%,ChatGPT用了31%,最後還跳出「Selected model is at capacity」——AI比較已從智力測驗變成油耗與可用性戰爭

比較的不是一句問答,而是需要讀長上下文、跑多個步驟、中途判斷並交付較大成果的長任務。

閱讀功能說明

收聽會朗讀正文;速讀會依序顯示短語,速度可調。語言練習可對照現有的不同語言版本。收藏儲存在本瀏覽器中,可從播放器的收藏清單再次開啟。

分享這篇文章
廣告
廣告

1. 同類重任務,Claude比較早到終點

比較的不是一句問答,而是需要讀長上下文、跑多個步驟、中途判斷並交付較大成果的長任務。

Claude Opus 5.5與GPT-6.1 Sol都使用中等推理設定並行運作,並不是故意讓其中一邊開超輕量模式。

實際感受是Claude明顯推進更快,完成的工作量也更多。GPT-6.1 Sol不是不動,而是比較慢、比較穩地前進。

單次差幾分鐘沒什麼,但長時間Agent把差距重複二十次後,十分鐘就會變成兩百分鐘。

排行榜多兩分,不一定比晚餐前多做完兩份可用工作更有價值。

2. 然後額度變成31%對3%

約一小時相似並行工作後,ChatGPT顯示剩69%,簡單看就是約消耗31%。Claude則約消耗3%。

31除以3大約是10.3,但不能直接寫成「Claude便宜10.3倍」。

兩家的百分比沒有同一個分母。方案池、五小時窗口、每週限制、模型權重與功能計量都不一樣。

這不是蘋果比蘋果。

比較像汽車油表對吃到飽剩餘時間。

但對付費者仍很重要:同一天跑相似工作,一邊幾乎不掉,另一邊明顯下降,而且掉得慢的那邊還先做完。

它不是普遍科學定律,卻是很有力的購買訊號。

3. 接著又來「Selected model is at capacity」,等了約30秒

OpenAI側接著出現:

Selected model is at capacity. Please try a different model.

額度掉得快已經夠煩,這次連道路本身都塞車。

實際等待約30秒。

30秒本身不大,但長任務還會加上重試、確認狀態、切模型,以及人重新回到畫面的成本。

OpenAI Developer Community也有人回報完全相同的錯誤文字,而且表示在剩餘用量還存在時也會發生。

所以「自己的quota用完」與「供應商當下capacity不足」可能是不同問題。

AI比較表因此還需要一欄:想用的瞬間,到底能不能用。

4. Opus 5.5官方本來就在強調效率

Anthropic於2026年9月22日發布Opus 5.5,表示典型按token計費的工作負載,比Opus 5約降低40%執行成本。

官方也強調用更少token、步驟與工具呼叫完成同樣工作。Claude Code的Fast mode在自己的條件下宣稱最高2.5倍速度。

這不代表本次實測就是Fast mode測試。

真正重要的是速度不只等於每秒輸出字數。

少走錯路、少重試、少浪費工具呼叫、少幾輪往返,也都是速度。

5. 同時,OpenAI月費200美元Pro的經濟性也在變

截至9月30日,OpenAI公開Help Center仍把Pro $200稱為Pro 20x。

但OpenAI另一個目前可讀的Help頁面表示,符合條件的舊用戶可保留原本內含量到2026年10月29日,之後在月費仍為200美元的情況下轉到較低的內含量。

Business Insider與公開分享的用戶通知則把數字寫成Work/Codex由Plus的20x降到10x,GPT-6 Pro Chat由每週200則降到100則。

所以目前應分開理解:

公開Help頁仍有20x。

轉換通知則說10月29日後受影響用戶會進入較低額度。

OpenAI同時推出月費500美元的Pro 500與GPT-6 Astra Ultrafast。

天花板升高了。

200美元這一層卻變輕了。

6. 62,500 credits很大,但只是暫時緩衝

公開分享的既有訂閱者通知稱,一次性提供62,500 usage credits,標稱2,500美元,並於2026年12月31日失效。

這對過渡期非常有幫助。

但它不是永久提高月費的價值。

credits花完或到期之後,長期留下的仍是月費與常規額度。

大型補給箱送到了。

明年的補給線仍然要另外算。

7. 真正的benchmark應該是「完成工作量÷金錢÷等待」

重度使用者可以追蹤:

  • 每小時完成多少可採用任務
  • 每消耗1%額度完成多少任務
  • 每1美元完成多少任務
  • 人工修正時間
  • capacity等待、重試與切模型損失的時間
  • 長任務不中斷完成率

可以粗略寫成:

實效價值 = 可採用完成工作量 /(訂閱費 + 額外費用 + 人工修改時間 + 等待與重試成本)

AI訂閱更像電動工具,不像高級酒。

最大扭力重要,電池壽命、過熱停機,以及扣下扳機時它到底會不會轉也重要。

8. 現在Claude比較像主力,但使用者仍需要OpenAI繼續打價格戰

一次觀察不能證明Claude在所有工作上都贏。

GPT-6.1 Sol有約105萬token context、OpenAI工具生態,以及比GPT-6 Astra低很多的API價格。OpenAI把它定位成以較低成本提供near-Astra複雜工作能力的模型。

問題不是模型很差。

問題是整套訂閱的實效工作量顯得比較弱。

如果Claude同類工作更快、額度掉得更少,而ChatGPT還出現capacity等待,加上200美元常規額度縮減,那麼重度使用者把主力轉向Claude很自然。

但OpenAI完全退出競爭也不是好事。

若使用者全部集中到單一供應商,贏家維持今天寬鬆條件的壓力也會下降。Anthropic也明確寫著,為管理capacity可能增加每週、每月、模型或功能限制。

使用者真正想要的不是某家公司永遠佛心。

而是幾家公司永遠互相加量、互相壓價。

結論

這次實測裡,Claude Opus 5.5在長時間工作速度與體感額度效率上明顯占優。

31%對3%不能直接變成10.3倍的普遍結論,因為分母不同。

但加上OpenAI的200美元額度調整、一次性62,500 credits,以及實際發生的capacity等待後,真正的KPI已經很清楚:

一個月結束以前,誰能讓你少等、並完成最多真正可用的工作。

Claude現在強很好。

OpenAI也請繼續撐住。

因為若只剩一個真正的強者,下一次被「最佳化」的可能就是使用者的錢包。

請各家繼續和平而猛烈地打價格戰。

2026年9月30日核對資料


廣告

尋找其他文章

所有文章

Mendoi-chan

作者

Mendoi-chan

把工作與日常生活中的麻煩整理成清楚的結構與下一步行動。

關於本站
廣告

最新文章

  1. 1Zero撤退的那一刻,黑色騎士團也該撤了|藤堂與「過度依賴Zero」的組織極限
  2. 2從第一季第25話等到R2:即時追番觀眾的地獄|槍口懸念之後,R2又像從「記憶被改寫」開始
  3. 3藍月亮,並不是藍色的月亮
  4. 4當外貌不再左右決定——從戀愛焦慮消失,到優先考慮契合度與生活設計
  5. 5「明明有回,卻被說『你根本沒回』」——把聊天引擎外包給一個人會發生什麼事

推薦閱讀

廣告