1. 同类重任务,Claude更早到终点
比较的不是一句问答,而是要读取长上下文、连续执行多个步骤、中途判断并交付较大成果的长任务。
Claude Opus 5.5与GPT-6.1 Sol都使用中等推理强度并行运行,没有故意让其中一边开超轻量模式。
实际感受是Claude明显推进更快,完成的工作量也更多。GPT-6.1 Sol并没有停,它只是更慢、更稳地往前走。
单次差几分钟不重要。但长时间Agent把这种差距重复二十次以后,十分钟就会变成两百分钟。
在排行榜上多两分,不一定比晚饭前多完成两份可用工作更有价值。
2. 然后额度变成了31%对3%
大约一小时的相似并行工作后,ChatGPT显示剩余69%,也就是简单理解约消耗31%。Claude显示约消耗3%。
31除以3约等于10.3,但不能因此直接写成“Claude性价比高10.3倍”。
两家的百分比没有相同分母。订阅池、五小时窗口、周上限、模型权重、功能计量方式都不同。
这甚至不是苹果对苹果。
更像汽车油表对自助餐剩余时间。
但对付钱的人仍然很有意义:同一天跑相似工作,一边的表几乎不动,另一边明显下降,而且前者还更快完成。
它不是万能科学结论,却是很强的购买信号。
3. 接着又来了“Selected model is at capacity”,等待约30秒
OpenAI侧随后出现:
Selected model is at capacity. Please try a different model.
额度掉得快已经够烦,结果道路本身还堵车。
这次观察到的等待大约30秒。
30秒单独看很小,但长任务会叠加重试、确认状态、切换模型以及让人重新回到屏幕的成本。
OpenAI Developer Community里也有人报告相同错误,而且声称在剩余用量尚未耗尽时仍会发生。
这说明“自己的quota用完”和“供应商此刻没有足够capacity”可能是两个不同问题。
因此比较AI时还要增加一列:想用的时候到底能不能用。
4. Opus 5.5的官方方向本来就在强调效率
Anthropic于2026年9月22日发布Opus 5.5,表示典型按token计费的工作负载相较Opus 5约可降低40%运行成本。
官方还强调以更少token、步骤和工具调用完成任务。Claude Code的Fast mode在自己的条件下宣称最高2.5倍速度。
这并不代表本次实测就是Fast mode测试。
真正有价值的是速度的定义:少走弯路、少重试、少浪费工具调用、少几轮往返,也都叫速度。
长任务中,“多少步到终点”常常比“每秒吐多少字”更重要。
5. 同时,OpenAI每月200美元Pro的经济性也在变化
截至9月30日,OpenAI公开Help Center仍把Pro $200称为Pro 20x。
但OpenAI另一份当前Help页面写明,符合条件的旧用户可保留以前的包含量到2026年10月29日,之后在月费仍为200美元的情况下转为更低的包含量。
Business Insider和公开分享的用户通知则把变化写得更具体:Work/Codex从Plus的20x降到10x,GPT-6 Pro Chat从每周200条降到100条。
所以当前最准确的说法是:
公开Help页仍保留20x标签。
迁移通知则说明10月29日以后受影响用户进入更低额度。
OpenAI同时推出月费500美元的Pro 500和GPT-6 Astra Ultrafast。
天花板升高了。
200美元这一层却变轻了。
6. 62,500 credits很大,但它是临时缓冲
公开分享的旧订阅者通知称,会一次性发放62,500 usage credits,标称2,500美元,并在2026年12月31日失效。
这确实是一份很大的过渡福利。
但它不是永久改善月费性价比。
credits花完或到期以后,长期剩下来的还是月费和常规额度。
大型补给箱到了。
明年的补给线还是另一个问题。
真正公平的比较应该放在促销余额消失后:正常200美元一个月究竟能完成多少可用工作。
7. 真正的benchmark应该是“完成工作量÷钱÷等待”
重度用户至少可以记录:
- 每小时完成的可采用任务数
- 每消耗1%额度完成多少任务
- 每1美元完成多少任务
- 人工修正时间
- capacity等待、重试、切模型损失的时间
- 长任务不中断完成的概率
可以粗略写成:
实际价值 = 可采用的完成工作量 /(订阅费 + 额外费用 + 人工修正时间 + 等待与重试成本)
AI订阅不是奢侈酒。
它更像电动工具。
最大扭矩重要,电池寿命、过热停机以及扣下扳机时能不能真的转起来也重要。
8. 现在Claude更像主力,但用户仍然需要OpenAI继续打价格战
一次观察不能证明Claude在所有工作里都赢。
GPT-6.1 Sol有约105万token上下文、OpenAI工具生态,以及比GPT-6 Astra更低的API价格。OpenAI把它定位为以更低成本提供near-Astra级复杂编码、computer use和专业工作能力。
问题不是模型很差。
问题是整套订阅的有效工作量显得不够强。
如果Claude同类工作完成更快、可见额度下降更少,而ChatGPT还出现capacity等待,同时200美元长期额度又要收缩,那么重度用户把主力迁到Claude非常自然。
但OpenAI完全退出竞争也不是好事。
如果用户全部集中到一个供应商,赢家维持今天宽松额度的压力也会下降。Anthropic自己也明确写着,为管理capacity,可以增加周、月、模型或功能限制。
用户最想要的不是某家公司永远善良。
而是几家公司永远互相压价、互相加量。
结论
本次实测里,Claude Opus 5.5在长时间任务速度与体感额度效率上明显占优。
31%对3%不能直接变成“10.3倍优势”,因为分母不同。
但再加上OpenAI的200美元额度调整、一次性62,500 credits,以及真正发生的capacity等待后,核心指标已经很清楚:
一个月结束前,哪家能让你少等待并完成更多真正可用的工作。
Claude今天领先很好。
OpenAI也别退出。
因为如果只剩一家真正有竞争力,下一次被“优化”的可能就是用户的钱包。
请各家继续和平地、猛烈地打价格战。
2026年9月30日核对资料
- https://help.openai.com/en/articles/9793128-about-chatgpt-pro-tiers
- https://help-lb.openai.com/en/articles/9793128-about-chatgpt-pro-tiers
- https://developers.openai.com/api/docs/models/gpt-6.1-sol
- https://www.anthropic.com/claude-opus-5-5
- https://support.claude.com/en/articles/11049741-what-is-the-max-plan
- https://community.openai.com/t/request-for-account-review-pro20x-subscription-experiencing-capacity-errors-and-significant-performance-degradation/1400068
- https://www.businessinsider.com/chatgpt-new-plan-pro-500-cost-compute-allowance-2026-9
