Claude用了3%,ChatGPT用了31%,最后还出现“Selected model is at capacity”——AI比较已经从智力测试变成油耗与可用性战争

比较的不是一句问答,而是要读取长上下文、连续执行多个步骤、中途判断并交付较大成果的长任务。

阅读功能说明

收听会朗读正文;速读会按顺序显示短语,速度可调。语言练习可对照已有的不同语言版本。收藏保存在本浏览器中,可从播放器的收藏列表再次打开。

分享这篇文章

分享这篇文章

广告
广告

1. 同类重任务,Claude更早到终点

比较的不是一句问答,而是要读取长上下文、连续执行多个步骤、中途判断并交付较大成果的长任务。

Claude Opus 5.5与GPT-6.1 Sol都使用中等推理强度并行运行,没有故意让其中一边开超轻量模式。

实际感受是Claude明显推进更快,完成的工作量也更多。GPT-6.1 Sol并没有停,它只是更慢、更稳地往前走。

单次差几分钟不重要。但长时间Agent把这种差距重复二十次以后,十分钟就会变成两百分钟。

在排行榜上多两分,不一定比晚饭前多完成两份可用工作更有价值。

2. 然后额度变成了31%对3%

大约一小时的相似并行工作后,ChatGPT显示剩余69%,也就是简单理解约消耗31%。Claude显示约消耗3%。

31除以3约等于10.3,但不能因此直接写成“Claude性价比高10.3倍”。

两家的百分比没有相同分母。订阅池、五小时窗口、周上限、模型权重、功能计量方式都不同。

这甚至不是苹果对苹果。

更像汽车油表对自助餐剩余时间。

但对付钱的人仍然很有意义:同一天跑相似工作,一边的表几乎不动,另一边明显下降,而且前者还更快完成。

它不是万能科学结论,却是很强的购买信号。

3. 接着又来了“Selected model is at capacity”,等待约30秒

OpenAI侧随后出现:

Selected model is at capacity. Please try a different model.

额度掉得快已经够烦,结果道路本身还堵车。

这次观察到的等待大约30秒。

30秒单独看很小,但长任务会叠加重试、确认状态、切换模型以及让人重新回到屏幕的成本。

OpenAI Developer Community里也有人报告相同错误,而且声称在剩余用量尚未耗尽时仍会发生。

这说明“自己的quota用完”和“供应商此刻没有足够capacity”可能是两个不同问题。

因此比较AI时还要增加一列:想用的时候到底能不能用。

4. Opus 5.5的官方方向本来就在强调效率

Anthropic于2026年9月22日发布Opus 5.5,表示典型按token计费的工作负载相较Opus 5约可降低40%运行成本。

官方还强调以更少token、步骤和工具调用完成任务。Claude Code的Fast mode在自己的条件下宣称最高2.5倍速度。

这并不代表本次实测就是Fast mode测试。

真正有价值的是速度的定义:少走弯路、少重试、少浪费工具调用、少几轮往返,也都叫速度。

长任务中,“多少步到终点”常常比“每秒吐多少字”更重要。

5. 同时,OpenAI每月200美元Pro的经济性也在变化

截至9月30日,OpenAI公开Help Center仍把Pro $200称为Pro 20x。

但OpenAI另一份当前Help页面写明,符合条件的旧用户可保留以前的包含量到2026年10月29日,之后在月费仍为200美元的情况下转为更低的包含量。

Business Insider和公开分享的用户通知则把变化写得更具体:Work/Codex从Plus的20x降到10x,GPT-6 Pro Chat从每周200条降到100条。

所以当前最准确的说法是:

公开Help页仍保留20x标签。

迁移通知则说明10月29日以后受影响用户进入更低额度。

OpenAI同时推出月费500美元的Pro 500和GPT-6 Astra Ultrafast。

天花板升高了。

200美元这一层却变轻了。

6. 62,500 credits很大,但它是临时缓冲

公开分享的旧订阅者通知称,会一次性发放62,500 usage credits,标称2,500美元,并在2026年12月31日失效。

这确实是一份很大的过渡福利。

但它不是永久改善月费性价比。

credits花完或到期以后,长期剩下来的还是月费和常规额度。

大型补给箱到了。

明年的补给线还是另一个问题。

真正公平的比较应该放在促销余额消失后:正常200美元一个月究竟能完成多少可用工作。

7. 真正的benchmark应该是“完成工作量÷钱÷等待”

重度用户至少可以记录:

  • 每小时完成的可采用任务数
  • 每消耗1%额度完成多少任务
  • 每1美元完成多少任务
  • 人工修正时间
  • capacity等待、重试、切模型损失的时间
  • 长任务不中断完成的概率

可以粗略写成:

实际价值 = 可采用的完成工作量 /(订阅费 + 额外费用 + 人工修正时间 + 等待与重试成本)

AI订阅不是奢侈酒。

它更像电动工具。

最大扭矩重要,电池寿命、过热停机以及扣下扳机时能不能真的转起来也重要。

8. 现在Claude更像主力,但用户仍然需要OpenAI继续打价格战

一次观察不能证明Claude在所有工作里都赢。

GPT-6.1 Sol有约105万token上下文、OpenAI工具生态,以及比GPT-6 Astra更低的API价格。OpenAI把它定位为以更低成本提供near-Astra级复杂编码、computer use和专业工作能力。

问题不是模型很差。

问题是整套订阅的有效工作量显得不够强。

如果Claude同类工作完成更快、可见额度下降更少,而ChatGPT还出现capacity等待,同时200美元长期额度又要收缩,那么重度用户把主力迁到Claude非常自然。

但OpenAI完全退出竞争也不是好事。

如果用户全部集中到一个供应商,赢家维持今天宽松额度的压力也会下降。Anthropic自己也明确写着,为管理capacity,可以增加周、月、模型或功能限制。

用户最想要的不是某家公司永远善良。

而是几家公司永远互相压价、互相加量。

结论

本次实测里,Claude Opus 5.5在长时间任务速度与体感额度效率上明显占优。

31%对3%不能直接变成“10.3倍优势”,因为分母不同。

但再加上OpenAI的200美元额度调整、一次性62,500 credits,以及真正发生的capacity等待后,核心指标已经很清楚:

一个月结束前,哪家能让你少等待并完成更多真正可用的工作。

Claude今天领先很好。

OpenAI也别退出。

因为如果只剩一家真正有竞争力,下一次被“优化”的可能就是用户的钱包。

请各家继续和平地、猛烈地打价格战。

2026年9月30日核对资料


分享这篇文章

广告

查找其他文章

所有文章

Mendoi-chan

作者

Mendoi-chan

把工作与日常生活中的麻烦整理成清晰的结构和下一步行动。

关于本站
广告

最新文章

  1. 1Zero撤退的那一刻,黑色骑士团也该撤了|藤堂与“过度依赖Zero”的组织极限
  2. 2从第一季第25话等到R2:实时追番观众的地狱|枪口悬念之后,R2又像从“记忆被改写”开始
  3. 3蓝月亮,并不是蓝色的月亮
  4. 4为什么 Niconico 动画的评论,会带来一个人看时笑不出来的笑点
  5. 5“明明回复了,却被说成‘你根本不回’”——当聊天引擎被外包给一个人,会发生什么

推荐阅读

广告