Claude dùng 3%, ChatGPT dùng 31%, rồi xuất hiện “Selected model is at capacity”: so sánh AI đã thành cuộc chiến về hiệu suất và khả dụng

Đây không phải bài kiểm tra hỏi đáp ngắn. Các tác vụ phải đọc ngữ cảnh dài, thực hiện nhiều bước, ra quyết định giữa chừng và trả về khối lượng kết quả lớn.

Cách dùng công cụ đọc

Nghe đọc bài thành tiếng. Đọc nhanh hiển thị lần lượt các cụm từ theo tốc độ bạn chọn. Luyện ngôn ngữ giúp đối chiếu các bản dịch hiện có. Lưu tạo dấu trang trong trình duyệt này; mở lại từ danh sách đã lưu của trình phát.

Chia sẻ bài viết này

Chia sẻ bài viết này

Quảng cáo
Quảng cáo

1. Với cùng kiểu công việc nặng, Claude về đích sớm hơn

Đây không phải bài kiểm tra hỏi đáp ngắn. Các tác vụ phải đọc ngữ cảnh dài, thực hiện nhiều bước, ra quyết định giữa chừng và trả về khối lượng kết quả lớn.

Claude Opus 5.5 và GPT-6.1 Sol được chạy song song ở mức suy luận khoảng medium. Không có chuyện cố tình cho một bên chạy chế độ siêu nhẹ.

Trong thực tế, Claude tiến nhanh hơn rõ rệt và hoàn thành nhiều phần việc hơn. GPT-6.1 Sol vẫn làm việc, nhưng chậm hơn.

Với một câu hỏi đơn lẻ, chênh vài phút không đáng kể. Với agent chạy nhiều giờ, chênh mười phút lặp hai mươi lần thành hơn ba giờ.

Thắng vài điểm benchmark có thể kém giá trị hơn việc hoàn thành thêm hai tác vụ hữu ích trước cuối ngày.

2. Sau đó đồng hồ usage cho thấy khoảng 31% so với 3%

Sau khoảng một giờ hoạt động tương đương, ChatGPT còn 69%, tức có thể hiểu đơn giản là đã dùng khoảng 31%. Claude hiển thị khoảng 3% đã dùng.

31 chia 3 khoảng 10,3. Nhưng không thể kết luận Claude rẻ hơn đúng 10,3 lần.

Hai phần trăm không dùng cùng mẫu số. Pool thuê bao, cửa sổ năm giờ, giới hạn tuần, trọng số model và cách tính theo tính năng đều khác nhau.

Đây không phải táo so với táo.

Có thể giống đồng hồ xăng so với thời gian còn lại của buffet.

Dù vậy, với người trả tiền, tín hiệu rất rõ: công việc tương tự cùng ngày, một đồng hồ gần như đứng yên còn bên kia giảm thấy rõ, và bên giảm ít hơn lại hoàn thành sớm hơn.

3. Rồi xuất hiện chi phí mới: “Selected model is at capacity”

Phía OpenAI xuất hiện:

Selected model is at capacity. Please try a different model.

Usage đã giảm nhanh, giờ chính con đường cũng kẹt.

Thời gian chờ quan sát được khoảng 30 giây.

Ba mươi giây riêng lẻ không lớn. Nhưng tác vụ dài còn có retry, kiểm tra trạng thái, đổi model và chi phí khiến con người phải quay lại màn hình.

OpenAI Developer Community cũng có người dùng Pro báo cùng thông báo dù vẫn còn usage.

Điều đó cho thấy “quota của tôi hết” và “provider thiếu capacity lúc này” có thể là hai lỗi khác nhau.

Bảng so sánh cần thêm một cột: model có thực sự sẵn sàng đúng lúc cần dùng hay không.

4. Hướng công bố chính thức của Opus 5.5 cũng nhấn mạnh hiệu suất

Anthropic phát hành Opus 5.5 ngày 22 tháng 9 năm 2026 và cho biết workload điển hình tính theo token có chi phí chạy thấp hơn Opus 5 khoảng 40%.

Họ cũng nhấn mạnh hoàn thành cùng công việc với ít token, bước và tool call hơn. Claude Code có Fast mode, được quảng bá nhanh hơn tối đa 2,5 lần trong điều kiện riêng.

Quan sát này không phải benchmark Fast mode có kiểm soát.

Điểm quan trọng là tốc độ không chỉ là số ký tự mỗi giây.

Ít đi sai hướng hơn, ít retry hơn, ít tool call vô ích hơn và ít vòng trao đổi hơn cũng là tốc độ.

5. Cùng lúc, kinh tế của OpenAI Pro $200 đang thay đổi

Ngày 30 tháng 9, Help Center công khai của OpenAI vẫn gọi Pro $200 là Pro 20x.

Nhưng một trang Help hiện hành khác của OpenAI nói người đăng ký cũ đủ điều kiện giữ lượng dùng trước đây đến 29 tháng 10 năm 2026, sau đó chuyển sang lượng included thấp hơn trong khi giá vẫn $200/tháng.

Business Insider và thông báo thuê bao được chia sẻ công khai mô tả Work/Codex giảm từ 20x xuống 10x Plus và GPT-6 Pro Chat từ 200 xuống 100 tin nhắn mỗi tuần.

Vì vậy cần tách rõ:

Trang Help công khai vẫn có nhãn 20x.

Thông báo chuyển đổi nói người bị ảnh hưởng sẽ có allowance thấp hơn sau 29 tháng 10.

OpenAI đồng thời đưa ra Pro 500 với usage cao nhất và GPT-6 Astra Ultrafast.

Trần cao hơn.

Tầng $200 nhẹ hơn.

6. 62.500 credits rất lớn nhưng chỉ tạm thời

Thông báo được chia sẻ nói có khoản một lần 62.500 usage credits, định giá $2.500 và hết hạn ngày 31 tháng 12 năm 2026.

Đó là hỗ trợ chuyển tiếp đáng kể.

Nhưng không phải giảm giá vĩnh viễn.

Khi credits hết hoặc hết hạn, thứ còn lại là giá hàng tháng và allowance thường kỳ.

Một thùng tiếp tế lớn đã tới.

Tuyến hậu cần năm sau vẫn là chuyện khác.

7. Benchmark thật là công việc hoàn thành chia cho tiền và thời gian chờ

Người dùng nặng nên đo:

  • tác vụ dùng được hoàn thành mỗi giờ;
  • tác vụ trên 1% allowance;
  • tác vụ trên một đô la;
  • thời gian con người sửa;
  • thời gian mất vì capacity, retry và đổi model;
  • tỷ lệ tác vụ dài hoàn thành không gián đoạn.

Có thể viết:

Giá trị thực = công việc hoàn thành dùng được / (phí thuê bao + phụ phí + thời gian sửa của con người + chi phí chờ và retry)

Thuê bao AI giống dụng cụ điện hơn rượu sang.

Công suất cực đại quan trọng, nhưng pin, quá nhiệt và việc nó có chạy khi bấm nút cũng quan trọng.

8. Hiện tại Claude có vẻ hợp làm lực lượng chính hơn, nhưng người dùng vẫn cần OpenAI trong cuộc chiến giá

Một quan sát không chứng minh Claude thắng mọi workload.

GPT-6.1 Sol có khoảng 1,05 triệu token context, hệ sinh thái công cụ OpenAI và giá API thấp hơn GPT-6 Astra nhiều. OpenAI định vị nó là near-Astra cho công việc phức tạp với chi phí thấp hơn.

Vấn đề không phải model tệ.

Vấn đề là kinh tế tổng thể của gói thuê bao.

Nếu Claude hoàn thành nhanh hơn, meter giảm ít hơn, trong khi ChatGPT có capacity wait và allowance $200 bị thu hẹp, chuyển workload chính sang Claude là hợp lý.

Nhưng OpenAI rời cuộc đua hoàn toàn cũng không tốt.

Khi cạnh tranh yếu đi, Anthropic có ít áp lực hơn để giữ giới hạn Max rộng rãi. Chính tài liệu của Anthropic nói có thể áp thêm giới hạn tuần, tháng, model hoặc tính năng để quản lý capacity.

Điều tốt nhất cho người dùng là cạnh tranh liên tục.

Kết luận

Trong quan sát này, Claude Opus 5.5 có vẻ vượt trội về throughput tác vụ dài và hiệu suất allowance nhìn thấy.

31% so với 3% không phải bằng chứng cho lợi thế phổ quát 10,3 lần vì mẫu số khác nhau.

Nhưng cộng thêm thay đổi Pro $200, 62.500 credits tạm thời và capacity wait thực tế, chỉ số đúng trở nên rõ ràng:

Đến cuối tháng, dịch vụ nào hoàn thành được nhiều công việc hữu ích hơn với ít thời gian chờ hơn?

Claude mạnh là tốt.

OpenAI tiếp tục chiến đấu cũng tốt.

Nếu chỉ còn một người thắng thật sự, thứ bị “tối ưu” tiếp theo có thể là ví của người dùng.

Các công ty AI: hãy tiếp tục cuộc chiến giá một cách hòa bình nhưng thật quyết liệt.

Nguồn kiểm tra ngày 30 tháng 9 năm 2026


Chia sẻ bài viết này

Quảng cáo

Tìm bài viết khác

Tất cả bài viết

Mendoi-chan

Tác giả

Mendoi-chan

Biến những vướng mắc trong công việc và đời sống hằng ngày thành cấu trúc rõ ràng và bước tiếp theo thực tế.

Giới thiệu
Quảng cáo

Bài viết mới

  1. 1Bài 5: Khi Zero rút lui, Hắc Kỵ Sĩ Đoàn cũng nên rút theo|Todo và giới hạn của một tổ chức phụ thuộc quá nhiều vào Zero
  2. 2Bài 8: Địa ngục của khán giả phải chờ từ tập 25 mùa 1 đến R2|Từ cái kết chĩa súng vào nhau đến màn mở đầu với ký ức bị sửa đổi
  3. 3Trăng Xanh không phải là Mặt Trăng có màu xanh
  4. 4Khi vẻ đẹp không còn điều khiển quyết định: hết vội vàng trong tình yêu và ưu tiên sự tương hợp cùng thiết kế cuộc sống
  5. 5“Rõ ràng có trả lời mà vẫn bị nói là ‘chẳng bao giờ trả lời’” — chuyện gì xảy ra khi một người phải gánh toàn bộ động cơ hội thoại

Có thể bạn quan tâm

Quảng cáo