Vì sao Astra “đốt” hạn mức tuần? Low vượt Sol High, hiệu suất tăng 3–4 lần nhưng bình xăng đã cạn

Ngày 7/9, Tibo của OpenAI nói GPT-6 Astra ở Low hoạt động tốt hơn GPT-5.6 Sol ở High, và khuyên người từng hài lòng với Sol High chuyển sang Astra Low hoặc Medi

Quảng cáo
Quảng cáo

Tình trạng tính đến ngày 7/9/2026. Đây không phải câu chuyện Astra yếu. Ngược lại: nó mạnh và nhanh nên người dùng muốn chạy thật nhiều. Đồng hồ usage tụt cực nhanh. Sau khi hạn mức đã bốc hơi, thông báo xuất hiện: “đã cải thiện hiệu suất”. Phản ứng tự nhiên: tốt, còn số xăng đã đốt trước đó thì sao?

1. Cốt truyện: mạnh → nhanh → hạn mức chết → sửa hiệu suất → hạn mức đã hết

Ngày 7/9, Tibo của OpenAI nói GPT-6 Astra ở Low hoạt động tốt hơn GPT-5.6 Sol ở High, và khuyên người từng hài lòng với Sol High chuyển sang Astra Low hoặc Medium.

Low, Medium và High không phải thang IQ tuyệt đối dùng chung cho mọi model. Astra Low không phải “Astra ngu”; động cơ mới với reasoning nhẹ hơn vẫn vượt ngưỡng từng cần Sol High.

Vậy nên tưởng như rất đơn giản: Astra Low làm mặc định—mạnh hơn, nhanh hơn. Gần đúng. Bất ngờ nằm ở đồng hồ nhiên liệu.

2. “Dung lượng” context và “hạn mức subscription” là hai thứ khác nhau

Nếu dung lượng nghĩa là context, Astra không lớn hơn. OpenAI ghi cả hai đều có context 1,05 triệu token và output tối đa 128.000 token.

Nhưng cách tính long context khác nhau. Rate card Enterprise thường thêm multiplier khi input vượt 272K, trong khi GPT-6 Astra trong Codex được miễn multiplier long-context bổ sung trên 272K. Đó không phải cái thùng lớn hơn; đó là cách đo khác.

Giới hạn 5 giờ và tuần là một đồng hồ khác. OpenAI nói Astra có thể tiêu allowance nhanh hơn tùy tác vụ, input/output, reasoning và Fast.

3. Đằng sau “uống hạn mức như nước” có giá và Fast

Giá API Astra là $10/$50 cho một triệu token input/output; Sol là $4/$20, tức 2,5 lần mỗi token. Nhưng giá API không phải công thức trực tiếp cho phần trăm tuần của mọi gói ChatGPT.

Một người dùng báo khoảng 10% với Sol Medium so với khoảng 50% với Astra Low cho công việc tương tự. Đây là trải nghiệm cá nhân, không phải benchmark phổ quát.

Người khác nói tắt 2x speed giúp rất nhiều. Rate card chính thức giải thích được: GPT-6 Astra Fast tính 2,5 lần Standard trong Work/Codex. Tốc độ không miễn phí. Đạp ga hết rồi hỏi xăng đi đâu thì bảng giá chỉ lặng lẽ nhìn lại.

4. “Nhanh” không chỉ là cảm giác—Tibo nói kế hoạch nội bộ tiến lên khoảng sáu tháng

Nếu Astra chỉ là model mới tốn kém, quay về Sol là xong. Nhưng ngày 5/9 Tibo nói Astra từng là lợi thế cạnh tranh lớn trước khi phát hành rộng rãi và năng suất nội bộ tăng đủ để đưa một số kế hoạch từ giữa năm sau lên DevDay, sớm khoảng sáu tháng.

Đây là lời tự báo cáo của OpenAI, không phải nghiên cứu năng suất độc lập. Tuy vậy, nó cho thấy vì sao wall-clock speed quan trọng: công việc agentic còn phụ thuộc thời gian hoàn thành tác vụ dài, retry, tool và giữ context.

Giá trị của Astra có thể là một ngày hoàn thành được bao nhiêu việc trọn vẹn. Vì thế ai cũng muốn chạy. Và chạy thì hạn mức chết. Một cái bẫy đẹp.

5. Sau đó OpenAI sửa long tail

Vài giờ sau, Tibo công bố cải tiến cho power users Astra đăng nhập bằng tài khoản ChatGPT, đặc biệt long tail của session dài hoặc nặng.

  • chất lượng không đổi;
  • long tail hiệu quả hơn;
  • ở trường hợp áp dụng, subscription usage có thể giảm tối đa 3–4 lần.

Không có nghĩa mọi tác vụ còn một phần tư; đây là mức tối đa cho long-tail cases.

Nếu chỉ minh họa số học, trường hợp 50% nếu giảm đầy đủ 3–4 lần sẽ còn khoảng 12,5–16,7%. Không phải dự báo hay bảo đảm.

6. Tiết kiệm hơn từ hôm nay không trả lại xăng hôm qua

  1. Astra xuất hiện.
  2. Low đã mạnh hơn Sol High.
  3. Nhanh nên chạy hết sức.
  4. Hạn mức tuần bốc hơi.
  5. “Long tail giờ có thể tiết kiệm 3–4 lần.”
  6. Tuyệt. Bình xăng đã cạn.

Bản sửa ngày 7/9 giảm usage về sau, không được công bố là hoàn tự động usage đã bị trừ trước đó.

Vì vậy câu hỏi rất con người là: số xăng phiên bản cũ đã uống có được trả lại trước không?

7. Và thế là “Tibo, reset nhanh lên” trở thành câu kết

Ngày 5/9 có tiền lệ: Tibo công bố full banked reset cho Plus, Pro, Business. Tài liệu OpenAI nói nó làm mới cả cửa sổ 5 giờ lẫn hàng tuần của Codex và đổi ngày reset tuần.

Đây là reset khuyến mại một lần, không phải tăng vĩnh viễn, và reset tương lai không được bảo đảm. Khi kiểm tra feed Tibo cuối buổi sáng 7/9 theo giờ Nhật, đã có hướng dẫn Low/Medium và cải tiến 3–4 lần nhưng chưa có reset mới sau ngày 5.

Tibo: Đã sửa mức tiêu hao.
Người dùng: Tốt.
Tibo: Không giảm chất lượng.
Người dùng: Tuyệt.
Tibo: Có thể giảm 3–4 lần.
Người dùng: Còn hạn mức hôm qua?
Tibo: …
Người dùng: Tibo, reset nhanh lên.

8. Kết luận thực dụng: Astra Low + Standard có vẻ là mặc định rất mạnh

  • việc nặng hằng ngày: Astra Low + Standard
  • tác vụ thực sự không qua Low: Astra Medium
  • khi thời gian quan trọng hơn hạn mức: Fast, Astra Fast hiện 2,5 lần Standard
  • khi chi phí và tuổi thọ hạn mức quan trọng: Sol vẫn đáng dùng

Năng lực, tốc độ, context và hiệu quả usage là các trục khác nhau. Astra có thể mạnh và nhanh hơn với context bằng Sol nhưng tiêu allowance nặng hơn; đồng thời có ngoại lệ long-context trong Codex và patch 7/9 đã cắt phần tệ nhất của session dài.

Chúng tôi hiểu xe giờ tiết kiệm hơn. Hãy đổ đầy bình để thử lại.

Nguồn đã kiểm tra


Quảng cáo
Mendoi-chan

Tác giả

Mendoi-chan

Biến những vướng mắc trong công việc và đời sống hằng ngày thành cấu trúc rõ ràng và bước tiếp theo thực tế.

Giới thiệu
Quảng cáo

Bài viết mới

  1. 1Tác nhân AI có khiến con người trở nên không cần thiết? Thiết kế môi trường, tín hiệu xu hướng và một nhà máy truyền thông “đuổi sếp ra ngoài”
  2. 2Tác vụ AI Agent chạy lâu có nên ghi log tiến độ? Thiết kế Heartbeat để tránh câu hỏi “nó dừng rồi à?”
  3. 3Tự động hóa bài viết bằng AI có nguy hiểm không? Kết hợp tốc độ, bằng chứng, cải tiến liên tục và website sở hữu riêng thành một hệ thống truyền thông “sống”
  4. 4Nhà máy xuất hiện trước 1.500 bài viết: AI khuếch đại khả năng khám phá, cấu trúc hóa, cải tiến và tự động hóa như thế nào
  5. 5“Nước ấm” làm ấm cái gì?

Có thể bạn quan tâm

Quảng cáo