GPT-6 Astra rất mạnh, nhưng điều đó không có nghĩa mọi việc đều nên chạy bằng Astra.
OpenAI cho biết mức sử dụng Work và Codex phụ thuộc vào model, độ phức tạp của nhiệm vụ, ngữ cảnh, thiết lập suy luận, tốc độ và công cụ; Astra cũng có thể tiêu thụ hạn mức đi kèm nhanh hơn GPT-5.6 Sol.[1][2]
Codex có lệnh /model để chọn model và mức suy luận.[3]
Tuy nhiên có một điểm quan trọng: đây không phải là hot-swap model ngay giữa một turn đang chạy. Yêu cầu đổi model khi prompt vẫn đang thực thi từng được xem như một tính năng riêng.[4]
Vì vậy cách dùng thực tế là:
làm bằng Sol → kết thúc turn → đổi sang Astra cho phần khó → xử lý xong → quay lại Sol.
1. Đổi model không đồng nghĩa với tự động định tuyến
/model cho phép chọn model và reasoning effort.[3] Nhưng Codex không nhất thiết tự tối ưu hạn mức bằng cách chọn Luna cho lỗi chính tả, Sol cho code thông thường và Astra cho sự cố bí ẩn.
Dùng Astra để sửa một dấu phẩy trong README giống như lái xe F1 đi mua sữa. Làm được, nhưng không cần biến thành thói quen.
2. Vì sao Astra có thể tiêu hạn mức rất nhanh
Tính đến ngày 6/9/2026, giá API chính thức là:[5]
| Model | Input / 1M token | Output / 1M token |
|---|---|---|
| GPT-6 Astra | $10 | $50 |
| GPT-5.6 Sol | $4 | $20 |
| GPT-5.6 Terra | $2 | $12 |
| GPT-5.6 Luna | $0.20 | $1.20 |
Giá API theo token của Astra cao gấp 2,5 lần Sol. Nhưng điều đó không có nghĩa hạn mức tuần trong ChatGPT luôn giảm đúng 2,5 lần nhanh hơn. Hạn mức Work/Codex và thanh toán API là hai hệ thống khác nhau; mức tiêu thụ thực tế còn phụ thuộc vào khối lượng công việc.[1][2]
3. Astra đáng dùng nhất cho “khám phá”
Astra đặc biệt phù hợp với các nhiệm vụ chưa biết đáp án ngay từ đầu:
- tạo nhiều giả thuyết cho lỗi chưa rõ nguyên nhân
- tìm vấn đề cấu trúc trên toàn repository
- tìm nguyên nhân chung của bug tái diễn
- xếp hạng ứng viên đáng kiểm thử nhất
- thiết kế thử nghiệm tiếp theo từ kết quả thất bại
- đánh giá trade-off kiến trúc phức tạp
OpenAI định vị Astra là model năng lực cao nhất cho suy luận phức tạp, lập trình, duyệt web, kỹ thuật phần mềm và workflow nhiều bước.[6]
4. Mẫu hiệu quả nhất: Sol → Astra → Sol
Đầu tiên dùng Sol/Terra/Luna để thu thập file, log, kết quả test và các vị trí nghi ngờ.
Sau đó nén thông tin và gửi cho Astra: “Còn 7 giả thuyết, 3 cách sửa đã thất bại, hãy xếp hạng bước thử tiếp theo.”
Khi Astra xác định hướng đi, trả phần triển khai và test hàng loạt về cho Sol/Terra.
Chỉ quay lại Astra nếu bằng chứng vẫn chưa hội tụ.
Như vậy Astra không còn là nhân viên đọc từng file trong 100 file, mà trở thành trưởng nhóm nghiên cứu được gọi vào khi bằng chứng đã sẵn sàng.
5. Phân chia đơn giản
| Công việc | Lựa chọn đầu tiên |
|---|---|
| tìm kiếm đơn giản, định dạng, chỉnh sửa lặp lại | Luna / Terra |
| triển khai thông thường, review, bug phổ biến | Sol |
| khám phá nguyên nhân chưa biết, kiến trúc khó, tạo giả thuyết, bài toán cuối | Astra |
Nguyên tắc: chỉ dùng Astra ở nơi nó thực sự thay đổi chất lượng quyết định.
6. Xem dashboard thay vì chỉ đếm tin nhắn
OpenAI khuyến nghị kiểm tra limit nào đã hết, số dư và thời điểm reset trong trang Usage. Trong Codex CLI cũng có /status.[2]
Một số trải nghiệm agent có thể dùng chung một pool, vì vậy đếm tin nhắn không phải cách ước lượng đáng tin cậy.[2]
7. Reset Astra mỗi ngày sẽ rất tuyệt, nhưng hiện không phải cơ chế chuẩn
Hệ thống hiện tại dùng các cửa sổ sử dụng hiển thị cho người dùng, có thể gồm chu kỳ 5 giờ và hàng tuần.[2]
Tài khoản Plus/Pro cá nhân đủ điều kiện có thể được mua reset tuần tức thời. Reset khôi phục cả cửa sổ 5 giờ và tuần, nhưng thực chất là kéo hạn mức tuần bình thường về sớm chứ không cộng thêm một tuần thưởng. Chu kỳ 7 ngày mới bắt đầu từ yêu cầu Work/Codex đầu tiên sau reset.[7]
Một số người dùng cũng có thể có reset được lưu; reset đầy đủ làm mới cả hai cửa sổ và thay đổi ngày reset tuần tiếp theo.[8]
8. Kiểm tra phiên bản Codex CLI
Astra hiện yêu cầu Codex CLI 0.153.0 hoặc mới hơn.[1]
9. Kết luận
Codex có thể đổi model trong cùng một session, nhưng nên hiểu là đổi giữa các turn, không phải thay động cơ ngay giữa turn đang chạy.
Chiến lược thực tế:
Sol cho công việc hằng ngày; Terra/Luna cho việc nhẹ, lặp lại; Astra cho khám phá, giả thuyết, lỗi chưa rõ, kiến trúc khó và quyết định cuối; xong thì quay lại ngay.
Kỹ năng quan trọng không chỉ là biết dùng model mạnh nhất, mà còn là biết nơi nào không cần dùng model mạnh nhất.
- OpenAI Help Center — ChatGPT Work and Codex help.openai.com
- OpenAI Help Center — Using Codex with your ChatGPT plan / ChatGPTプランでCodexを使う help.openai.com
- openai/codex — codex-rs/tui/src/slash_command.rs (/model: choose model and reasoning effort) github.com
- openai/codex Issue #20842 — Switch model mid-prompt github.com
- OpenAI Developers — Models developers.openai.com
- OpenAI Developers — Model guidance / GPT-6 Astra developers.openai.com
- OpenAI Help Center — Paid weekly Work and Codex rate limit resets help.openai.com
- OpenAI Help Center — How banked Codex resets work help.openai.com
