Sai lầm chi phí phổ biến nhất khi coding bằng AI là chỉ nhìn giá của một lần chạy.
Nếu model rẻ đi lạc năm lần rồi kết thúc bằng “permission denied”, model đắt hơn nhưng tìm đúng nguyên nhân ngay lần đầu hoàn toàn có thể rẻ hơn.
Tháng 9/2026, Codex có thêm GPT-6 Sol và GPT-6 Luna bên cạnh GPT-6 Astra. Câu hỏi hữu ích không phải “model nào mạnh nhất?” mà là:
Loại việc nào nên giao cho model nào ngay từ đầu để giảm chi phí hoàn thành?
1. Thực sự đã ra mắt những gì
OpenAI phát hành GPT-6 Sol và GPT-6 Luna qua API ngày 22/9/2026, đồng thời đưa chúng vào ChatGPT Work và Codex.[1][2]
Sol hướng tới coding phức tạp và agentic workflow. Luna tối ưu cho tác vụ tập trung, khối lượng lớn. Cả hai có context window 1,05M và tối đa 128K token đầu ra.[3][4][5]
Astra nằm trên cùng cho các công việc end-to-end khó nhất, gồm coding, thao tác máy tính, nghiên cứu và tạo tài liệu.[6]
Có thể hình dung: Luna là nhân công sản xuất giá rẻ, Sol là người phụ trách hằng ngày, Astra là người bước vào phòng máy và hỏi ngay “dây này cắm ngược đúng không?”
2. Cạm bẫy của câu “GPT-6 đã vào ChatGPT”
Release Notes ngày 22/9 nói rõ Sol và Luna được thêm vào ChatGPT Work và Codex, đồng thời tách biệt với các model có trong Chat thông thường.[1]
Vì vậy “có trong sản phẩm ChatGPT” không đồng nghĩa với “chọn được trong cuộc trò chuyện Chat bình thường”.
Astra có rollout ChatGPT rộng hơn theo thông báo đầu tháng 9.[6] Cùng tên GPT-6 nhưng bề mặt sản phẩm khác nhau.
3. Giá niêm yết chênh lệch rất lớn
Giá Standard API trên 1 triệu token input/output vào 23/9/2026:[3][4][6][7][8][9]
| Model | Input | Output |
|---|---|---|
| GPT-6 Luna | $0.10 | $0.50 |
| GPT-6 Sol | $2.00 | $10.00 |
| GPT-6 Astra | $10.00 | $50.00 |
| GPT-5.6 Luna | $0.20 | $1.20 |
| GPT-5.6 Terra | $2.00 | $12.00 |
| GPT-5.6 Sol | $4.00 | $20.00 |
Với cùng lượng token, Sol khoảng 20 lần Luna và Astra 5 lần Sol.
Chỉ nhìn bảng này, dùng Luna cho mọi thứ có vẻ tuyệt vời. Giống như tiết kiệm phí chuyển nhà bằng cách tự vác tủ lạnh.
4. Mô phỏng đơn giản: 100K input + 20K output
Giả sử một tác vụ dùng 100.000 token input và 20.000 output, bỏ qua cache, phí tool, phụ phí context dài và retry.
| Model | Chi phí API ước tính mỗi lần |
|---|---|
| GPT-6 Luna | $0.020 |
| GPT-6 Sol | $0.400 |
| GPT-6 Astra | $2.000 |
| GPT-5.6 Luna | $0.044 |
| GPT-5.6 Terra | $0.440 |
| GPT-5.6 Sol | $0.800 |
Nếu chỉ tính token, Luna thắng tuyệt đối.
Nhưng công thức hữu ích hơn là:
chi phí hoàn thành ≈ chi phí mỗi lần × số lần thử + thời gian con người + context bị mất
Nếu lượng token bằng nhau, một lần Astra xấp xỉ năm lần Sol. Nếu Sol cần năm lần còn Astra cần một, chi phí API đã ngang nhau.
5. Astra đắt hơn có thể rẻ hơn trên mỗi công việc
Trong Terminal-Bench 4.0, OpenAI báo GPT-6 Astra đạt 57,9%, GPT-5.6 Sol 37,3%, trong khi chi phí API ước tính trên mỗi task của Astra thấp hơn khoảng 9% ở cấu hình so sánh.[6]
AutomationBench: 41,4% so với 18,1%; task migration database nội bộ: 63,9% so với 42,7%.[6]
Giá mỗi token và giá để hoàn tất công việc không giống nhau.
Astra cũng đưa vào Codex cơ chế lưu và truy xuất context qua những session dài.[6] Điều này giúp giảm cảnh “quên tại sao bản sửa trước thất bại rồi tự tin thử lại đúng thứ đó”.
6. Route theo hình dạng công việc, không theo thứ tự rẻ→đắt
Không nên bắt mọi task va vào Luna→Sol→Astra.
Hãy phân loại trước, sau một thất bại có ý nghĩa thì nâng model.
GPT-6 Luna
- tìm kiếm, trích xuất, phân loại, đổi định dạng
- sửa nhỏ với đặc tả rõ
- batch độc lập
- chạy và tóm tắt test
- tiêu chí thành công cơ học
GPT-6 Sol
- implementation nhiều file thông thường
- debug khi đã biết vùng nghi ngờ
- agentic workflow tiêu chuẩn
- nghiên cứu→sửa→test
- model mặc định cho Codex
GPT-6 Astra
- chưa biết root cause
- vấn đề qua nhiều service, permission hoặc state
- debug kéo dài
- migration, refactor lớn
- task luôn tới 80% rồi chết
- task đã được Sol điều tra nghiêm túc một lần nhưng chưa khép lại
7. GPT-5.6 Terra còn đứng ở đâu
Giá Standard:
- GPT-5.6 Terra: $2 / $12
- GPT-6 Sol: $2 / $10
Input bằng nhau, output Sol rẻ hơn.[3][8]
Với workload mới, vị trí kinh tế của Terra trở nên khó thuyết phục hơn. Tuy nhiên Terra vẫn có thể hợp lý nếu cần tương thích, tái lập hoặc prompt đã được xác thực.
Thiết kế mới có thể đơn giản thành:
Luna=khối lượng, Sol=mặc định, Astra=khó.
8. Câu trả lời thật đến từ khoảng 20 task của chính bạn
Benchmark là bản đồ, không phải repository của bạn.
Chia công việc thật thành 3–5 nhóm, ghi lại khoảng 20 task mỗi nhóm:
- hoàn thành không cần hướng dẫn người thêm
- thời gian tới trạng thái green
- số retry
- token/credit
- lượng log con người phải đọc
- regression
- tần suất cuối cùng vẫn phải đổi model
Tối ưu tổng chi phí trên mỗi task hoàn thành.
Kết luận: Sol làm mặc định, Luna cho khối lượng cơ học, Astra cho mê cung
GPT-6 Luna: rõ ràng, nhiều, độc lập.
GPT-6 Sol: công việc Codex thông thường.
GPT-6 Astra: mơ hồ, dài, xuyên nhiều hệ thống.
Mẫu đắt tiền thường không phải “dùng Astra”, mà là “tiết kiệm Astra bằng nhiều lần thất bại rồi cuối cùng vẫn dùng Astra”.
Con người đọc cùng một log lần thứ tư cũng là chi phí.
- OpenAI ChatGPT Release Notes help.openai.com
- OpenAI API Changelog developers.openai.com
- GPT-6 Sol developers.openai.com
- GPT-6 Luna developers.openai.com
- Models catalog developers.openai.com
- GPT-6 Astra openai.com
- GPT-5.6 Sol developers.openai.com
- GPT-5.6 Terra developers.openai.com
- GPT-5.6 Luna developers.openai.com
