“Chọn model rẻ mà bay mất 20 phút” — Cách chọn GPT-6 Luna / Sol / Astra trong Codex

Cách dùng công cụ đọc

Nghe đọc bài thành tiếng. Đọc nhanh hiển thị lần lượt các cụm từ theo tốc độ bạn chọn. Luyện ngôn ngữ giúp đối chiếu các bản dịch hiện có. Lưu tạo dấu trang trong trình duyệt này; mở lại từ danh sách đã lưu của trình phát.

Chia sẻ bài viết này

Chia sẻ bài viết này

Quảng cáo
Quảng cáo

Sai lầm chi phí phổ biến nhất khi coding bằng AI là chỉ nhìn giá của một lần chạy.

Nếu model rẻ đi lạc năm lần rồi kết thúc bằng “permission denied”, model đắt hơn nhưng tìm đúng nguyên nhân ngay lần đầu hoàn toàn có thể rẻ hơn.

Tháng 9/2026, Codex có thêm GPT-6 Sol và GPT-6 Luna bên cạnh GPT-6 Astra. Câu hỏi hữu ích không phải “model nào mạnh nhất?” mà là:

Loại việc nào nên giao cho model nào ngay từ đầu để giảm chi phí hoàn thành?

1. Thực sự đã ra mắt những gì

OpenAI phát hành GPT-6 Sol và GPT-6 Luna qua API ngày 22/9/2026, đồng thời đưa chúng vào ChatGPT Work và Codex.[1][2]

Sol hướng tới coding phức tạp và agentic workflow. Luna tối ưu cho tác vụ tập trung, khối lượng lớn. Cả hai có context window 1,05M và tối đa 128K token đầu ra.[3][4][5]

Astra nằm trên cùng cho các công việc end-to-end khó nhất, gồm coding, thao tác máy tính, nghiên cứu và tạo tài liệu.[6]

Có thể hình dung: Luna là nhân công sản xuất giá rẻ, Sol là người phụ trách hằng ngày, Astra là người bước vào phòng máy và hỏi ngay “dây này cắm ngược đúng không?”

2. Cạm bẫy của câu “GPT-6 đã vào ChatGPT”

Release Notes ngày 22/9 nói rõ Sol và Luna được thêm vào ChatGPT Work và Codex, đồng thời tách biệt với các model có trong Chat thông thường.[1]

Vì vậy “có trong sản phẩm ChatGPT” không đồng nghĩa với “chọn được trong cuộc trò chuyện Chat bình thường”.

Astra có rollout ChatGPT rộng hơn theo thông báo đầu tháng 9.[6] Cùng tên GPT-6 nhưng bề mặt sản phẩm khác nhau.

3. Giá niêm yết chênh lệch rất lớn

Giá Standard API trên 1 triệu token input/output vào 23/9/2026:[3][4][6][7][8][9]

Model Input Output
GPT-6 Luna $0.10 $0.50
GPT-6 Sol $2.00 $10.00
GPT-6 Astra $10.00 $50.00
GPT-5.6 Luna $0.20 $1.20
GPT-5.6 Terra $2.00 $12.00
GPT-5.6 Sol $4.00 $20.00

Với cùng lượng token, Sol khoảng 20 lần Luna và Astra 5 lần Sol.

Chỉ nhìn bảng này, dùng Luna cho mọi thứ có vẻ tuyệt vời. Giống như tiết kiệm phí chuyển nhà bằng cách tự vác tủ lạnh.

4. Mô phỏng đơn giản: 100K input + 20K output

Giả sử một tác vụ dùng 100.000 token input và 20.000 output, bỏ qua cache, phí tool, phụ phí context dài và retry.

Model Chi phí API ước tính mỗi lần
GPT-6 Luna $0.020
GPT-6 Sol $0.400
GPT-6 Astra $2.000
GPT-5.6 Luna $0.044
GPT-5.6 Terra $0.440
GPT-5.6 Sol $0.800

Nếu chỉ tính token, Luna thắng tuyệt đối.

Nhưng công thức hữu ích hơn là:

chi phí hoàn thành ≈ chi phí mỗi lần × số lần thử + thời gian con người + context bị mất

Nếu lượng token bằng nhau, một lần Astra xấp xỉ năm lần Sol. Nếu Sol cần năm lần còn Astra cần một, chi phí API đã ngang nhau.

5. Astra đắt hơn có thể rẻ hơn trên mỗi công việc

Trong Terminal-Bench 4.0, OpenAI báo GPT-6 Astra đạt 57,9%, GPT-5.6 Sol 37,3%, trong khi chi phí API ước tính trên mỗi task của Astra thấp hơn khoảng 9% ở cấu hình so sánh.[6]

AutomationBench: 41,4% so với 18,1%; task migration database nội bộ: 63,9% so với 42,7%.[6]

Giá mỗi token và giá để hoàn tất công việc không giống nhau.

Astra cũng đưa vào Codex cơ chế lưu và truy xuất context qua những session dài.[6] Điều này giúp giảm cảnh “quên tại sao bản sửa trước thất bại rồi tự tin thử lại đúng thứ đó”.

6. Route theo hình dạng công việc, không theo thứ tự rẻ→đắt

Không nên bắt mọi task va vào Luna→Sol→Astra.

Hãy phân loại trước, sau một thất bại có ý nghĩa thì nâng model.

GPT-6 Luna

  • tìm kiếm, trích xuất, phân loại, đổi định dạng
  • sửa nhỏ với đặc tả rõ
  • batch độc lập
  • chạy và tóm tắt test
  • tiêu chí thành công cơ học

GPT-6 Sol

  • implementation nhiều file thông thường
  • debug khi đã biết vùng nghi ngờ
  • agentic workflow tiêu chuẩn
  • nghiên cứu→sửa→test
  • model mặc định cho Codex

GPT-6 Astra

  • chưa biết root cause
  • vấn đề qua nhiều service, permission hoặc state
  • debug kéo dài
  • migration, refactor lớn
  • task luôn tới 80% rồi chết
  • task đã được Sol điều tra nghiêm túc một lần nhưng chưa khép lại

7. GPT-5.6 Terra còn đứng ở đâu

Giá Standard:

  • GPT-5.6 Terra: $2 / $12
  • GPT-6 Sol: $2 / $10

Input bằng nhau, output Sol rẻ hơn.[3][8]

Với workload mới, vị trí kinh tế của Terra trở nên khó thuyết phục hơn. Tuy nhiên Terra vẫn có thể hợp lý nếu cần tương thích, tái lập hoặc prompt đã được xác thực.

Thiết kế mới có thể đơn giản thành:

Luna=khối lượng, Sol=mặc định, Astra=khó.

8. Câu trả lời thật đến từ khoảng 20 task của chính bạn

Benchmark là bản đồ, không phải repository của bạn.

Chia công việc thật thành 3–5 nhóm, ghi lại khoảng 20 task mỗi nhóm:

  • hoàn thành không cần hướng dẫn người thêm
  • thời gian tới trạng thái green
  • số retry
  • token/credit
  • lượng log con người phải đọc
  • regression
  • tần suất cuối cùng vẫn phải đổi model

Tối ưu tổng chi phí trên mỗi task hoàn thành.

Kết luận: Sol làm mặc định, Luna cho khối lượng cơ học, Astra cho mê cung

GPT-6 Luna: rõ ràng, nhiều, độc lập.
GPT-6 Sol: công việc Codex thông thường.
GPT-6 Astra: mơ hồ, dài, xuyên nhiều hệ thống.

Mẫu đắt tiền thường không phải “dùng Astra”, mà là “tiết kiệm Astra bằng nhiều lần thất bại rồi cuối cùng vẫn dùng Astra”.

Con người đọc cùng một log lần thứ tư cũng là chi phí.


  1. OpenAI ChatGPT Release Notes help.openai.com
  2. OpenAI API Changelog developers.openai.com
  3. GPT-6 Sol developers.openai.com
  4. GPT-6 Luna developers.openai.com
  5. Models catalog developers.openai.com
  6. GPT-6 Astra openai.com
  7. GPT-5.6 Sol developers.openai.com
  8. GPT-5.6 Terra developers.openai.com
  9. GPT-5.6 Luna developers.openai.com

Hôm nay đọc bài này

Mỗi bài trả lời một câu hỏi mà người đọc bài này thường đặt ra tiếp theo.

Xem tất cả bài viếtThêm bài về AI

Chia sẻ bài viết này

Quảng cáo

Thêm một bài nữa? Có gì vui không?

Đọc xong rồi thì xem tiếp: vài bài gần chủ đề và vài bài khác hẳn nhưng thú vị.

  1. Gần chủ đềDùng AI để tạo AI mạnh nhấtAI Shadowverse WB yếu đi sau khi nhìn trước tương lai, rồi bắt đầu tính ngược đường thắng, đường thua và cả “chứng minh thắng bắt buộc”
  2. Ngài phán đoán đâu rồi!?Hiểu năng lực quyết định qua “độ rộng × lực đẩy” và “trục bản thân × trục người khác”
  3. Khác hẳn, nhưng thú vịVì sao RPG đứng đầu bảng xếp hạng vẫn có thể khiến ta “ừm…”BG3, Clair Obscur: Expedition 33 và sự khác nhau giữa “được đánh giá rất cao” với “hợp với mình”
  4. Tình yêu thời Heiankhông hẳn chỉ là waka tao nhã mà giống một kiểu “ghép đôi spam bằng tanka”?
  5. 5 giờ sángcơ thể bảo “ngủ đi”, não bảo “vẫn đang mở cửa”
  6. AURA từng có nghĩa là “làn gió nhẹ”từ Aura Máy Chém trong *Frieren* đến love hotel nơi “đời thường đã không còn nữa rồi mà”

Tìm bài viết khác

Tất cả bài viết

Mendoi-chan

Người vận hành trang

Mendoi-chan

Biến những vướng mắc trong công việc và đời sống hằng ngày thành cấu trúc rõ ràng và bước tiếp theo thực tế.