Trang chủ / Tin tức / Tin tổng hợp
TIN TỔNG HỢP

OpenAI ra mắt GPT-6 Sol và Luna, giá API giảm một nửa

OpenAI bổ sung GPT-6 Sol và GPT-6 Luna cho gia đình GPT-6, kèm mức giảm giá API 50% và cải thiện prompt caching cho agent.

TopUngDung·23/09/2026·5 phút đọc·3 lượt xem
OpenAI ra mắt GPT-6 Sol và Luna, giá API giảm một nửa

Ngày 22/09/2026, OpenAI giới thiệu GPT-6 Sol và GPT-6 Luna, hai model mới nối tiếp GPT-6 Astra ra mắt hồi đầu tháng. Điểm đáng nói không nằm ở việc thông minh hơn bao nhiêu, mà ở giá: OpenAI nói giảm giá API của Sol và Luna 50% so với mức giá khuyến mãi của GPT-5.6.

Với người dùng Việt Nam, thay đổi này chủ yếu tác động tới hai nhóm. Nhóm thứ nhất là đội làm sản phẩm, startup đang gọi API để xây tính năng AI, nơi chi phí mỗi triệu token giảm một nửa là chuyện lớn. Nhóm thứ hai là người dùng ChatGPT Work và Codex, vì hai model mới có mặt ở đó ngay từ đầu.

GPT-6 Sol và Luna là gì

Theo OpenAI, Sol và Luna được huấn luyện bằng phương pháp tương tự GPT-6 Astra, mang các tiến bộ về công việc chuyên môn, độ xác thực, viết code và điều khiển máy tính xuống những model nhanh và rẻ hơn. Astra vẫn là model mạnh nhất trong dải sản phẩm, còn Sol và Luna nhắm vào hiệu quả chi phí.

Nói gọn: nếu Astra dành cho việc khó nhất, Sol và Luna để chạy các tác vụ hằng ngày với chi phí dễ chịu hơn. Cách đặt tên này khá rõ, nhưng cũng dễ khiến người dùng nhầm rằng Sol và Luna là bản thay thế Astra. Không phải, chúng là lựa chọn rẻ hơn trong cùng gia đình GPT-6.

Giá API giảm một nửa

Đây là phần đáng quan tâm nhất với đội phát triển. OpenAI nêu giá theo 1 triệu token:

  • GPT-6 Sol: input từ 4 USD xuống 2 USD, output từ 20 USD xuống 10 USD.
  • GPT-6 Luna: input từ 0,20 USD xuống 0,10 USD, output từ 1,20 USD xuống 0,50 USD.

Cả hai đều giảm 50% so với giá khuyến mãi của các bản GPT-5.6 tương ứng. OpenAI nói phần tiết kiệm từ caching và suy luận hiệu quả được chuyển thẳng cho người dùng, thay vì giữ lại. Với một tính năng chạy hàng triệu lượt gọi mỗi tháng, mức giảm này thay đổi bài toán chi phí theo cách nhìn thấy được trên hoá đơn.

Caching tốt hơn cho agent và hội thoại dài

Song song với việc giảm giá token, OpenAI cải thiện prompt caching cho GPT-6 để đạt tỉ lệ cache hit cao hơn theo mặc định. Nhờ đó agent dùng lại được nhiều ngữ cảnh hơn, phản hồi nhanh hơn, và phần input đọc từ cache được giảm giá 90%.

Về công cụ đo, có Prompt Caching Dashboard để xem lượng input được cache và thay đổi theo thời gian, cùng công cụ chẩn đoán giải thích vì sao có cơ hội cache bị bỏ lỡ và cần sửa gì. Nhà phát triển cũng có explicit breakpoints, tức tự chọn chỗ kết thúc tiền tố được cache, để kiểm soát việc tái sử dụng cache tốt hơn.

Một chi tiết đáng chú ý: bạn có thể tăng hoặc giảm reasoning effort cho việc khó dễ khác nhau, và bật tắt công cụ tuỳ nhu cầu, mà hai thao tác này nay vẫn giữ ngữ cảnh trước đó cho cache. Trước kia, đổi thiết lập giữa chừng thường làm mất cache. OpenAI dẫn số liệu từ GitHub rằng trong vài tháng qua, các cải thiện này đã giảm hơn 50% tỉ lệ token prompt phải xử lý mới, trên hàng tỉ yêu cầu.

Ai được dùng model nào

Theo OpenAI, từ ngày công bố, GPT-6 Sol và GPT-6 Luna có trong ChatGPT Work và Codex cho mọi người dùng Plus, Pro, Business, Enterprise và Edu. Người dùng gói Free và Go được dùng GPT-6 Luna trong ứng dụng desktop.

Một điểm cần lưu ý: hai model này chưa có trong Chat, và OpenAI nói sẽ triển khai dần trong ngày. Nếu bạn chưa thấy model mới, hãy thử lại sau. Trên API, tên gọi là gpt-6-sol và gpt-6-luna.

Có gì khác ngoài giá

OpenAI nói Sol và Luna mang phong cách giao tiếp cải thiện của Astra sang, dễ thấy nhất trong các cuộc trao đổi kỹ thuật và viết code: rõ ràng hơn, ít thuật ngữ, ít chi tiết vô ích và trả lời ngắn hơn một chút mà không mất nội dung. Về an toàn, hai model này cũng giảm tỉ lệ tuyên bố sai lệch về công việc code so với bản GPT-5.6 tương ứng.

So với lựa chọn khác trên thị trường

Việc OpenAI giảm giá mạnh đặt áp lực lên các lựa chọn cùng phân khúc. Claude của Anthropic và Gemini của Google là hai đối thủ trực tiếp ở mảng model cho doanh nghiệp. Với người dùng cuối, ChatGPT vẫn là cửa vào quen thuộc, còn Codex dành cho ai muốn agent viết code. Nếu bạn dùng Copilot trong IDE, các model OpenAI cũng xuất hiện ở đó qua những bản cập nhật riêng, ví dụ trong GitHub Copilot.

Nên làm gì bây giờ

Nếu bạn đang trả tiền API, việc đầu tiên là xem lại mức dùng hiện tại rồi thử đổi một phần lưu lượng sang Sol hoặc Luna để đo chất lượng trên chính bài toán của mình. Đừng đổi toàn bộ ngay, vì kết quả khác nhau tuỳ tác vụ. Nếu bạn là người dùng ChatGPT, chỉ cần mở ChatGPT Work hoặc Codex để kiểm tra model đã có chưa.

Thông tin về giá và gói có thể thay đổi, nên bạn kiểm tra lại trang chính thức của OpenAI trước khi tính toán. Nguồn: thông báo của OpenAI. Xem thêm bài đánh giá ChatGPT trên TopỨngDụng.