
Phiên bản nhập môn Luna giảm giá cực mạnh, giá đầu vào mỗi triệu Token từ 1 USD giảm còn 0.2 USD, giá đầu ra từ 6 USD giảm còn 1.2 USD.
Tính sang tiền Việt Nam, tương đương giá đầu vào từ khoảng 6.8 đồng giảm còn 1.35 đồng, giá đầu ra từ khoảng 40.6 đồng giảm còn 8.1 đồng.
Mẫu định vị "lực lượng lao động chính hàng ngày" là Terra cũng giảm 20%, giá đầu vào và đầu ra lần lượt giảm còn 2 USD và 12 USD.
Tính sang tiền Việt Nam, tương đương khoảng 13.5 đồng và 81.2 đồng.
Chỉ có mẫu flagship Sol là giữ nguyên giá, nhưng ra mắt Fast mode (Chế độ Nhanh), tốc độ tối đa đạt gấp 2.5 lần chế độ tiêu chuẩn, tăng tốc không tăng giá.

Kể từ khi Codex liên tục reset hạn mức sử dụng, việc giảm giá cũng đã được lên kế hoạch ngay lập tức, OpenAI muốn cuốn chết ai đây...
Cuộc chiến giá cả đã trở nên cực kỳ khốc liệt.
OpenAI cho biết, việc giảm giá là vì GPT-5.6 Sol tự giúp mình tiết kiệm tiền.
GPT-5.6 Sol tham gia cải tiến chính mình, hiệu quả đã có bước nhảy vọt, nên đặc biệt tri ân người dùng mới và cũ ~
Trò dẫm chân trái lên chân phải để bay tại chỗ này, OpenAI cũng đã chơi rồi

。
Hai Mẫu Giảm Giá, Một Mẫu Tăng Tốc
Hiện tại, giá API của ba mẫu GPT-5.6 lần lượt là:
GPT-5.6 Luna: Mỗi triệu Token đầu vào 0.2 USD, đầu ra 1.2 USD;
GPT-5.6 Terra: Mỗi triệu Token đầu vào 2 USD, đầu ra 12 USD;
GPT-5.6 Sol: Mỗi triệu Token đầu vào 5 USD, đầu ra 30 USD.

Sau khi giảm giá, Luna thuộc dạng nhảy vọt một bước lớn.
Giá đầu vào của nó đã ngang bằng với thế hệ trước GPT-5.4 nano, giá đầu ra thậm chí còn rẻ hơn 0.05 USD.
Nhưng công việc của hai mẫu không hoàn toàn giống nhau, GPT-5.4 nano chủ yếu hướng đến các nhiệm vụ đơn giản tần suất cao như phân loại, trích xuất thông tin và xếp hạng.
GPT-5.6 Luna thì được OpenAI định vị là mẫu hướng đến khối lượng công việc nhạy cảm về chi phí, có thể gọi công cụ, xử lý ngữ cảnh dài, thực thi quy trình công việc nhiều bước.
Nói đơn giản, OpenAI đang bán mô hình hỗ trợ Agent làm việc với mức giá của các mô hình nhỏ đơn giản trước đây.
Terra tương đối kiềm chế, giảm 20%.
Sol thì giữ nguyên giá, bổ sung thêm Fast mode, tốc độ tối đa đạt 2.5 lần chế độ tiêu chuẩn, giá thì gấp đôi chế độ tiêu chuẩn, trình độ thông minh của mô hình không thay đổi.
Nó cũng sẽ thay thế cho Priority Processing trước đây. Các yêu cầu API trước đây sử dụng nhãn Priority có thể tự động chuyển sang Fast mode.
Bên chính thức cho biết, đợt điều chỉnh này cũng sẽ được áp dụng vào Codex và ChatGPT Work.
Giá đăng ký sẽ không giảm, tổng hạn mức của người dùng cũng không tăng, nhưng khi gọi Terra và Luna, hạn mức tiêu hao sẽ giảm tương ứng.
Cùng một khoản phí đăng ký, có thể để mô hình làm việc nhiều lần hơn.
OpenAI còn tiện tay thay mô hình Auto-review trong ChatGPT và Codex CLI từ GPT-5.4 thành GPT-5.6 Luna.
Auto-review chịu trách nhiệm kiểm tra mã và kết quả chỉnh sửa ở hậu trường, thuộc loại nhiệm vụ Agent tần suất cao điển hình.
Kết hợp nâng cấp mô hình và giảm giá Luna, OpenAI dự kiến chi phí của nó sẽ giảm xuống còn khoảng một phần mười so với trước.
Mô hình rẻ không còn chỉ chịu trách nhiệm phân loại, trích xuất những "việc lặt vặt" truyền thống, mà bắt đầu tham gia vào các khâu cần phán đoán và gọi công cụ như kiểm tra mã, giám sát hậu trường.
Hiện tại, định vị của ba mẫu là:
Nhiệm vụ nhạy cảm ngân sách, lượng gọi lớn giao cho Luna;
Công việc hàng ngày thông thường giao cho Terra;
Nhiệm vụ khó cao tiếp tục sử dụng Sol;
Nếu thậm chí còn chán chờ chậm, hãy trả thêm gấp đôi tiền để mua tốc độ.
GPT-5.6 Bắt Đầu Tham Gia Tự Giảm Chi Phí Cho Mình
Tại sao đột nhiên giảm giá?
OpenAI cho biết, nguyên nhân là vì GPT-5.6 Sol tham gia tối ưu hóa hệ thống sản xuất của chính mình.
Hiệu quả mà nó nâng cao, sau đó chuyển hóa thành những con số chiết khấu trên bảng giá.
Cụ thể, GPT-5.6 Sol viết lại và tối ưu hóa một phần GPU Kernel trong môi trường sản xuất, thiết kế và chạy hàng trăm thí nghiệm tạo Token, còn tham gia giám sát huấn luyện, can thiệp khi có vấn đề.
Cuối cùng thành tích cũng rất nổi bật: Tối ưu hóa GPU Kernel sản xuất, giúp chi phí dịch vụ end-to-end GPT-5.6 giảm 20%; Cải tiến giải mã suy đoán, giúp hiệu quả tạo Token tăng trên 15%.

GPU Kernel có thể hiểu là chương trình cấp thấp mà mô hình thực thi nhiệm vụ tính toán cụ thể trên GPU.
Bản thân mô hình không cần thay đổi, chỉ cần các chương trình này viết hiệu quả hơn, cùng một GPU có thể hoàn thành tính toán nhanh hơn, xử lý nhiều yêu cầu hơn, chi phí cho mỗi lần gọi cũng sẽ giảm theo.
Giải mã suy đoán là khi tạo câu trả lời, trước tiên hàng loạt "đoán" Token có thể xuất hiện tiếp theo, sau đó giao cho mô hình chính xác minh. Đoán càng chuẩn, các bước cần tạo lần lượt và chờ đợi càng ít.
Hai tối ưu hóa đều không làm giảm khả năng của mô hình, nhưng lại có thể giúp cùng một mô hình chạy nhanh hơn, rẻ hơn.
Tuy nhiên, đây vẫn chưa phải là GPT-5.6 hoàn toàn tự nâng cấp chính mình.
OpenAI đặc biệt nhấn mạnh, toàn bộ quá trình vẫn do con người dẫn dắt.
Mô hình có thể viết mã, chạy thí nghiệm, giám sát ngoại lệ, nhưng mục tiêu đặt ra thế nào, kết quả có dùng được không, mã có vào môi trường sản xuất không, vẫn cần "Human in the Loop" (Con người trong vòng lặp).
Một Suy Nghĩ Khác
Cuối cùng, còn có một thay đổi mới.
Lần giảm giá này có một điểm rơi cụ thể: Quy trình công việc Agent.
Luna - mẫu giảm giá mạnh nhất, không chỉ là mô hình nhỏ truyền thống dùng để phân loại, trích xuất.
Theo định vị của OpenAI, nó có thể gọi công cụ, thực thi nhiệm vụ nhiều bước, chủ yếu hướng đến khối lượng công việc tần suất cao, nhạy cảm về chi phí.
Vì vậy, Luna giảm 80%, cũng là hạ thấp ngưỡng vận hành lâu dài của Agent.
Giúp các nhiệm vụ kiểm tra, xác minh và giám sát vốn không thể thực hiện thường xuyên do chi phí quá cao, có cơ hội trở thành bước thường quy trong quy trình công việc.
Kết hợp với việc GPT-5.6 tham gia tối ưu hóa hệ thống sản xuất của chính mình, một chu kỳ mới xuất hiện:
Mô hình tham gia nâng cao hiệu quả vận hành, chi phí giảm; Giá giảm, mô hình thâm nhập vào nhiều quy trình công việc tần suất cao hơn; Quy mô gọi mở rộng, lại thúc đẩy đợt tối ưu hóa hiệu quả tiếp theo.
Bánh xe bay giảm giá của OpenAI, đã lộ diện hình dáng ban đầu.
Sau loạt thao tác này, giờ đây áp lực trực tiếp dồn lên A xã:
"Đến lượt bạn rồi."

Liên kết tham khảo:[1]https://x.com/OpenAI/status/2082878156483219672[2]https://x.com/sama/status/2082880720989532597
Bài viết này đến từ tài khoản công chúng WeChat "量子位", tác giả: Quan tâm đến công nghệ tiên phong







