
Nếu hôm nay vẫn có người tiêu nhiều tiền nhất để gọi mô hình mạnh nhất của OpenAI.
OpenAI ngược lại sẽ khuyên anh ta đổi một cái khác.
Ngày 30 tháng 7, OpenAI đã ra thông báo điều chỉnh giá.
Mô hình GPT-5.6 Luna giảm giá 80%, mô hình Terra giảm giá 20%.
Thấy tin này, dễ dàng tập trung vào việc Thung lũng Silicon bắt đầu chiến tranh giá.
Nhưng nếu cẩn thận đọc xong tài liệu kỹ thuật và hướng dẫn gọi API do chính thức công bố, sẽ nhận ra, động thái đáng chú ý thực sự không nằm ở chính con số giá cả.
Về bản chất, đây là lần đầu tiên OpenAI bắt đầu nói với người dùng, rất nhiều nhiệm vụ, thực ra không cần dùng mô hình mạnh nhất.
Chính thức đưa ra một đề xuất rất cụ thể. Nếu là một nhiệm vụ phức tạp, trước tiên dùng GPT-5.6 Sol hoàn thành phân tích nhu cầu và thiết kế giải pháp, rồi giao cho Luna đi thực thi, viết code, chạy test.
Mô hình đắt nhất chịu trách nhiệm suy nghĩ, mô hình rẻ nhất chịu trách nhiệm làm việc. Chiến lược này nhìn từ hai năm trước, tương đương với việc tự phủ nhận về mặt thương mại.
Phải biết, trước đây cả ngành AI, tất cả mọi người đều cố gắng nói với thị trường mô hình của mình thông minh nhất.
Kết quả hôm nay, OpenAI lại đứng ra nói không cần lúc nào cũng mua cái đắt nhất.
Việc này, quan trọng hơn nhiều so với việc giảm giá.
Một. Sự ăn ý của hai hùng tướng Thung lũng Silicon
Trước tiên xem những việc xảy ra trong hai tuần gần đây.
Ngày 30 tháng 7, OpenAI điều chỉnh giá. Luna giảm 80%. Terra giảm 20%. Sol không giảm giá, mà tăng thêm chế độ Fast, cao nhất có thể nhanh hơn 2.5 lần so với chế độ tiêu chuẩn, giá gấp đôi, nhưng trình độ thông minh hoàn toàn giống nhau.
Mô hình đỉnh cao tiếp tục giữ lại. Thực sự bắt đầu đi lượng, là trung và thấp cấp.
Lùi lại một tuần trước đó.
Ngày 24 tháng 7, Anthropic cũng làm một việc gần như giống hệt. Claude Opus 5 ra mắt, triệu token đầu vào 5 đô la, đầu ra 25 đô la. Chính xác chỉ bằng một nửa của Fable 5.
So với đột phá hiệu năng, Anthropic đối ngoại càng nhấn mạnh tính kinh tế của nó: chỉ với một nửa giá, có thể có được năng lực suy luận tiên phong vô hạn gần Fable 5.
Chỉ một tháng trước, Fable 5 vẫn là flagship được Anthropic tập trung tuyên truyền. Suy luận mạnh nhất, ngữ cảnh dài nhất, giá cao nhất. Kết quả một tháng sau, Anthropic tự mình tìm cho flagship một sản phẩm thay thế với giá bằng nửa.
Nếu chỉ một nhà làm vậy, có thể hiểu là điều chỉnh sản phẩm. Hai nhà gần như đồng thời, không phải là trùng hợp.
Họ đều bắt đầu chủ động giảm tầm quan trọng của mô hình flagship.
Hai. Flagship chịu trách nhiệm đứng đài, đi lượng chịu trách nhiệm kiếm tiền
Tôi sau đó cứ suy nghĩ, tại sao lại là bây giờ.
Đáp án thực ra không phức tạp.
Trước đây giá trị lớn nhất của mô hình flagship, không phải là kiếm tiền, là chứng minh dẫn đầu công nghệ. GPT-4 ra đời sau, định giá OpenAI tăng một mạch. Claude mỗi cập nhật một lần, Anthropic đều định nghĩa lại vị trí công nghệ của mình. Mô hình flagship đảm nhận là giá trị thương hiệu.
Nhưng doanh nghiệp thực sự tiêu tiền chỗ, không ở đây.
Một doanh nghiệp mỗi ngày phải chạy vài triệu lần gọi API. Dịch vụ khách hàng, tìm kiếm, phê duyệt, tạo mã, thực thi Agent, những nhiệm vụ tần suất cao này chiếm đại đa số tiêu hao Token. Doanh nghiệp mua hàng quan tâm nhất, cũng không phải Benchmark thứ nhất, là một nhiệm vụ bao nhiêu tiền, có đủ ổn định không, ROI có cao không.
Khi quy mô gọi mở rộng đến cấp hàng chục triệu mỗi ngày, ưu thế thông minh yếu ớt của mô hình flagship, sẽ bị chi phí tính toán khổng lồ trong khoảnh khắc xóa sạch.
Động thái và thái độ của OpenAI đánh dấu một bước ngoặt:Flagship đỉnh cao không còn đảm đương trọng trách kiếm tiền.
Ba. AI bắt đầu bước vào thời đại "dòng xe đại chúng"
Cảnh này, ngành ô tô sớm đã trải qua.
Hai mươi năm trước, dòng 7 định nghĩa chiều cao BMW, dòng S chống đỡ điệu sang trọng Mercedes, A8 xác lập hình ảnh flagship Audi, dòng xe flagship quyết định trần thương hiệu. Nhưng cơ sở thực sự chống đỡ doanh số, kiếm lợi nhuận của thương hiệu, luôn là BMW dòng 3, Mercedes C-Class và Audi A4.
Sau này càng rõ ràng. Model S chứng minh Tesla có thể sản xuất ô tô. Thực sự khiến nó trở thành nhà sản xuất ô tô toàn cầu, là Model 3 và Model Y.
Flagship chịu trách nhiệm chứng minh năng lực, dòng xe đại chúng chịu trách nhiệm quy mô.
AI hôm nay cũng bắt đầu bước vào giai đoạn này. Sol, Fable sẽ tiếp tục tồn tại, họ chịu trách nhiệm xung kích trần công nghệ, làm mới Benchmark. Thực sự đảm đương thương mại hóa, sẽ ngày càng trở thành Luna, Terra, Opus.
OpenAI lần này thậm chí công khai viết ra quy trình đề xuất, Sol chịu trách nhiệm hoạch định, Luna chịu trách nhiệm thực thi.
Đây đã không phải là một mô hình, OpenAI đang thiết kế một bộ phân công mô hình. Sau này doanh nghiệp mua, cũng không phải một mô hình, là một hệ thống mô hình toàn bộ. Thực sự quyết định chi phí, không phải tổng thiết kế sư, là đội thi công mỗi ngày đều đang làm việc.
Bốn. Mô hình bắt đầu tối ưu hóa mô hình
Còn một chi tiết, tôi cảm thấy thú vị hơn chính việc giảm giá.
OpenAI trong giải thích kỹ thuật có đề cập, lần giảm giá này, không chỉ vì mua thêm GPU, cũng không phải vì quy mô lớn hơn.Nguyên nhân thực sự, là mô hình bắt đầu tham gia tối ưu hóa mô hình.
Cụ thể, dưới sự dẫn dắt của kỹ sư con người, Sol tự viết lại và tối ưu hóa hạt nhân sản xuất tầng dưới. Nó tự thiết kế hàng trăm thí nghiệm, nâng cao hiệu suất tạo Token, thậm chí tham gia giám sát quy trình huấn luyện mô hình, phát hiện vấn đề sau trực tiếp can thiệp.
Kết quả là, chi phí chạy end-to-end giảm 20%, hiệu suất tạo Token tăng 15%.
Thông tin này dễ bị bỏ qua, nhưng ý nghĩa nó đại diện rất lớn.
Trước đây, nâng cao hiệu suất dựa vào kỹ sư. Mô hình lên tuyến sau, người một
chút chút
tối ưu hóa khung suy luận, CUDA, chiến lược cache, thuật toán điều phối. Một năm xuống, có thể vắt ra vài chục điểm phần trăm nâng cao hiệu suất, đã không tệ.
Ngày nay tiến hóa công nghệ đi vào con đường mới. Mô hình bắt đầu tiếp quản tối ưu hóa công trình của code tầng dưới và điều phối tính toán, lặp lại chạy suốt ngày.
Đây là một vòng lặp sẽ liên tục tăng tốc. Mô hình càng thông minh, năng lực tham gia tối ưu hóa càng mạnh. Tối ưu càng nhanh, chi phí giảm càng nhanh. Chi phí càng thấp, lượng gọi càng lớn. Lượng gọi càng lớn, tạo ra nhiều dữ liệu hơn, tiếp tục huấn luyện mô hình.
Lật lại biến động giá nửa năm qua của OpenAI. GPT-4 ra mắt đầu vào 30 đô la / triệu Token, GPT-4o giảm xuống 5 đô la, GPT-4o mini làm đến 0.15 đô la. Ngày nay Luna định giá áp sát vùng giá rẻ mini thời sớm, nhưng trình độ thông minh tổng thể của nó, sớm đã vượt xa GPT-4 đắt đỏ hai năm trước.
Hơn hai năm thời gian, giá giảm gần hai bậc số lượng. Nếu mô hình tiếp tục tham gia tối ưu hóa chính mình, đường cong này, xác suất lớn sẽ tiếp tục đi xuống.
Thực sự đáng sợ không phải hôm nay giá giảm 80%, là sự giảm chi phí bắt đầu có năng lực tự động.
Năm. Từ ai thông minh nhất đến ai đáng giá nhất
Tôi càng cảm thấy, hôm nay mọi người đang thảo luận cạnh tranh AI, đôi lúc vẫn sẽ áp dụng khung của giai đoạn trước.
Ví dụ, thường xuyên vẫn sẽ truy hỏi: ai thông minh nhất? GPT, Claude, Gemini,
DeepSeek
, mỗi lần ra mắt một mô hình mới, truyền thông thời gian đầu tiên xem đều là bảng xếp hạng. Ai thứ nhất, ai thắng.
Tuy nhiên động thái mới của OpenAI và Anthropic phá vỡ quy luật này, họ truyền tín hiệu mới đến thị trường:Sức hút của quán quân hiệu năng đơn hạng đang suy giảm.
OpenAI trong thông báo đề cập một câu, tôi cảm thấy đặc biệt then chốt, nó đề nghị nhà phát triển dựa vào mức độ quan trọng, cái giá sai lầm, mức độ khẩn cấp và quy mô của nhiệm vụ, để kết hợp mô hình khác nhau.
Chú ý, nó thảo luận đã không phải là mô hình, là nhiệm vụ.
Trước đây, một doanh nghiệp triển khai AI, đa số thời gian chỉ có một lựa chọn. Hôm nay bắt đầu, nó giống như đang xây dựng một tổ chức. Nhiệm vụ quan trọng nhất dùng Sol, thực thi hàng ngày giao Luna, sau này có thể còn có mô hình nhẹ hơn chịu trách nhiệm việc đơn giản hơn.
Điều này và điện toán đám mây năm đó đặc biệt giống. Không ai đặt toàn bộ dữ liệu, đều trên SSD đắt nhất. Dữ liệu nóng đặt SSD, dữ liệu thường đặt HDD, dữ liệu lạnh lại đặt lưu trữ đối tượng. Mọi người thảo luận, không bao giờ là ổ cứng nào nhanh nhất, mà là toàn bộ hệ thống xây dựng thế nào hợp lý nhất.
DeepSeek
thực ra so Thung lũng Silicon sớm hơn ngửi được hướng này. Nửa năm qua, nó hầu như không nhấn mạnh mình nhất định thông minh nhất toàn cầu, lặp lại nói chỉ vài từ:rẻ, đủ nhanh, đủ dùng.
Cache trúng sau, mỗi triệu Token rẻ đến gần như có thể bỏ qua. Nó luôn đặt cược một việc, doanh nghiệp cần không phải quán quân thế giới, mà là lựa chọn triển khai ROI tổng hợp cao nhất.
Đây không phải chiến tranh giá ngắn hạn, hai gã khổng lồ Thung lũng Silicon ngày nay theo kịp, xác minh tính tất yếu của con đường thương mại này.
Sáu. OpenAI thực sự muốn bán, không phải mô hình
Đến hôm nay, chiến lược của OpenAI rất rõ ràng, thứ nó thực sự muốn bán, đã không phải là mô hình, là lượng gọi.
Trước đây nhà sản xuất mô hình dựa vào cao kỹ thuật premium thu lợi nhuận gộp cao, bây giờ logic kinh doanh chuyển thành lấy cực thấp ngưỡng cửa đổi siêu quy mô lớn hệ sinh thái lưu lượng.
Microsoft thực sự kiếm tiền, không phải vì Windows bán đắt, là vì tất cả máy tính đều cài Windows. AWS kiếm tiền cũng không phải vì lợi nhuận một máy chủ cao, là vì cả thế giới mỗi ngày có vô số ứng dụng chạy trên đó.
Thu nhập nền tảng, dựa vào chưa bao giờ là tỷ lệ thâm nhập.
Điều này giải thích tại sao giá Sol luôn không động. Sol đảm nhận là thương hiệu, nó chứng minh OpenAI vẫn là công ty có trần công nghệ cao nhất. Mà Luna mới là động cơ thu nhập.
OpenAI hy vọng nhà phát triển hình thành một thói quen mặc định mới, viết Agent dùng Luna, chạy workflow dùng Luna, thực thi hàng loạt cũng dùng Luna. Chỉ gặp vấn đề thực sự khó, mới gọi một lần Sol.
Một khi mặc định này xây dựng lên, cạnh tranh phía sau sẽ trở nên rất khó khăn. Doanh nghiệp di chuyển một lần mô hình tầng dưới, có nghĩa là kiểm tra lại, xác minh, thích ứng toàn bộ workflow. Chi phí di chuyển sẽ ngày càng cao.
Hào bảo vệ thực sự, đã bắt đầu từ dẫn đầu năng lực trở thành độ dính hệ sinh thái.
Bảy. Mô hình flagship, không còn quyết định hướng
Kéo dài thời gian nhìn, ngành AI đang trải qua một điểm ngoặt kinh tế quy mô cực kỳ điển hình.
Khi chi phí đơn vị tính toán giảm đến cực thấp, tổng nhu cầu Token của thị trường không giảm theo giá đơn vị giảm, mà trái lại bùng nổ cấp số mũ.
Mô hình flagship không còn quyết định hướng, vì trọng tâm tiến hóa công nghệ đã từ khám phá trần thông minh, chuyển dịch đến giảm chi phí công nghiệp hóa tính toán. Khi chi phí gọi API thấp đến có thể bỏ qua, hình thái và biên giới của mô hình sẽ bắt đầu mờ nhạt.
Nhà phát triển doanh nghiệp không còn quan tâm từng Token tiêu hao, mà là khảm vô hình AI vào mỗi quy trình nghiệp vụ.
Nơi chuyển biến sâu sắc nhất của sự chuyển đổi này nằm ở, tuyết lở giá API đang đẩy cao chi phí di chuyển toàn bộ kỹ thuật phần mềm. Một khi workflow, mạng điều phối Agent và đường ống dữ liệu tự động hóa toàn bộ của doanh nghiệp xây dựng trên sự kết hợp của mô hình chi phí thấp, nhà cung cấp mô hình tầng dưới đã khóa đường ống tính toán mười năm tương lai.
Mấy năm qua, công ty mô hình lớn bán là thông minh. Từ hôm nay bắt đầu, họ bắt đầu bán hiệu suất.
Đây là hai câu chuyện hoàn toàn khác nhau.
Lời nói của [Bên ngoài trang]:
Trước đây chúng ta quen so sánh sự phát triển của AI với điện tử tiêu dùng, mong đợi thỉnh thoảng có flagship hoàn toàn mới làm mới kỷ lục.
Nhưng có lẽ, hình thái thắng lợi thực sự của AI, không phải trở thành sản phẩm gây chấn động nhất thời.
Động cơ hơi nước vừa phát minh, người ta kinh ngạc với sức sản xuất của nó, mà hôm nay, điện lực chảy tràn khắp nơi, điều khiển vận chuyển của toàn bộ văn minh, nhưng lại không có ai sẽ chuyên môn thảo luận nó.
Khi con người không còn nhiệt liệt thảo luận flagship nào lại làm mới điểm chạy IQ hạng nào, AI lặng lẽ khảm vào mỗi hệ thống, mỗi chỉ lệnh, trở thành nước và điện được gọi mặc định đằng sau mọi quy trình tự động hóa.
Thời đại thực sự thuộc về nó, mới tính vừa bắt đầu.
Bài viết này đến từ tài khoản WeChat công chúng "Bên ngoài trang", tác giả: Họa Họa








