Phiên bản ‘đầy đủ máu’ DeepSeek V4 đã lộ diện, có thể ra mắt sớm nhất vào ngày mai

marsbitXuất bản vào 2026-07-19Cập nhật gần nhất vào 2026-07-19

Tóm tắt

DeepSeek V4 phiên bản đầy đủ (“Full Blood”) đã lộ diện và có thể được ra mắt sớm nhất vào ngày mai. Bài viết cho biết sau gần ba tháng chờ đợi, phiên bản chính thức của DeepSeek V4 (GA) sắp được phát hành, với hai biến thể: V4 Flash và V4 Pro. Hiện một số người dùng đã có quyền truy cập thử nghiệm. Một mẹo kiểm tra là xem lập luận (CoT) của mô hình bắt đầu bằng “I’m” thay vì “Let me” như phiên bản cũ. Theo đánh giá ban đầu từ các nhà phát triển, hiệu năng tổng thể của V4 tiếp cận mức Claude Opus 4.8, khả năng lập trình ngang ngửa GPT-5.6 Sol, và kỹ năng Agent, tạo 3D/SVG được cải thiện rõ rệt. Tuy nhiên, nó vẫn có thể không vượt mặt Kimi K3 mới ra mắt. Điểm đáng chú ý là chiến lược định giá. DeepSeek lần đầu giới thiệu cơ chế tính phí theo giờ cao điểm/thấp điểm. Cụ thể, V4 Pro có giá 0.87 USD cho triệu token xuất (cao điểm: 1.74 USD), còn V4 Flash chỉ 0.28 USD (cao điểm: 0.56 USD). Dù có tăng giá so với trước, mức giá này vẫn cạnh tranh mạnh so với các đối thủ như Fable 5 (50 USD/triệu token xuất). Như vậy, DeepSeek V4 có thể không phải là mô hình mạnh nhất mọi mặt, nhưng tiếp tục duy trì chiến lược “kẻ hủy diệt giá” bằng cách cung cấp hiệu năng cao với mức giá thấp đáng kể, tạo ra một cú hích lớn trong cộng đồng AI.

Cả mạng đã chờ gần ba tháng!

DeepSeek V4 phiên bản chính thức, có thể ra mắt sớm nhất vào ngày mai, muộn nhất là vài ngày tới.

Hiện tại, một số người đã nhận được quyền truy cập thử nghiệm trước (grayscale) cho DeepSeek V4(GA).

Có hai phiên bản: DeepSeek V4 Flash, DeepSeek V4 Pro.

DeepSeek V4 「Phiên bản đầy đủ máu」

Cuối cùng cũng sắp ra mắt

Điều mọi người quan tâm nhất chắc hẳn là, làm sao để biết mình có được chọn vào thử nghiệm grayscale hay không?

Blogger AiBattle đã đưa ra một "câu thần chú" dân gian để "kiểm tra hàng": nhìn vào ngôi thứ nhất trong chuỗi suy nghĩ (CoT).

Nếu quá trình suy nghĩ của mô hình bắt đầu bằng "I'm" (Tôi là), "I'll" (Tôi sẽ), thay vì "Let me" (Để tôi) của phiên bản cũ.

Vậy thì xin chúc mừng, bạn có khả năng cao đang sử dụng phiên bản V4 GA rồi đấy!

Trong bối cảnh Fable 5 và GPT-5.6 Sol đang giằng co kịch liệt, sự mong đợi của toàn mạng đối với "đòn chí mạng" AI mã nguồn mở có thể nói là đã lên đến đỉnh điểm.

Một nhà phát triển Pankaj Kumar sau khi trải nghiệm đã sớm đưa ra một tổng kết khách quan về hiệu năng của V4:

Hiệu năng tổng thể gần mức Opus 4.8, lập trình đuổi kịp GPT-5.6 Sol;

Khả năng Agent được tăng cường mạnh mẽ, tạo hình 3D và SVG cải thiện đáng kể;

Cùng một nhiệm vụ, V4 cần số vòng lặp nhiều hơn so với Fable 5.

Ông cho biết, từ góc độ vị thế hiện tại, V4 nhiều khả năng không đánh bại được Kimi K3 vừa ra mắt, nhưng giá sẽ thấp hơn đáng kể.

Nếu hiệu năng này đi kèm với mức giá này, thì có lẽ đây sẽ lại là một DeepSeek Moment nữa.

Đợt thử nghiệm đầu tiên đã có kết quả

Hiện nay, demo thử nghiệm đầu tiên của DeepSeek V4(GA) đã bắt đầu lan truyền ra bên ngoài.

Có thể nói, thế giới bên ngoài có những đánh giá trái chiều:

Có người cho rằng nó đã có thể sánh ngang Claude 5, nhưng một số nhà phát triển cũng chỉ ra rằng phiên bản Pro không vượt trội hơn phiên bản Flash quá nhiều.

Dưới đây là một trò chơi bắn súng mô phỏng 3D được tạo bởi V4 Pro, lối chơi chính là điều khiển máy bắn đá (ballista) để tập bắn bia, các chức năng UI cơ bản cũng đã hoàn thiện.

Một trò chơi HTML lai giữa "Minecraft" và "No Man's Sky" do phiên bản chính thức V4 tạo ra, độ khả thi chơi vẫn khá cao.

Trò chơi kinh điển "Cut the Rope" dưới đây, cũng được V4 tạo ra một lần.

Dưới đây cũng là một số demo do V4 tạo ra, một bài kiểm tra SVG tay cầm Xbox, và cả việc tạo trò chơi.

Lần đầu tiên áp dụng "Tính phí theo giờ cao điểm/thấp điểm"

Vẫn rất "thơm"

Để tái tạo " DeepSeek Moment", yếu tố thay đổi lớn nhất là giá cả.

Tất cả các tin đồn đều chỉ về cùng một nhận định: hiệu năng có thể không đứng đầu, nhưng giá sẽ thấp hơn đáng kể.

Cuối tháng trước, DeepSeek đã gửi một email cho tất cả người dùng API, thông báo sắp ra mắt phiên bản chính thức V4 vào giữa tháng 7.

Sau khi GA ra mắt sẽ đồng thời điều chỉnh giá API, áp dụng "Tính phí theo giờ cao điểm/thấp điểm".

deepseek-v4-pro: 1 triệu token đầu ra bình thường 0.87 USD, cao điểm 1.74 USD; đầu vào không trúng cache bình thường 0.435 USD.

deepseek-v4-flash còn "ác" hơn: 1 triệu token đầu ra 0.28 USD, cao điểm 0.56 USD, đầu vào trúng cache 0.0028 USD.

Điều đó có nghĩa là, "Kẻ giết giá" chưa bao giờ tăng giá, lần đầu tiên đã lắp đồng hồ tính tiền cho sức mạnh tính toán của mình.

Với người dùng cá nhân ảnh hưởng không lớn, nhưng với những đội nhóm chạy Agent liên tục trong giờ làm việc, đây là một khoản chi thực sự cần phải tính toán lại.

May mắn là giá khi trúng cache vẫn cực kỳ thấp, việc di chuyển các tác vụ hàng loạt, chạy điểm chuẩn, tạo dữ liệu ra khỏi giờ cao điểm, có thể giúp kéo chi phí về lại.

Tuy nhiên, so với giá 50 USD cho 1 triệu token đầu ra của Fable 5, V4 vẫn là lựa chọn có tỷ lệ giá/hiệu năng tốt nhất.

Xét cho cùng, hiệu năng cũng đã đạt đến cấp Opus. Khi phiên bản xem trước V4 ra mắt, theo bài kiểm tra chính thức trên SWE-bench Verified—

DeepSeek -V4-Pro-Max chỉ kém Claude Opus 4.6 Max 0.2 điểm phần trăm, nhưng giá chỉ bằng một phần bảy của đối thủ.

Nhưng trong các bài kiểm tra về truy xuất ngữ cảnh dài, kỹ thuật phần mềm chuyên nghiệp và một số lý luận tri thức, Opus vẫn giữ vị trí dẫn đầu.

Tiện thể nhắc thêm, hai tên mô hình cũ deepseek-chat và deepseek-reasoner sẽ chính thức ngừng hoạt động vào ngày 24 tháng 7.

Dù sao đi nữa, "chiếc giày" mà cả mạng chờ đợi suốt ba tháng, cuối cùng cũng sắp chạm đất.

Từ thông tin rò rỉ hiện tại, V4 nhiều khả năng sẽ không phải là mô hình "đứng nhất toàn diện".

Với Fable 5 và GPT-5.6 Sol ở phía trước, Kimi K3 ở bên cạnh, việc V4 muốn dựa hoàn toàn vào hiệu năng thuần túy để "lật bàn" là không dễ dàng.

Nhưng DeepSeek chưa bao giờ chơi theo lá bài đó.

Điểm đáng xem thực sự là con đường cũ đã được kiểm chứng nhiều lần: đem khả năng cấp Opus, ép giá còn một phần bảy.

Xét cho cùng, trước mặt các gã khổng lồ với giá hàng chục USD cho mỗi triệu token, thì dù có lắp "đồng hồ tính phí giờ cao điểm", V4 vẫn là "Kẻ giết giá" đang tung hoành khắp nơi.

Tài liệu tham khảo:

https://x.com/pankajkumar_dev/status/2078536231026372846

Bài viết này đến từ tài khoản WeChat công cộng "New Zhi Yuan", biên tập viên: Đào Tử

Câu hỏi Liên quan

QDeepSeek V4 được dự kiến phát hành khi nào?

ADeepSeek V4 bản chính thức dự kiến phát hành sớm nhất vào ngày mai, muộn nhất cũng chỉ trong vài ngày tới.

QCó bao nhiêu phiên bản của DeepSeek V4 (GA) và chúng là gì?

ADeepSeek V4 (GA) có hai phiên bản: DeepSeek V4 Flash và DeepSeek V4 Pro.

QLàm thế nào để người dùng kiểm tra xem họ có được chọn tham gia thử nghiệm tính năng V4 GA hay không?

ATheo mẹo dân gian từ blogger AiBattle, người dùng có thể kiểm tra bằng cách xem chuỗi suy nghĩ (CoT) của mô hình: nếu quá trình suy nghĩ bắt đầu bằng "I'm" hoặc "I'll" thay vì "Let me" như phiên bản cũ, thì rất có thể họ đã dùng V4 GA.

QMô hình DeepSeek V4 có hiệu năng như thế nào so với các mô hình đối thủ?

ATheo trải nghiệm của nhà phát triển Pankaj Kumar, hiệu năng tổng thể của V4 gần với mức Claude Opus 4.8, mã hóa có thể sánh ngang GPT-5.6 Sol, năng lực Agent được cải thiện mạnh, và khả năng tạo SVG/3D tốt hơn đáng kể. Tuy nhiên, một số người cho rằng nó khó cạnh tranh trực tiếp với Kimi K3 mới ra mắt.

QBiểu phí API mới cho DeepSeek V4 có gì đặc biệt?

ABiểu phí API mới cho V4 sẽ áp dụng hình thức "tính phí theo giờ cao điểm và thấp điểm". Ví dụ: đối với deepseek-v4-pro, phí xuất triệu tokens là 0.87 USD (giờ thường) và 1.74 USD (giờ cao điểm). Phiên bản Flash rẻ hơn, với mức 0.28 USD (thường) và 0.56 USD (cao điểm) cho triệu tokens xuất. Phí cho đầu vào nếu bộ nhớ cache không trúng là 0.435 USD (Pro) và cực thấp 0.0028 USD (Flash) nếu trúng cache.

Nội dung Liên quan

Claude đột nhập vào mọi lớp học tại Mỹ: Giáo viên làm việc 49 giờ/tuần cuối cùng cũng đợi được trợ giảng AI miễn phí

Claude chính thức ra mắt Claude for Teachers, cung cấp miễn phí các tính năng nâng cao và bộ công cụ giảng dạy cho giáo viên K-12 tại Mỹ sau khi xác minh danh tính. Mục tiêu là giải quyết khối lượng công việc khổng lồ - trung bình 49 giờ/tuần - bằng cách tự động hóa các nhiệm vụ lặp đi lặp lại như chuẩn bị bài giảng, phân tích dữ liệu học sinh và điều chỉnh giáo án. Công cụ này tích hợp hệ thống Learning Commons, cho phép nó căn chỉnh bài giảng với tiêu chuẩn học thuật của từng bang, tạo kế hoạch bài học phân hóa theo trình độ học sinh (hỗ trợ ngôn ngữ, bổ trợ hoặc nâng cao) và phân tích điểm số, ghi chú để xác định lỗ hổng kiến thức. Nó cũng kết nối với các nền tảng giáo dục phổ biến như Canva, ASSISTments. Điểm quan trọng là học sinh trực tiếp không thể truy cập Claude vì chính sách chỉ dành cho người từ 18 tuổi. Anthropic nhấn mạnh đây là công cụ hỗ trợ giáo viên, không thay thế họ, nhằm giảm tải công việc hành chính để giáo viên có nhiều thời gian tương tác với học sinh hơn. Công ty cam kết mạnh mẽ về quyền riêng tư, tuân thủ FERPA, không dùng dữ liệu để huấn luyện mô hình và hợp tác với hiệp hội giáo viên AFT. Động thái này diễn ra trong bối cảnh tranh cãi về AI trong giáo dục, như lệnh cấm phần lớn với AI sinh ở Na Uy, và sau khi OpenAI cũng ra mắt công cụ tương tự. Câu hỏi lớn được đặt ra là liệu học sinh chỉ được giáo viên sử dụng AI để dạy, mà bản thân không được trải nghiệm, có thực sự sẵn sàng cho một tương lai AI hay không.

marsbit7 phút trước

Claude đột nhập vào mọi lớp học tại Mỹ: Giáo viên làm việc 49 giờ/tuần cuối cùng cũng đợi được trợ giảng AI miễn phí

marsbit7 phút trước

Triết học hàn lâm bỗng trở thành 'liều thuốc' nóng cho AI

Triết học, một ngành từng được coi là "lạnh", đang trở thành tâm điểm trong các cuộc thảo luận về AI tại Diễn đàn Trí tuệ Nhân tạo Thế giới (WAIC) năm nay. Các học giả như Giáo sư Tôn Ninh và Tôn Hướng Thần từ Đại học Phúc Đán đã chia sẻ quan điểm, nhấn mạnh rằng trí tuệ cần có nền tảng từ thế giới thực—qua cơ thể, môi trường, quan hệ xã hội và lịch sử. Diễn đàn tập trung vào việc AI ngày càng tham gia sâu vào hoạt động khoa học, từ việc tự viết bài báo, chứng minh toán học đến mô phỏng xã hội. Tuy nhiên, nhiều câu hỏi nổi lên: Liệu AI có thực sự hiểu? Làm thế nào đánh giá kết quả nghiên cứu do AI tạo ra? Ai chịu trách nhiệm khi có sai sót? Vấn đề quản trị AI trở nên cấp thiết khi công nghệ này bắt đầu mô phỏng xã hội và ảnh hưởng đến quyết định thực tế. Các chuyên gia cảnh báo về rủi ro từ định kiến trong dữ liệu và sự cần thiết của việc giữ con người trong vòng lặp ra quyết định. "Sổ tay Xanh 2026" về Phát triển Thông minh Nhân văn & Xã hội đề xuất các khung như STRIDES để đảm bảo tính minh bạch và trách nhiệm. Ứng dụng AI vào công nghiệp, như trong lĩnh vực sinh học tổng hợp, cho thấy tiềm năng to lớn nhưng cũng đòi hỏi sự phối hợp giữa mô hình, thí nghiệm tự động và quy trình sản xuất. Thách thức nằm ở việc điều chỉnh các mối quan hệ sản xuất và cơ chế phân phối lợi ích. Tóm lại, sự "nóng lên" của triết học trong AI phản ánh một xu hướng sâu sắc hơn: khi công nghệ tiến sâu vào đời sống, chúng ta cần suy ngẫm nghiêm túc về những câu hỏi cơ bản—đặt niềm tin vào đâu, hỏi điều gì và định hướng tương lai ra sao.

marsbit47 phút trước

Triết học hàn lâm bỗng trở thành 'liều thuốc' nóng cho AI

marsbit47 phút trước

Kimi khiến hai gã khổng lồ thay đổi định giá? Sam Altman hiếm hoi nhận lỗi, Claude được reset hạn mức

Kimi K3 ra mắt với mức giá thấp hơn nhiều so với các mô hình AI cao cấp, tạo áp lực lên thị trường. Sam Altman của OpenAI hiếm hoi thừa nhận sai lầm, đồng thời dự báo 12 tháng tới sẽ là giai đoạn xuất sắc nhất của công ty, với dấu hiệu cho thấy GPT-6 sắp ra mắt. Cùng lúc, cuộc chiến giành người dùng giữa OpenAI và Anthropic đang nóng lên. OpenAI liên tục xóa giới hạn và tặng hạn ngạch sử dụng cho ChatGPT Work, trong khi Anthropic gia hạn truy cập Claude Fable 5 và tăng hạn mức Claude Code thêm 50%. Động thái này không chỉ để thu hút người dùng mà còn nhằm thu thập dữ liệu từ các tác vụ dài, thứ tạo nên lợi thế cạnh tranh trong kỷ nguyên AI Agent. CFO OpenAI, Sarah Friar, giới thiệu thước đo mới: "Useful Intelligence per Dollar" (Lượng trí tuệ hữu ích trên mỗi đô-la), nhấn mạnh chi phí thực để hoàn thành một nhiệm vụ thành công quan trọng hơn giá token đơn lẻ. Các mô hình như GPT-5.6 Sol được tối ưu cho mục tiêu này. Cuộc cạnh tranh cốt lõi hiện nay là đưa AI từ vai trò trả lời câu hỏi trở thành "đồng nghiệp" thực thụ trong quy trình làm việc. OpenAI tích hợp Agent vào ChatGPT với hàng trăm triệu người dùng, trong khi Anthropic tập trung vào Claude Code và Cowork. Ai chiếm được vị trí thiết yếu trong quy trình công việc của người dùng, người đó sẽ định hình tương lai thị trường.

marsbit1 giờ trước

Kimi khiến hai gã khổng lồ thay đổi định giá? Sam Altman hiếm hoi nhận lỗi, Claude được reset hạn mức

marsbit1 giờ trước

32 tỷ huy động vốn vẽ bánh 6 năm sau 90% bù lưu: Công nghệ 'công nghiệp hóa' Silicon Carbide của Luxiao Technology - Thực và Hư | Độ sâu TMT

Ngày 7/7, Công ty Cổ phần Công nghệ Loxia (002617.SZ) thông báo chính thức chấm dứt hai dự án góp vốn định hướng silicon carbide (SiC) từ đợt phát hành cổ phiếu năm 2021, và chuyển 1,217 tỷ NDT còn lại thành vốn lưu động vĩnh viễn. Giá cổ phiếu sau đó giảm gần 40% trong 8 phiên. Tính tổng từ năm 2020, Loxia Tech đã hai lần phát hành cổ phiếu định hướng, huy động tổng cộng khoảng 3,2 tỷ NDT cho kế hoạch "bán dẫn thế hệ thứ ba" trăm tỷ. Tuy nhiên, sau 6 năm, chỉ chưa đầy 300 triệu NDT thực sự được đầu tư vào xây dựng dự án SiC, số còn lại (khoảng 2,9 tỷ NDT) chủ yếu dùng để bổ sung vốn lưu động và trả nợ. Dự án 24 vạn tấm nền/năm ban đầu liên tục bị trì hoãn. Công ty nhiều lần bày tỏ sự tự tin trong các báo cáo, nhưng đến tháng 7/2026 lại tuyên bố chấm dứt với lý do thị trường 6 inch đã bão hòa và giá giảm. Thông tin về công suất thực tế của dự án mập mờ: có nguồn nói "đã hoàn thành" 6 vạn tấm/năm, có nguồn lại nói "kế hoạch đạt" 6 vạn tấm trong năm nay. Từ năm 2022 đến 2025, công ty con hợp tác tại Hợp Phì là Hợp Phì Loxia Semiconductor chỉ ghi nhận doanh thu 3,2492 triệu NDT và lỗ ròng 344 triệu NDT. Trong khi Loxia Tech chậm chân với 6 inch, các đối thủ như Thiên Nhạc Tiên Tiến, Thiên Khoa Hợp Đạt đã sản xuất hàng loạt 8 inch và có đột phá với 12 inch. Loxia Tech tuyên bố sẽ dùng vốn tự có tiếp tục phát triển nền 8 và 12 inch, nhưng năng lực R&D của họ thấp hơn hẳn đối thủ (chi phí R&D năm 2025 chỉ chiếm 2,74% doanh thu). Nhân vật then chốt - nhà khoa học chính Trần Chi Chiến - ít được nhắc đến trong báo cáo gần đây, và thông tin học thuật/công nghệ của ông có vẻ không còn cập nhật. Đây là một chương mới trong lịch sử "đuổi theo xu hướng" của Loxia Tech kể từ khi lên sàn năm 2011. Công ty đã mở rộng ồ ạt sang các lĩnh vực như cơ điện, đá quý sapphire, xe điện, quang điện, SiC, máy nâng cao... nhưng phần lớn thất bại, phải bán lại với giá thấp. Trong khi đó, công ty đã huy động tổng cộng 7,069 tỷ NDT qua các đợt phát hành, nhưng tổng lợi nhuận tích lũy chỉ là 221 triệu NDT, và cổ tức chỉ là 88,8312 triệu NDT. Gia đình cổ đông kiểm soát đã thực hiện nhiều đợt thoái vốn, ước tính thu về khoảng 1,993 tỷ NDT từ năm 2018, và lại công bố kế hoạch bán cổ phiếu vào tháng 6 năm nay.

marsbit1 giờ trước

32 tỷ huy động vốn vẽ bánh 6 năm sau 90% bù lưu: Công nghệ 'công nghiệp hóa' Silicon Carbide của Luxiao Technology - Thực và Hư | Độ sâu TMT

marsbit1 giờ trước

ChatGPT cuối cùng cũng có thể "tự tìm kiếm", lục lại cuộc hội thoại gần 4 năm tích lũy chỉ bằng một cú nhấp chuột

ChatGPT đã chính thức ra mắt tính năng tìm kiếm thống nhất mới, cho phép người dùng tìm kiếm toàn bộ lịch sử tương tác của mình bao gồm trò chuyện, hình ảnh, tài liệu và dự án chỉ từ một ô tìm kiếm duy nhất. Tính năng này khắc phục điểm yếu kéo dài gần 4 năm là việc khó tìm lại các cuộc hội thoại cũ, biến ChatGPT từ một công cụ trò chuyện thành một kho kiến thức cá nhân thực sự. Bản cập nhật này đánh dấu bước chuyển lớn khi OpenAI định vị ChatGPT không chỉ là chatbot mà là nơi người dùng làm việc, với đầy đủ "hệ thống tệp" riêng để lưu trữ và quản lý dữ liệu được tạo ra cùng AI. Việc dữ liệu cá nhân trở nên dễ tìm kiếm và tái sử dụng hơn cũng làm tăng giá trị của chúng, đồng thời làm nổi bật vấn đề riêng tư và quyền kiểm soát. Động thái này phản ánh xu hướng chung trong ngành AI: cuộc cạnh tranh đang chuyển từ khả năng tạo phản hồi sang khả năng tổ chức và khai thác hiệu quả kho dữ liệu cá nhân mà người dùng đã tích lũy qua nhiều năm, thứ được coi là tài sản giá trị nhất trong kỷ nguyên AI.

marsbit1 giờ trước

ChatGPT cuối cùng cũng có thể "tự tìm kiếm", lục lại cuộc hội thoại gần 4 năm tích lũy chỉ bằng một cú nhấp chuột

marsbit1 giờ trước

Giao dịch

Giao ngay
活动图片