DeepSeek V4 chính thức ra mắt, phá vỡ thế độc quyền của mã nguồn đóng mạnh nhất, công khai hợp tác với chip Huawei

marsbitXuất bản vào 2026-04-24Cập nhật gần nhất vào 2026-04-24

Tóm tắt

DeepSeek vừa chính thức ra mắt phiên bản DeepSeek-V4 với hai phiên bản: Pro và Flash. V4-Pro có 1,6 nghìn tỷ tham số và 49 tỷ tham số kích hoạt, được đánh giá ngang hàng với các mô hình nguồn đóng hàng đầu về khả năng Agent, kiến thức thế giới và suy luận. Trong khi đó, V4-Flash là phiên bản nhẹ hơn, phù hợp cho các tác vụ đơn giản và có chi phí API thấp hơn. Cả hai phiên bản đều hỗ trợ ngữ cảnh dài 1 triệu token, một tính năng trước đây chỉ có trên Gemini. DeepSeek cũng công bố sẽ hỗ trợ chip Huawei từ nửa cuối năm nay. Mô hình đã được open-source và có sẵn trên Hugging Face và ModelScope. API cập nhật đồng thời, hỗ trợ cả giao thức OpenAI và Anthropic.

Vừa qua, DeepSeek-V4 đã chính thức xuất hiện!

Phiên bản xem trước chính thức lên sóng và đồng thời mã nguồn mở.

Tổng cộng có hai phiên bản:

DeepSeek-V4-Pro: Đối đầu với các mô hình mã nguồn đóng hàng đầu, 1.6T, 49B kích hoạt, độ dài ngữ cảnh 1M;

DeepSeek-V4-Flash: Phiên bản kinh tế nhỏ hơn và nhanh hơn, 284B, 13B kích hoạt, độ dài ngữ cảnh 1M.

Lời nói chính thức từ nhà phát triển là: Về khả năng Agent, kiến thức thế giới và hiệu suất suy luận đều đạt được vị trí dẫn đầu trong nước và lĩnh vực mã nguồn mở.

Và:

Hiện tại DeepSeek-V4 đã trở thành mô hình Agentic Coding được nhân viên nội bộ sử dụng, theo đánh giá phản hồi trải nghiệm sử dụng tốt hơn Sonnet 4.5, chất lượng giao hàng gần với Opus 4.6 chế độ không suy nghĩ. Nhưng vẫn còn khoảng cách nhất định so với mô hình suy nghĩ Opus 4.6.

Hiện tại cả trang web chính thức và APP đều đã cập nhật, dịch vụ API cũng đã đồng bộ hóa.

Về khả năng tính toán trong nước mà mọi người quan tâm, điểm nhấn là nửa cuối năm sẽ hỗ trợ khả năng tính toán của Huawei.

Lựa chọn cao cấp và tiết kiệm, hai phiên bản cùng ra mắt

Lần này V4 một lúc ra mắt hai phiên bản.

V4-Pro, hiệu suất ngang bằng với các mô hình mã nguồn đóng hàng đầu.

Nhà phát triển đưa ra ba đánh giá:

Khả năng Agent được cải thiện mạnh mẽ: Trong đánh giá Agentic Coding, V4-Pro đã đạt đến trình độ tốt nhất của các mô hình mã nguồn mở hiện tại, và cũng thể hiện xuất sắc trong các đánh giá liên quan đến Agent khác. Trong đánh giá nội bộ, ở chế độ Agent Coding, trải nghiệm V4 tốt hơn Sonnet 4.5, chất lượng giao hàng gần với Opus 4.6 chế độ không suy nghĩ, nhưng vẫn còn khoảng cách so với chế độ suy nghĩ Opus 4.6.

Kiến thức thế giới phong phú: Trong đánh giá kiến thức thế giới, DeepSeek-V4-Pro vượt xa các mô hình mã nguồn mở khác, chỉ kém hơn một chút so với mô hình mã nguồn đóng đỉnh cao Gemini-Pro-3.1.

Hiệu suất suy luận đỉnh cao thế giới: Trong các đánh giá về toán học, STEM, mã thi đấu, DeepSeek-V4-Pro vượt qua tất cả các mô hình mã nguồn mở đã công bố đánh giá hiện tại, đạt được thành tích ngang bằng với các mô hình mã nguồn đóng hàng đầu thế giới.

V4-Flash, phiên bản kinh tế nhỏ hơn và nhanh hơn. Khả năng suy luận gần với Pro, kiến thức thế giới hơi kém hơn, nhưng tham số và kích hoạt nhỏ hơn, API rẻ hơn.

Về nhiệm vụ Agent, DeepSeek-V4-Flash ngang ngửa với DeepSeek-V4-Pro trong nhiệm vụ đơn giản, nhưng vẫn có khoảng cách trong nhiệm vụ khó cao.

Trong bài kiểm tra rửa xe, V4 cũng vượt qua nhanh chóng.

Trong khi đó, trong tình huống sinh học kinh điển "người cha tuyệt vọng", DeepSeek-V4 không nhận ra ngay điểm mấu chốt về mù màu đỏ-xanh lá (theo quy luật di truyền, nếu một phụ nữ bị mù màu đỏ-xanh lá, cha ruột của cô ấy chắc chắn cũng bị).

Triệu ngữ cảnh trở thành tiêu chuẩn

Đáng chú ý là, từ hôm nay, 1M ngữ cảnh là tiêu chuẩn cho tất cả dịch vụ chính thức của DeepSeek.

Một năm trước, 1M ngữ cảnh vẫn là lá bài độc quyền của Gemini; tất cả các mô hình mã nguồn đóng khác chỉ 128K hoặc 200K; phía mã nguồn mở hầu như không ai chơi được ở cấp độ này.

DeepSeek trực tiếp biến triệu ngữ cảnh từ một "tính năng cao cấp" thành "cơ sở hạ tầng".

Và mã nguồn mở. Họ làm được như thế nào, trong bản phát hành đã trực tiếp đưa ra câu trả lời——

V4 tạo ra một cơ chế chú ý hoàn toàn mới, nén ở chiều token, kết hợp với sự chú ý thưa DSA. So với phương pháp truyền thống, nhu cầu tính toán và bộ nhớ giảm mạnh.

DSA không phải từ mới. Nửa năm trước, bản cập nhật V3.2-Exp lần đầu tiên giới thiệu, lúc đó sự chú ý bên ngoài không cao, vì điểm chạy và V3.1-Terminus gần như giống nhau, trông giống như một phiên bản trung gian không có gì mới.

Giờ nhìn lại, đó là nền móng của V4.

Tối ưu hóa chuyên sâu khả năng Agent

Về phía Agent, V4 đã điều chỉnh và tối ưu hóa cho các sản phẩm Agent chủ lưu như Claude Code, OpenClaw, OpenCode, CodeBuddy, nhiệm vụ mã và nhiệm vụ tạo tài liệu đều được cải thiện.

Bản phát hành còn kèm theo một ví dụ trang PPT được tạo bởi V4-Pro trong một khung Agent.

Giá API

Về phía API, V4-Pro và V4-Flash đồng bộ lên sóng, hỗ trợ hai giao diện OpenAI ChatCompletions và Anthropic.

base_url không đổi, tham số model đổi thành deepseek-v4-pro hoặc deepseek-v4-flash để gọi.

Cả hai phiên bản đều có ngữ cảnh tối đa 1M, đều hỗ trợ đồng thời chế độ không suy nghĩ và chế độ suy nghĩ. Ở chế độ suy nghĩ, có thể điều chỉnh cường độ qua tham số reasoning_effort, hai mức high và max. Nhà phát triển khuyến nghị các tình huống Agent phức tạp nên dùng max.

Có một điểm nhấn ở đây——nửa cuối năm hỗ trợ khả năng tính toán của Huawei.

Ngoài ra, tên mô hình cũ sẽ ngừng hoạt động.

deepseek-chat và deepseek-reasoner sẽ ngừng hoạt động sau ba tháng (24/7/2026), trong giai đoạn hiện tại hai tên này lần lượt trỏ đến chế độ không suy nghĩ và suy nghĩ của V4-Flash.

Ảnh hưởng không lớn với nhà phát triển cá nhân, chỉ cần đổi một tham số model. Các công ty đã kết nối môi trường sản xuất, trong ba tháng này cần di chuyển.

One more thing

Cuối bản phát hành, DeepSeek tự trích dẫn một câu.

「不诱于誉,不恐于诽,率道而行,端然正己。」

Đây là một câu trong "Phi Thập Nhị Tử" của Tuân Tử. Nghĩa đen là, không bị dụ dỗ bởi danh tiếng, không sợ hãi bởi phỉ báng, đi theo con đường mình nhận định, ngay thẳng chính mình.

Đặt trong bối cảnh hôm nay, khá thú vị.

Nửa năm qua, những tin đồn về việc V4 khi nào ra mắt, có phải hoãn, có phải đã bị nhà khác vượt qua, có phải đã bị Claude chưng cất dữ liệu giải quyết... chạy đi chạy lại vài vòng trong cộng đồng AI tiếng Trung và tiếng Anh. Đầu năm thậm chí còn có người khẳng định V4 sẽ ra trước Tết, nhưng cuối cùng đợi đến cuối tháng tư.

Họ không phản hồi lần nào.

Vào một chiều thứ Sáu, đưa V4 ra, đồng bộ mã nguồn mở, đồng bộ lên trang chính thức và App, đồng bộ cập nhật API, tiện thể viết vào bản phát hành sự thật nhân viên nội bộ đã ngừng dùng Claude.

Không có lộ trình, không livestream, không phỏng vấn.

Bốn chữ "率道而行" (suất đạo nhi hành), nghe như một khẩu hiệu. Nhưng nếu bạn đặt cùng nhau phiên bản Exp "không có điểm nhấn" của V3.2 nửa năm trước, bộ chú ý thưa DSA đã chuẩn bị nền móng cho V4 nửa năm, con đường biến triệu ngữ cảnh từ lá bài thành tiêu chuẩn.

DeepSeek đã làm được.

Liên kết mã nguồn mở mô hình DeepSeek-V4:

[1]https://huggingface.co/collections/deepseek-ai/deepseek-v4

[2]https://modelscope.cn/collections/deepseek-ai/DeepSeek-V4

Báo cáo kỹ thuật DeepSeek-V4: https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro/blob/main/DeepSeek_V4.pdf

Bài viết từ tài khoản công chúng WeChat "量子位", tác giả: 量子位

Câu hỏi Liên quan

QDeepSeek V4 có những phiên bản nào và thông số kỹ thuật của chúng là gì?

ADeepSeek V4 có hai phiên bản: DeepSeek-V4-Pro với 1.6T tham số, 49B kích hoạt và độ dài ngữ cảnh 1M; DeepSeek-V4-Flash với 284B tham số, 13B kích hoạt và độ dài ngữ cảnh 1M.

QDeepSeek V4 có những cải tiến nổi bật nào so với các mô hình trước?

ADeepSeek V4 cải thiện đáng kể khả năng Agent, kiến thức thế giới và hiệu suất suy luận. Nó hỗ trợ ngữ cảnh lên đến 1M token, sử dụng cơ chế chú ý mới DSA để giảm nhu cầu tính toán và bộ nhớ.

QDeepSeek V4 có hỗ trợ phần cứng của Huawei không?

ACó, DeepSeek thông báo sẽ hỗ trợ phần cứng Huawei (Huawei compute) vào nửa cuối năm 2026.

QAPI của DeepSeek V4 có những tính năng nào?

AAPI của DeepSeek V4 hỗ trợ cả hai giao diện OpenAI ChatCompletions và Anthropic, với độ dài ngữ cảnh 1M, chế độ không suy nghĩ và chế độ suy nghĩ với tham số reasoning_effort điều chỉnh cường độ.

QDeepSeek V4 đã được đánh giá so với các mô hình đóng như thế nào?

ATheo đánh giá nội bộ, DeepSeek-V4-Pro có trải nghiệm sử dụng tốt hơn Sonnet 4.5, chất lượng gần với Opus 4.6 chế độ không suy nghĩ, nhưng vẫn còn khoảng cách so với Opus 4.6 chế độ suy nghĩ.

Nội dung Liên quan

Gã khổng lồ lưu trữ kiếm bộn tiền, hạ nguồn không chịu nổi

Các công ty sản xuất bộ nhớ toàn cầu vừa công bố báo cáo tài chính nửa đầu năm với lợi nhuận kỷ lục. SK Hynix ghi nhận lợi nhuận ròng tăng 1242%, trong khi Samsung Electronics có lợi nhuận hoạt động một quý vượt tổng lợi nhuận ba năm trước đó. Các công ty Trung Quốc như GigaDevice, Jiangbolong và BIWIN cũng báo cáo mức tăng lợi nhuận hàng trăm đến hàng chục nghìn phần trăm nhờ giá bán tăng và nhu cầu AI. Tuy nhiên, lợi nhuận khổng lồ này đồng nghĩa với chi phí gia tăng cho khách hàng downstream. Các hãng sản xuất AI server, với nhu cầu HBM cứng, vẫn chấp nhận trả giá cao. Ngược lại, ngành điện thoại di động và PC đang chịu áp lực lớn khi chip nhớ chiếm tỷ trọng ngày càng cao trong BOM, làm giảm lợi nhuận. Đáng chú ý, nhiều hãng điện thoại lớn, bao gồm OPPO và vivo, đã bắt đầu từ chối các đề nghị tăng giá từ nhà cung cấp bộ nhớ. Mâu thuẫn lên đến đỉnh điểm khi ngay cả bộ phận di động của Samsung cũng gặp khó khăn trong việc đàm phán giá nội bộ với chính bộ phận bán dẫn của mình. Động thái "từ chối trả giá" tập thể này cho thấy chu kỳ tăng giá siêu tốc có thể đang đến hồi kết khi các khách hàng downstream không còn khả năng chi trả. Các hãng downstream đang chuyển sang các chiến lược như cắt giảm sản lượng, điều chỉnh cấu trúc sản phẩm và tối ưu hóa kỹ thuật để giảm phụ thuộc vào bộ nhớ, báo hiệu một sự thay đổi tiềm năng trong cấu trúc quyền lực của ngành.

marsbit11 phút trước

Gã khổng lồ lưu trữ kiếm bộn tiền, hạ nguồn không chịu nổi

marsbit11 phút trước

Dự án Agorá của BIS hoàn tất thử nghiệm thanh toán xuyên biên giới được token hóa trị giá 1 triệu USD

Ngân hàng Thanh toán Quốc tế (BIS) thông báo Dự án Agorá đã hoàn thành thử nghiệm thanh toán xuyên biên giới trị giá thực, với 28 tổ chức tài chính và ngân hàng trung ương thực hiện thanh toán khoảng 800.000 franc Thụy Sĩ (tương đương 1 triệu USD) qua 17 kịch bản giao dịch. Cuộc thử nghiệm, diễn ra vào tháng 7, sử dụng dự trữ ngân hàng trung ương và tiền gửi ngân hàng thương mại được mã hóa (tokenized) để thanh toán bằng nhiều loại tiền tệ, bao gồm franc Thụy Sĩ, euro, bảng Anh, yên Nhật, won Hàn Quốc và đô la Mỹ. Thời gian thanh toán trung bình chỉ khoảng 80 giây. Các ngân hàng trung ương tham gia như Ngân hàng Anh, Pháp, Nhật Bản, Hàn Quốc và Thụy Sĩ, cùng với các ngân hàng thương mại lớn bao gồm JPMorgan Chase, Citi, Deutsche Bank, BNP Paribas, UBS, Standard Chartered và MUFG. Được khởi động năm 2024, Dự án Agorá của BIS nhằm khám phá cách mã hóa tài sản có thể cải thiện hệ thống thanh toán xuyên biên giới quy mô lớn. BIS cho biết đợt thử nghiệm này đánh dấu một cột mốc quan trọng và việc thử nghiệm sẽ tiếp tục khi dự án phát triển.

cointelegraph28 phút trước

Dự án Agorá của BIS hoàn tất thử nghiệm thanh toán xuyên biên giới được token hóa trị giá 1 triệu USD

cointelegraph28 phút trước

Ngày quan trọng trên thị trường tiền mã hóa: Giá trị quyền chọn Bitcoin và Ethereum tăng mạnh 10,5 tỷ USD! Nhà đầu tư đang kỳ vọng điều gì?

Thị trường tiền điện tử đang chứng kiến một ngày quan trọng khi một khối lượng hợp đồng quyền chọn (options) khổng lồ, trị giá khoảng 10,5 tỷ USD, chuẩn bị hết hạn vào ngày 31 tháng 7. Trong đó, quyền chọn Bitcoin chiếm 9,69 tỷ USD và Ethereum là 830 triệu USD. Sự kiện này càng đáng chú ý vì rơi vào thứ Sáu cuối cùng của cả tuần và tháng. Bitcoin hiện đang dao động quanh mức 64.000 USD trong bối cảnh bất ổn về chính sách tiền tệ của Mỹ và rủi ro địa chính trị. Tỷ lệ Put/Call cho các quyền chọn sắp đáo hạn là 0,28 đối với Bitcoin và 0,63 đối với Ethereum. Tỷ lệ thấp này, đặc biệt là với Bitcoin, cho thấy tâm lý thị trường chủ đạo là lạc quan (bullish), với phần lớn nhà đầu tư kỳ vọng giá sẽ tăng. Mặc dù vẫn thiên về kỳ vọng tăng giá, tỷ lệ cao hơn của Ethereum phản ánh sự thận trọng hơn so với Bitcoin. Các chuyên gia lưu ý rằng, mặc dù ngày đáo hạn hợp đồng lớn là một yếu tố đáng theo dõi, nó không phải là nhân tố duy nhất quyết định biến động giá. Các sự kiện kinh tế vĩ mô và tâm lý thị trường vẫn đóng vai trò then chốt.

cryptonews.ru42 phút trước

Ngày quan trọng trên thị trường tiền mã hóa: Giá trị quyền chọn Bitcoin và Ethereum tăng mạnh 10,5 tỷ USD! Nhà đầu tư đang kỳ vọng điều gì?

cryptonews.ru42 phút trước

Phân Tích Ảnh Hưởng của AI Đối Với Tăng Trưởng Kinh Tế và Năng Suất

Tóm tắt: Tác động của AI đối với tăng trưởng kinh tế và năng suất được nhìn nhận qua ba quan điểm chính. Phe lạc quan tin rằng AI có thể thúc đẩy tăng trưởng kinh tế bùng nổ, thậm chí tạo ra "điểm kỳ dị" (singularity) thông qua việc tự động hóa nghiên cứu và phát triển. Phe ôn hòa (chủ đạo) thừa nhận AI nâng cao năng suất nhưng nhấn mạnh nhiều rào cản như chi phí, mức độ phơi nhiễm công việc, hiệu ứng "điểm yếu", hạn chế hạ tầng vật lý, năng lượng và các vấn đề quy định, đạo đức, khiến lợi ích thực tế thấp hơn nhiều so với ước tính lạc quan. Phe bi quan cho rằng tác động nâng cao năng suất của AI bị phóng đại, hoặc cảnh báo rằng tự động hóa quá mức có thể thay thế lao động, làm giảm thu nhập lao động, kìm hãm tổng cầu và kéo tụt tăng trưởng. Trong ngắn hạn (1-2 năm), AI chủ yếu hỗ trợ tăng trưởng thông qua kích thích đầu tư, hơn là từ lợi ích năng suất rõ rệt. Về dài hạn, AI hoàn toàn có khả năng tạo ra cuộc cách mạng năng suất. Tuy nhiên, con đường đến thịnh vượng trong trung hạn (3-5 năm) có thể không bằng phẳng, với ba kịch bản dựa trên triển vọng nhu cầu và các rào cản phát triển: 1. **Lạc quan**: Nhu cầu AI đáp ứng hoặc vượt kỳ vọng, không có rào cản đáng kể, năng suất tăng mạnh. Tuy nhiên, nếu việc thay thế lao động diễn ra nhanh mà không có chính sách phân phối thu nhập kịp thời, có thể dẫn đến bất bình đẳng và bất ổn xã hội. 2. **Ôn hòa (có xác suất cao nhất)**: Nhu cầu AI đáp ứng kỳ vọng, nhưng phải đối mặt và vượt qua nhiều rào cản về kỹ thuật, hạ tầng và thể chế. AI nâng cao năng suất ở mức vừa phải, thị trường tài chính phân hóa mạnh, và thất nghiệp cục bộ có thể xảy ra. 3. **Bi quan**: Nhu cầu AI thấp hơn kỳ vọng hoặc gặp phải rào cản nghiêm trọng, dẫn đến đóng góp vào tăng trưởng và năng suất rất hạn chế, có thể gây điều chỉnh thị trường tài chính. Tuy nhiên, tác động thay thế việc làm sẽ hạn chế, giúp duy trì ổn định xã hội lâu hơn. Bài viết kết luận rằng không có con đường nào là dễ dàng. Các nhà hoạch định chính sách cần xem xét toàn diện, giám sát chặt chẽ và có các biện pháp chủ động để đảm bảo tăng trưởng kinh tế bền vững và công bằng xã hội.

marsbit48 phút trước

Phân Tích Ảnh Hưởng của AI Đối Với Tăng Trưởng Kinh Tế và Năng Suất

marsbit48 phút trước

Giao dịch

Giao ngay
活动图片