DeepSeek V4 chính thức ra mắt, phá vỡ thế độc quyền của mã nguồn đóng mạnh nhất, công khai hợp tác với chip Huawei

marsbitXuất bản vào 2026-04-24Cập nhật gần nhất vào 2026-04-24

Tóm tắt

DeepSeek vừa chính thức ra mắt phiên bản DeepSeek-V4 với hai phiên bản: Pro và Flash. V4-Pro có 1,6 nghìn tỷ tham số và 49 tỷ tham số kích hoạt, được đánh giá ngang hàng với các mô hình nguồn đóng hàng đầu về khả năng Agent, kiến thức thế giới và suy luận. Trong khi đó, V4-Flash là phiên bản nhẹ hơn, phù hợp cho các tác vụ đơn giản và có chi phí API thấp hơn. Cả hai phiên bản đều hỗ trợ ngữ cảnh dài 1 triệu token, một tính năng trước đây chỉ có trên Gemini. DeepSeek cũng công bố sẽ hỗ trợ chip Huawei từ nửa cuối năm nay. Mô hình đã được open-source và có sẵn trên Hugging Face và ModelScope. API cập nhật đồng thời, hỗ trợ cả giao thức OpenAI và Anthropic.

Vừa qua, DeepSeek-V4 đã chính thức xuất hiện!

Phiên bản xem trước chính thức lên sóng và đồng thời mã nguồn mở.

Tổng cộng có hai phiên bản:

DeepSeek-V4-Pro: Đối đầu với các mô hình mã nguồn đóng hàng đầu, 1.6T, 49B kích hoạt, độ dài ngữ cảnh 1M;

DeepSeek-V4-Flash: Phiên bản kinh tế nhỏ hơn và nhanh hơn, 284B, 13B kích hoạt, độ dài ngữ cảnh 1M.

Lời nói chính thức từ nhà phát triển là: Về khả năng Agent, kiến thức thế giới và hiệu suất suy luận đều đạt được vị trí dẫn đầu trong nước và lĩnh vực mã nguồn mở.

Và:

Hiện tại DeepSeek-V4 đã trở thành mô hình Agentic Coding được nhân viên nội bộ sử dụng, theo đánh giá phản hồi trải nghiệm sử dụng tốt hơn Sonnet 4.5, chất lượng giao hàng gần với Opus 4.6 chế độ không suy nghĩ. Nhưng vẫn còn khoảng cách nhất định so với mô hình suy nghĩ Opus 4.6.

Hiện tại cả trang web chính thức và APP đều đã cập nhật, dịch vụ API cũng đã đồng bộ hóa.

Về khả năng tính toán trong nước mà mọi người quan tâm, điểm nhấn là nửa cuối năm sẽ hỗ trợ khả năng tính toán của Huawei.

Lựa chọn cao cấp và tiết kiệm, hai phiên bản cùng ra mắt

Lần này V4 một lúc ra mắt hai phiên bản.

V4-Pro, hiệu suất ngang bằng với các mô hình mã nguồn đóng hàng đầu.

Nhà phát triển đưa ra ba đánh giá:

Khả năng Agent được cải thiện mạnh mẽ: Trong đánh giá Agentic Coding, V4-Pro đã đạt đến trình độ tốt nhất của các mô hình mã nguồn mở hiện tại, và cũng thể hiện xuất sắc trong các đánh giá liên quan đến Agent khác. Trong đánh giá nội bộ, ở chế độ Agent Coding, trải nghiệm V4 tốt hơn Sonnet 4.5, chất lượng giao hàng gần với Opus 4.6 chế độ không suy nghĩ, nhưng vẫn còn khoảng cách so với chế độ suy nghĩ Opus 4.6.

Kiến thức thế giới phong phú: Trong đánh giá kiến thức thế giới, DeepSeek-V4-Pro vượt xa các mô hình mã nguồn mở khác, chỉ kém hơn một chút so với mô hình mã nguồn đóng đỉnh cao Gemini-Pro-3.1.

Hiệu suất suy luận đỉnh cao thế giới: Trong các đánh giá về toán học, STEM, mã thi đấu, DeepSeek-V4-Pro vượt qua tất cả các mô hình mã nguồn mở đã công bố đánh giá hiện tại, đạt được thành tích ngang bằng với các mô hình mã nguồn đóng hàng đầu thế giới.

V4-Flash, phiên bản kinh tế nhỏ hơn và nhanh hơn. Khả năng suy luận gần với Pro, kiến thức thế giới hơi kém hơn, nhưng tham số và kích hoạt nhỏ hơn, API rẻ hơn.

Về nhiệm vụ Agent, DeepSeek-V4-Flash ngang ngửa với DeepSeek-V4-Pro trong nhiệm vụ đơn giản, nhưng vẫn có khoảng cách trong nhiệm vụ khó cao.

Trong bài kiểm tra rửa xe, V4 cũng vượt qua nhanh chóng.

Trong khi đó, trong tình huống sinh học kinh điển "người cha tuyệt vọng", DeepSeek-V4 không nhận ra ngay điểm mấu chốt về mù màu đỏ-xanh lá (theo quy luật di truyền, nếu một phụ nữ bị mù màu đỏ-xanh lá, cha ruột của cô ấy chắc chắn cũng bị).

Triệu ngữ cảnh trở thành tiêu chuẩn

Đáng chú ý là, từ hôm nay, 1M ngữ cảnh là tiêu chuẩn cho tất cả dịch vụ chính thức của DeepSeek.

Một năm trước, 1M ngữ cảnh vẫn là lá bài độc quyền của Gemini; tất cả các mô hình mã nguồn đóng khác chỉ 128K hoặc 200K; phía mã nguồn mở hầu như không ai chơi được ở cấp độ này.

DeepSeek trực tiếp biến triệu ngữ cảnh từ một "tính năng cao cấp" thành "cơ sở hạ tầng".

Và mã nguồn mở. Họ làm được như thế nào, trong bản phát hành đã trực tiếp đưa ra câu trả lời——

V4 tạo ra một cơ chế chú ý hoàn toàn mới, nén ở chiều token, kết hợp với sự chú ý thưa DSA. So với phương pháp truyền thống, nhu cầu tính toán và bộ nhớ giảm mạnh.

DSA không phải từ mới. Nửa năm trước, bản cập nhật V3.2-Exp lần đầu tiên giới thiệu, lúc đó sự chú ý bên ngoài không cao, vì điểm chạy và V3.1-Terminus gần như giống nhau, trông giống như một phiên bản trung gian không có gì mới.

Giờ nhìn lại, đó là nền móng của V4.

Tối ưu hóa chuyên sâu khả năng Agent

Về phía Agent, V4 đã điều chỉnh và tối ưu hóa cho các sản phẩm Agent chủ lưu như Claude Code, OpenClaw, OpenCode, CodeBuddy, nhiệm vụ mã và nhiệm vụ tạo tài liệu đều được cải thiện.

Bản phát hành còn kèm theo một ví dụ trang PPT được tạo bởi V4-Pro trong một khung Agent.

Giá API

Về phía API, V4-Pro và V4-Flash đồng bộ lên sóng, hỗ trợ hai giao diện OpenAI ChatCompletions và Anthropic.

base_url không đổi, tham số model đổi thành deepseek-v4-pro hoặc deepseek-v4-flash để gọi.

Cả hai phiên bản đều có ngữ cảnh tối đa 1M, đều hỗ trợ đồng thời chế độ không suy nghĩ và chế độ suy nghĩ. Ở chế độ suy nghĩ, có thể điều chỉnh cường độ qua tham số reasoning_effort, hai mức high và max. Nhà phát triển khuyến nghị các tình huống Agent phức tạp nên dùng max.

Có một điểm nhấn ở đây——nửa cuối năm hỗ trợ khả năng tính toán của Huawei.

Ngoài ra, tên mô hình cũ sẽ ngừng hoạt động.

deepseek-chat và deepseek-reasoner sẽ ngừng hoạt động sau ba tháng (24/7/2026), trong giai đoạn hiện tại hai tên này lần lượt trỏ đến chế độ không suy nghĩ và suy nghĩ của V4-Flash.

Ảnh hưởng không lớn với nhà phát triển cá nhân, chỉ cần đổi một tham số model. Các công ty đã kết nối môi trường sản xuất, trong ba tháng này cần di chuyển.

One more thing

Cuối bản phát hành, DeepSeek tự trích dẫn một câu.

「不诱于誉,不恐于诽,率道而行,端然正己。」

Đây là một câu trong "Phi Thập Nhị Tử" của Tuân Tử. Nghĩa đen là, không bị dụ dỗ bởi danh tiếng, không sợ hãi bởi phỉ báng, đi theo con đường mình nhận định, ngay thẳng chính mình.

Đặt trong bối cảnh hôm nay, khá thú vị.

Nửa năm qua, những tin đồn về việc V4 khi nào ra mắt, có phải hoãn, có phải đã bị nhà khác vượt qua, có phải đã bị Claude chưng cất dữ liệu giải quyết... chạy đi chạy lại vài vòng trong cộng đồng AI tiếng Trung và tiếng Anh. Đầu năm thậm chí còn có người khẳng định V4 sẽ ra trước Tết, nhưng cuối cùng đợi đến cuối tháng tư.

Họ không phản hồi lần nào.

Vào một chiều thứ Sáu, đưa V4 ra, đồng bộ mã nguồn mở, đồng bộ lên trang chính thức và App, đồng bộ cập nhật API, tiện thể viết vào bản phát hành sự thật nhân viên nội bộ đã ngừng dùng Claude.

Không có lộ trình, không livestream, không phỏng vấn.

Bốn chữ "率道而行" (suất đạo nhi hành), nghe như một khẩu hiệu. Nhưng nếu bạn đặt cùng nhau phiên bản Exp "không có điểm nhấn" của V3.2 nửa năm trước, bộ chú ý thưa DSA đã chuẩn bị nền móng cho V4 nửa năm, con đường biến triệu ngữ cảnh từ lá bài thành tiêu chuẩn.

DeepSeek đã làm được.

Liên kết mã nguồn mở mô hình DeepSeek-V4:

[1]https://huggingface.co/collections/deepseek-ai/deepseek-v4

[2]https://modelscope.cn/collections/deepseek-ai/DeepSeek-V4

Báo cáo kỹ thuật DeepSeek-V4: https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro/blob/main/DeepSeek_V4.pdf

Bài viết từ tài khoản công chúng WeChat "量子位", tác giả: 量子位

Câu hỏi Liên quan

QDeepSeek V4 có những phiên bản nào và thông số kỹ thuật của chúng là gì?

ADeepSeek V4 có hai phiên bản: DeepSeek-V4-Pro với 1.6T tham số, 49B kích hoạt và độ dài ngữ cảnh 1M; DeepSeek-V4-Flash với 284B tham số, 13B kích hoạt và độ dài ngữ cảnh 1M.

QDeepSeek V4 có những cải tiến nổi bật nào so với các mô hình trước?

ADeepSeek V4 cải thiện đáng kể khả năng Agent, kiến thức thế giới và hiệu suất suy luận. Nó hỗ trợ ngữ cảnh lên đến 1M token, sử dụng cơ chế chú ý mới DSA để giảm nhu cầu tính toán và bộ nhớ.

QDeepSeek V4 có hỗ trợ phần cứng của Huawei không?

ACó, DeepSeek thông báo sẽ hỗ trợ phần cứng Huawei (Huawei compute) vào nửa cuối năm 2026.

QAPI của DeepSeek V4 có những tính năng nào?

AAPI của DeepSeek V4 hỗ trợ cả hai giao diện OpenAI ChatCompletions và Anthropic, với độ dài ngữ cảnh 1M, chế độ không suy nghĩ và chế độ suy nghĩ với tham số reasoning_effort điều chỉnh cường độ.

QDeepSeek V4 đã được đánh giá so với các mô hình đóng như thế nào?

ATheo đánh giá nội bộ, DeepSeek-V4-Pro có trải nghiệm sử dụng tốt hơn Sonnet 4.5, chất lượng gần với Opus 4.6 chế độ không suy nghĩ, nhưng vẫn còn khoảng cách so với Opus 4.6 chế độ suy nghĩ.

Nội dung Liên quan

AMLBot ra mắt AI Tracer để tự điều tra blockchain

Công ty phân tích tuân thủ và điều tra tiền điện tử AMLBot đã ra mắt công cụ AI Tracer, một nền tảng phân tích blockchain tự phục vụ. Công cụ này tự động lập bản đồ dòng tiền từ một mã hash giao dịch xuyên suốt các mạng blockchain, bao gồm cả việc theo dõi qua các cầu nối cross-chain và khi tài sản bị chia nhỏ vào nhiều ví. AI Tracer được thiết kế để đơn giản hóa việc truy vết, vốn thường yêu cầu phần mềm và kiến thức chuyên môn. Nó tự động duyệt qua biểu đồ giao dịch, theo dõi chuyển động tiền và đối chiếu các địa chỉ ví với nhãn của các thực thể đã biết như sàn giao dịch, dịch vụ hoặc địa chỉ bị cảnh báo. Công ty lưu ý rằng công cụ có giới hạn: không thể thấy giao dịch nội bộ trên sàn, xác định lý do thanh toán, đóng băng tài sản hay đảm bảo thu hồi tiền. Báo cáo từ AI Tracer chỉ nhằm cung cấp điểm khởi đầu cho các cuộc điều tra và không thay thế quy trình kiểm toán hay pháp lý. AI Tracer cung cấp kiểm tra miễn phí và các gói trả phí với giới hạn cao hơn. Hiện tại, nó hỗ trợ nhiều mạng lưới blockchain lớn như Bitcoin, Ethereum, BNB Chain, Solana, Cardano, Ripple, Polygon, Arbitrum và nhiều mạng khác. Đối tượng mục tiêu bao gồm nhà báo, nhà nghiên cứu, trader, người dùng crypto, cơ quan thực thi pháp luật và các đội tuân thủ.

cointelegraph26 phút trước

AMLBot ra mắt AI Tracer để tự điều tra blockchain

cointelegraph26 phút trước

Cổ phiếu sụt giảm còn mạnh hơn cả thị trường tiền điện tử, tiền đã đi đâu?

Tác giả Cathy từ Nền tảng Blockchain Bạch thoại phân tích về đợt sụt giảm mạnh của thị trường chứng khoán toàn cầu gần đây, đặc biệt là sự sụp đổ của chỉ số Kospi Hàn Quốc với mức giảm kỷ lục và việc kích hoạt cơ chế ngắt mạch. Bài viết chỉ ra rằng đây không phải là sự sụt giảm của một cổ phiếu riêng lẻ, mà là một đợt "giảm đòn bẩy cưỡng chế" toàn cầu, nhắm vào các lĩnh vực được giao dịch quá mức như bán dẫn. Đáng chú ý, trong khi các cổ phiếu công nghệ và ETF có đòn bẩy lao dốc (ví dụ: ETF 2x SK Hynix giảm 83%), Bitcoin lại thể hiện sự ổn định tương đối, thậm chí có mức tăng nhẹ, trái ngược với hình ảnh biến động thường thấy. Nguyên nhân được cho là do các lệnh thanh lý cưỡng chế từ các nhà đầu tư sử dụng đòn bẩy cao và quỹ phòng hộ, được kích hoạt bởi báo cáo lợi nhuận không đạt kỳ vọng của SK Hynix và các yếu tố từ Trung Quốc (như đợt IPO của CXMT). Áp lực từ việc chấm dứt giao dịch carry-trade bằng đồng Yên cũng góp phần vào làn sóng bán tháo. Bài viết lập luận rằng dòng tiền từ thị trường chứng khoán không chảy vào Bitcoin. Thay vào đó, Bitcoin "trông có vẻ ổn định" vì đã trải qua một đợi điều chỉnh sâu và bán tháo mạnh từ tháng 5 đến tháng 6, với dòng tiền ròng rất lớn rút khỏi các ETF Bitcoin. Dòng tiền thực sự tìm đến nơi trú ẩn an toàn là vàng. Bitcoin và vàng hiện có tương quan nghịch rất mạnh, cho thấy Bitcoin hiện được coi là tài sản mạo hiểm để tìm kiếm lợi nhuận, chứ không phải là "vàng kỹ thuật số" để phòng ngừa rủi ro. Kết luận cho rằng để dòng tiền lớn quay trở lại với Bitcoin, cần ba điều kiện: áp lực thanh khoản toàn cầu giảm bớt, Fed cắt lãi suất mà không gây suy thoái, và quan trọng là dự luật CLARITY được thông qua để giải quyết các vấn đề pháp lý. Tuy nhiên, việc Bitcoin thể hiện mối tương quan thấp với thị trường chứng khoán (đặc biệt là Nasdaq) trong đợt biến động này có thể lại là điểm hấp dẫn đối với các định chế tài chính đang tìm kiếm sự đa dạng hóa danh mục sau khi tập trung quá mức vào AI. Vị thế của Bitcoin vẫn còn đó, chỉ chờ dòng tiền toàn cầu quay trở lại.

marsbit28 phút trước

Cổ phiếu sụt giảm còn mạnh hơn cả thị trường tiền điện tử, tiền đã đi đâu?

marsbit28 phút trước

Mỹ áp đặt trừng phạt đối với dịch vụ tiền mã hóa thanh toán bằng Bitcoin của Iran Hormuz Safe

Bộ Tài chính Hoa Kỳ thông qua OFAC đã áp đặt trừng phạt đối với hai công ty Iran là Persian Gulf Marine Insurance Company (PGMIC) và Hormuz Safe Marine Services Authority, cáo buộc họ thiết lập một kế hoạch phá vỡ lệnh trừng phạt thông qua dịch vụ bảo hiểm hàng hải kỹ thuật số với thanh toán bằng tiền mã hóa. OFAC tuyên bố Iran đã sử dụng nền tảng Hormuz Safe, ra mắt vào tháng 5/2026, để buộc các tàu thương mại mua bảo hiểm bắt buộc khi qua eo biển Hormuz, chấp nhận thanh toán bằng Bitcoin, nhằm tạo thêm doanh thu và né tránh các biện pháp trừng phạt của phương Tây. Cùng lúc, các biện pháp trừng phạt cũng nhắm vào "đội tàu bóng" của Iran, bao gồm 8 công ty vận tải biển và 8 tàu chở dầu bị cáo buộc vận chuyển dầu thô và sản phẩm dầu mỏ của Iran bất chấp các lệnh cấm quốc tế. Tất cả tài sản của các thực thể này dưới thẩm quyền Hoa Kỳ sẽ bị đóng băng. Các động thái này diễn ra trong bối cảnh Mỹ cáo buộc Iran tìm cách kiếm tiền để hỗ trợ các hoạt động mà họ cho là khủng bố và đàn áp, đồng thời bất chấp những tiếp xúc ngoại giao gần đây giữa hai bên.

cryptonews.ru36 phút trước

Mỹ áp đặt trừng phạt đối với dịch vụ tiền mã hóa thanh toán bằng Bitcoin của Iran Hormuz Safe

cryptonews.ru36 phút trước

«Giai đoạn cuối cùng trước chu kỳ mới». Bitcoin sẽ ra sao trong tháng Tám

Bài viết từ “RBC-Crypto” phân tích triển vọng giá Bitcoin trong tháng 8, với cảnh báo rủi ro đầu tư do tính biến động cao. Dù phục hồi nhẹ cuối tháng 7 lên khoảng 63,5 nghìn USD, BTC vẫn giảm khoảng 50% so với đỉnh lịch sử tháng 10/2025. Các chuyên gia được phỏng vấn dự báo không có đà tăng tiếp tục và khả năng giảm xuống dưới 60 nghìn USD. Áp lực chính đến từ môi trường vĩ mô: lãi suất cao ở Mỹ, lạm phát và giá dầu cao khiến tài sản cố định hấp dẫn hơn so với tiền mã hóa. Dòng tiền ròng rút khỏi các quỹ ETF Bitcoin trong nửa đầu năm và tháng 6 càng cho thấy sự thiếu hụt động lực. Lịch sử cũng cho thấy tháng 8 thường là tháng yếu đối với thị trường. Tuy nhiên, một số chuyên gia xem đây là giai đoạn tích lũy trước một chu kỳ mới, với chu kỳ giảm giá thường kéo dài khoảng 400 ngày. Kịch bản cơ bản được đưa ra là Bitcoin sẽ tiếp tục dao động trong khoảng 58-68 nghìn USD (xác suất 50%). Hỗ trợ chính ở 60-61 nghìn USD; nếu giảm xuống dưới 58 nghìn USD, mục tiêu tiếp theo có thể là 50-55 nghìn USD (xác suất 30%). Chỉ khi vượt qua 67 nghìn USD, BTC mới có cơ hội hướng tới 71-75 nghìn USD, nhưng xác suất này chỉ khoảng 20%. Một số chuyên gia lạc quan hơn dự báo khả năng tăng lên 70 nghìn USD trong tháng 8, nhưng đồng ý rằng xu hướng tăng mạnh hơn có thể chỉ bắt đầu vào quý IV/2025. Lời khuyên cho nhà đầu tư là tích lũy Bitcoin và các dự án mạnh từ từ, tránh các meme coin và đồng non trẻ, trong khi chờ đợi điểm đảo chiều rõ ràng hơn vào cuối năm.

cryptonews.ru36 phút trước

«Giai đoạn cuối cùng trước chu kỳ mới». Bitcoin sẽ ra sao trong tháng Tám

cryptonews.ru36 phút trước

Giao dịch

Giao ngay
活动图片