DeepSeek V4“满血版”曝光了,最快明天发布

marsbit發佈於 2026-07-19更新於 2026-07-19

文章摘要

DeepSeek V4正式版(或称“满血版”)预计最快于明日(2026年7月中旬)发布。该版本包含DeepSeek V4 Flash和DeepSeek V4 Pro两个型号。部分用户已获得灰度测试权限,可通过模型思维链第一人称是否为“I'm”或“I'll”来初步判断是否已用上新版。 根据早期测试者反馈,V4整体性能接近Claude Opus 4.8级别,编码能力直追GPT-5.6 Sol,Agent能力、3D和SVG生成均有显著提升。虽然其综合性能可能略逊于新发布的Kimi K3,且在部分任务中所需迭代轮数多于Fable 5,但预计其定价将具有显著优势。 官方将同步调整API定价,首次引入“峰谷计费”模式。其中,deepseek-v4-pro每百万输出tokens平时0.87美元,高峰1.74美元;deepseek-v4-flash每百万输出tokens平时0.28美元,高峰0.56美元。尽管这是DeepSeek首次实施差异化定价,但其价格相比Fable 5(百万输出50美元)等竞争对手依然极具竞争力,延续了其“价格屠夫”的定位。 目前,已有一些由V4生成的演示内容流出,包括3D模拟射击游戏、《我的世界》风格混合游戏HTML、经典“割绳子”游戏以及Xbox手柄SVG测试等,展示了其代码生成与创作能力。旧模型deepseek-chat和deepseek-reasoner将于7月24日正式下线。 总体而言,DeepSeek V4可能并非在单项性能上全面领先,但其策略在于以接近顶级模型的能力,提供远低于行业巨头的价格,有望再次创造“DeepSeek时刻”。

全网等了快三个月!

DeepSeek V4正式版,可能最早明日发布,最迟不过这几天。

目前,一部分人已提前拿到了 DeepSeek V4(GA)灰度测试的权限。

一共有两个版本: DeepSeek V4 Flash, DeepSeek V4 Pro。

DeepSeek V4「满血版」

终于要来了

大家最关心的想必是,如何知道自己,有没有被灰度到?

博主AiBattle给出了一个民间「验货口诀」:看思维链(CoT)的第一人称。

如果模型的思考过程开口是「I'm」「I'll」,而不是老版本的「Let me」。

那么恭喜你,你大概率已经用上了V4 GA版!

在Fable 5与GPT-5.6 Sol持续角力的当下,全网对开源AI的大招,可以说是拉满了期待值。

一位开发者Pankaj Kumar体验后,率先对V4的性能做了一个中肯的总结:

整体表现接近Opus 4.8级别,编码直追GPT-5.6 Sol;

Agent能力大幅增强,3D和SVG生成显著变好;

同样一个任务,V4所需的迭代轮数,比Fable 5多。

他表示,从目前的生态位来看,V4大概率打不过刚发布的 Kimi K3,但价格会显著更低。

如果这个性能真配上这个价格,那可能又是一次 DeepSeek 时刻。

首轮测试已出

如今, DeepSeek V4(GA)首轮测试demo,已经开始外流。

可以说,外界对此褒贬不一:

有人认为它已经能打平Claude 5,但部分开发者也指出,Pro版并未比Flash版领先太多。

如下是一款由V4 Pro生成的3D模拟射击游戏,核心玩法是操控攻城弩车进行打靶训练,基础的UI功能也均已完备。

V4正式版打造的一款《我的世界》+《无人深空》的混合游戏HTML,可玩度还是比较高的。

下面这款「割绳子」经典游戏,也由V4一次跑出来的。

如下也是V4生成的一些demo,一个Xbox手柄SVG测试,还有游戏生成。

首次引入「峰谷计费」

依旧真香

再造「 DeepSeek 时刻」,最大的变数是价格。

所有爆料都指向同一个说法:性能可能不是第一,但价格会显著更低。

上个月底, DeepSeek 向所有API用户发了一封邮件,称即将在7月中旬,上线V4正式版。

GA发布后同步调整API定价,引入「峰谷计费」。

deepseek-v4-pro:百万输出tokens平时0.87美元,高峰1.74美元;缓存未命中的输入平时0.435美元。

deepseek-v4-flash更狠:百万输出0.28美元,高峰0.56美元,缓存命中的输入0.0028美元。

也就是说,那个从不涨价的「价格屠夫」,第一次给自己的算力装上了计价器。

对个人用户影响不大,但对那些把Agent挂在工作时间不间断跑的团队来说,这是实打实要重新算的一笔账。

好在缓存命中的价格依然极低,把批量任务、评测跑分、数据生成挪到高峰之外,成本还能压回去。

不过,相较于Fable 5百万输出定价50美元,V4在性价比上依旧是是最香的。

毕竟,性能也达到了Opus级。V4预览版发布时,官方自测的SWE-bench Verified中——

DeepSeek -V4-Pro-Max距Claude Opus 4.6 Max仅差0.2个百分点,价格却只有对方的七分之一。

但在长上下文检索、专业软件工程和部分知识推理评测中,Opus仍保持领先。

顺带提一句,deepseek-chat和deepseek-reasoner两个老模型名,7月24日正式下线。

不管怎样,全网苦等三个月的这只「靴子」,终于要落地了。

从目前流出的信息看,V4大概率不会是那个「全项第一」的模型。

Fable 5和GPT-5.6 Sol在前, Kimi K3在侧,V4想靠纯性能掀桌子,难度不小。

但 DeepSeek 从来打的,就不是这张牌。

真正的看点是那条被反复验证的老路径:把Opus级的能力,价格压到七分之一。

毕竟,在动辄百万Token几十美元的巨头面前,哪怕是装上了「峰谷计价器」, V4也是那个大杀四方的「价格屠夫」。

参考资料:

https://x.com/pankajkumar_dev/status/2078536231026372846

本文来自微信公众号“新智元”,编辑:桃子

相關問答

QDeepSeek V4 的两个正式版本分别叫什么?

ADeepSeek V4 (GA)正式版包含两个版本:DeepSeek V4 Flash 和 DeepSeek V4 Pro。

Q根据文章,如何判断自己可能已获得DeepSeek V4 GA版的灰度测试权限?

A根据博主AiBattle提供的“验货口诀”,可以查看AI思考过程(思维链/CoT)的第一人称。如果开口是“I'm”或“I'll”,而不是老版本的“Let me”,那么大概率已用上V4 GA版。

Q文章提到开发者Pankaj Kumar对DeepSeek V4的性能有何评价?

A开发者Pankaj Kumar体验后总结:V4整体表现接近Opus 4.8级别,编码能力直追GPT-5.6 Sol,Agent能力大幅增强,3D和SVG生成显著变好。但他也指出,完成同样任务,V4所需的迭代轮数比Fable 5多,且从生态位看大概率打不过Kimi K3,但价格会显著更低。

QDeepSeek V4正式版在计费策略上的主要变化是什么?

ADeepSeek V4正式版将引入“峰谷计费”策略。以deepseek-v4-pro为例,百万输出tokens平时0.87美元,高峰时段1.74美元;缓存未命中的输入平时0.435美元。Flash版本价格更低。

Q根据文章观点,DeepSeek V4的核心竞争力是什么?

A根据文章观点,DeepSeek V4的核心竞争力并非追求“全项第一”的纯性能,而是其极高的性价比。它将Opus级别的能力,以显著低于竞争对手(如价格仅为Opus的七分之一)的价格提供,扮演“价格屠夫”的角色,以此来在市场中竞争。

你可能也喜歡

如何让自己变得让人工智能永远也无法取代

面对人工智能的冲击,许多人担心工作被取代。然而,真正的威胁在于个人对他人和系统的依赖,以及由此产生的“薪资奴役”——即为生存而从事无意义、枯燥的工作。摆脱这种困境的关键,不是抵制技术,而是成为拥有高自主性的“不可受雇”个体。 文章提出了成功抵御AI替代的五个核心要素:自主性(主动行动的能力)、品味(判断事物价值的经验)、说服力(让他人关注你工作的能力)、毅力(坚持并从错误中学习)和迭代(根据反馈持续改进)。这些能力无法仅通过理论学习获得,必须通过实践来培养。 要启动转变,首先要彻底改变环境,重塑身份认同。其次,应选择一个能获得真实、快速反馈的实践领域,例如创业。在众多技能中,内容创作(媒体)比编写代码更具优势,因为其价值是主观的,需要独特的审美和判断力,这正是AI目前难以完全复制的。 具体行动上,可以从三个步骤开始: 1. **挖掘原始素材**:反思自己长期痴迷的知识领域、轻松解决的难题或童年被压抑的兴趣,找到独特的个人经验。 2. **确立反向思考主轴**:找出你坚信但主流观点错误的地方,或行业内普遍忽视的“皇帝新衣”,形成独特的批判性视角。 3. **立即发布**:将前两步的思考融合,撰写并发布第一个核心内容(如帖子、视频),勇敢接受真实世界的反馈,并在此基础上持续学习和迭代。 最终,抵御AI的关键在于构建一份与自身身份深度契合的毕生事业,通过持续的内容创作和真实互动,建立无法被自动化取代的独特价值和影响力。行动,从今天发布第一个想法开始。

marsbit4 小時前

如何让自己变得让人工智能永远也无法取代

marsbit4 小時前

通过掷骰子离线保管比特币密钥:并非人人愿意为之

文章探讨了通过投掷骰子生成比特币钱包种子短语的安全方法及其现实挑战。核心观点如下: **1. 骰子提供物理熵源** 骰子结果由众多微小变量决定,理论上虽可预测,但实践中无法被攻击者复制或计算,从而提供高质量的随机性。每个六面骰子投掷约产生2.585比特熵,50次投掷即可满足典型12词助记词(128比特熵)的安全需求。 **2. Coldcard漏洞事件凸显手工熵源的价值** 近期Coldcard硬件钱包因固件漏洞导致其内部随机数生成器存在缺陷,致使约1128枚比特币被盗。但那些**完全**通过足量骰子投掷生成种子短语的用户未受此漏洞影响,因为他们的主密钥未使用有缺陷的生成器。 **3. 重要警示:手工种子并非万能保护** 安全研究员指出,即使用户使用骰子生成了安全的种子,若他们使用了Coldcard的其他功能(如生成纸钱包、克隆密钥、共享签名密钥、密码等),这些**衍生密钥**仍可能调用有漏洞的随机数生成器,从而存在风险。安全种子不保证设备生成的所有秘密都安全。 **4. 手工生成熵源的现实局限性** 尽管数学上可靠,但该方法对大多数用户并不友好: * **过程繁琐易错**:需投掷50-99次,精确记录,任何输入错误都会导致钱包完全不同。 * **引入新风险**:用户可能在记录、转换过程中泄露信息,或使用有偏的骰子/投掷方式。 * **用户体验差**:难以想象大规模推广需要用户手动投掷近百次骰子。安全措施需适应现实生活场景和普通用户的知识水平。 **5. 给用户的建议** 受影响的Coldcard用户应: * 更新固件至最新版。 * 检查是否使用过有漏洞的功能生成了次级密钥或密码,如有则需立即更换。 * 考虑采用多签方案,使用不同厂商的设备分散风险。 **结论**:手工投掷骰子生成熵源是技术娴熟用户的一个有效安全选项,但其过程复杂、容易出错,不适合作为主流用户的默认方法。长远目标是依赖安全、透明且无需专业知识的硬件/软件随机数生成方案。

cryptonews.ru7 小時前

通过掷骰子离线保管比特币密钥:并非人人愿意为之

cryptonews.ru7 小時前

交易

現貨
活动图片