# 深度求索的所有文章

在 HTX 新闻中心浏览与「深度求索」相关的最新资讯与深度分析。潘盖市场趋势、项目动态、技术进展及监管政策,提供权威的加密行业洞察。

DeepSeek的十万亿美元之路:用开源撬动万亿硬件生态

DeepSeek的长期战略并非通过应用层(如编程订阅)直接变现,而是致力于通过一系列底层架构创新,重塑AI训练与推理的成本结构,并推动一个规模达10万亿美元的新硬件生态形成。 其技术创新始终围绕一个核心:在高端算力受限的背景下,如何用更少的资源跑出更强的模型。例如: 1. **压缩KV Cache**:通过MLA、DSA、CSA、HSA等机制,大幅减少长上下文所需的显存(HBM)。DeepSeek V4在100万上下文长度下仅需约5.5GB HBM,远低于其他主流模型,这使得将KV Cache卸载到SSD/NAND成为经济可行的方案,降低了对紧缺的HBM的依赖。 2. **以内存换计算**:其Engram模块利用LPDDR内存进行高效的O(1)知识查找,用更便宜的内存资源节省昂贵的计算开销。 3. **提升硬件兼容性与效率**:通过MoE架构、权重流式加载、TileLang编程语言等,旨在削弱对特定硬件(如CUDA生态)的依赖,让更多国产及全球的GPU、ASIC、存储和网络芯片能够高效运行AI负载。 这些创新若扩散开来,将直接惠及长江存储(NAND/SSD)、长鑫存储(LPDDR)等国内存储厂商,并为众多AI芯片厂商创造机会。DeepSeek的盈利模式可能类似于OpenAI与AMD的合作,通过深度绑定并赋能整个硬件生态,以换取股权等长期回报,从而在推动一个巨大产业形成的同时,实现自身万亿美金估值的终极目标。

marsbit05/25 13:13

DeepSeek的十万亿美元之路:用开源撬动万亿硬件生态

marsbit05/25 13:13

DeepSeek永久降价,但梁文锋并不想做「赛博菩萨」

DeepSeek宣布将V4-Pro API的75%折扣永久化,全球同步生效,基础输入/输出价格大幅降低至0.435美元/百万Token和0.87美元/百万Token。在AI行业普遍涨价的背景下,这一逆势降价行动被社区称为“赛博菩萨”行为。但创始人梁文锋并非纯粹做慈善,而是选择了开源普惠的商业模式。 当前AI行业正变得越来越贵,微软、Uber等大公司的Token预算消耗远超预期,而Anthropic、OpenAI和谷歌等巨头已在过去六个月内悄悄提价。随着用户习惯建立,AI补贴时代已结束,供需关系反转导致价格上涨。 DeepSeek的持续降价展现了一种反向定价权。其竞争力来源于多个方面:国产昇腾算力支持未来将进一步降低成本;中国相对较低的AI人才成本;最重要的是能源体系优势——中国西部绿电价格仅为欧美的1/5到1/4,且拥有完整的电力结构和“东数西算”等调度能力,电力成本占AI运营成本的60%-70%,这构成了系统性的成本优势。 虽然DeepSeek V4与顶尖闭源模型仍有客观差距,且商业收入目前落后于国内其他AI公司,但其极低的推理成本(仅为GPT-5.5的约1%到11%)满足了大量实际商业场景对“勉强能用+足够便宜+足够稳定”的需求。当AI整体越贵,DeepSeek的性价比优势就越突出,其商业价值也由此体现。

marsbit05/24 12:19

DeepSeek永久降价,但梁文锋并不想做「赛博菩萨」

marsbit05/24 12:19

知情人士:DeepSeek正在组建Harness团队,对标Claude Code

知情人士透露,DeepSeek正在内部组建一个名为“Harness”的团队,旨在开发代码智能体产品,直接对标Anthropic旗下的Claude Code。DeepSeek资深研究员陈德里在社交媒体证实了这一动向,并表示团队目标即“做DeepSeek Code Harness”。 此次招聘开放了Harness产品经理和研发工程师两个关键岗位。招聘信息揭示了一个核心公式:模型(Model) + 约束与控制层(Harness) = 智能体(Agent)。这表明DeepSeek的战略重点正从单纯的模型能力竞争,转向构建连接模型与真实工作流的“中间层”。DeepSeek认为,模型之外的上下文管理、工具调用、任务规划、代码修改、终端执行等能力,才是智能体融入开发者工作流的关键。 文章分析,DeepSeek此举并非简单打造代码助手插件,而是要“补齐模型通向真实工作流的中间层”,为强大的代码模型“装上双手”。过去,虽然DeepSeek的代码模型能力突出,但尚未形成高频使用的产品化工作流。Claude Code的成功证明,AI编程的竞争已转向争夺开发者工作流入口。 此前,一个名为DeepSeek-TUI的开源终端智能体项目在社区走红,它展示了开发者对DeepSeek版Claude Code的强烈需求,但也凸显了官方产品的缺失。官方Harness团队的优势在于能与模型团队深度协作,实现“模型与Harness的共同进化”,并将真实任务反馈系统性地注入模型迭代,形成数据闭环。 此举标志着DeepSeek在模型能力之外,开始全力构建其智能体产品的关键组成部分,正式进入以工作流为核心的“智能体战争”新阶段。

链捕手05/22 02:14

知情人士:DeepSeek正在组建Harness团队,对标Claude Code

链捕手05/22 02:14

活动图片