# 推理的所有文章

在 HTX 新闻中心浏览与「推理」相关的最新资讯与深度分析。潘盖市场趋势、项目动态、技术进展及监管政策,提供权威的加密行业洞察。

挖矿即推理,Nockchain 的双重收益如何实现?

文章主要讨论了宏观经济数据后,聚焦于公链 Nockchain 即将上线的“Logos”升级。该升级核心是引入“零知识工作证明”(ZKPoW)与“AI推理计算”相结合的双重挖矿机制。 * **宏观背景**:美国CPI数据温和,股市表现继续优于加密货币市场。BTC ETF资金流近期转为净流入,可能为价格提供支撑。 * **Nockchain 的创新**:该链采用ZKPoW,矿工的工作是生成零知识证明,其计算本身具有可用性。Logos升级在此基础上,新增第二个挖矿谜题——执行AI推理的核心运算(整数矩阵乘法)。 * **双重收益机制**:升级后,网络70%的区块奖励分配给ZKPoW谜题,30%分配给AI计算谜题。这意味着,矿工为付费客户执行AI推理任务时,同一份算力同时有机会赢得区块奖励,实现“安全挖矿”与“算力收入”的双重收益。 * **挑战与现状**: * 该机制的成功依赖于能否吸引真实的、付费的AI推理需求。为此,项目创始人成立了National Compute公司,旨在作为首批客户向矿工购买算力。 * 升级上线时间已多次推迟,且新的AI计算谜题本身的安全性仍需时间验证。 * 目前NOCK代币市值约2200万美元,市场关注度不高。文章指出,项目已完成复杂的技术工程,但其成败关键在于能否真正建立起一个可持续的AI算力交易市场。

marsbit08/17 10:43

挖矿即推理,Nockchain 的双重收益如何实现?

marsbit08/17 10:43

Transformer祖传设计遭暴击,COLM顶会三篇论文发难

在COLM 2026会议上,三篇论文集中挑战了Transformer架构中被广泛接受为“标配”的设计,指出这些设计存在被忽视的缺陷。 首篇论文《Cracks in the Foundation》通过系统实验发现,诸如QK归一化、GQA(分组查询注意力)、滑动窗口注意力等常见设计组合使用时会严重损害模型的长上下文处理能力,其负面影响远超单个设计影响之和。例如,某些“标配”设计在不同基础模型上效果可能完全相反,而通常被认为浪费算力的“注意力汇聚”现象反而与更好的长上下文表现相关。 第二篇论文《Lost in Backpropagation》揭示了几乎所有语言模型都使用的输出投影层在反向传播中造成了严重的梯度信息损耗。研究显示,在GPT-2、Llama 3等多个主流模型中,高达95%-99%的梯度范数在此层被削除,剩余信号的方向也与原始梯度严重偏离,这意味着大部分用于调整模型参数的关键训练信号在传递过程中被悄然“吃掉”。 第三篇论文《When Fewer Layers Break More Chains》则指出,被普遍用于模型压缩的“层剪枝”方法存在隐患。虽然剪枝后模型在常规知识测评中表现下降平缓,但其进行复杂长链推理(如数学竞赛题)的能力会急剧下降,且无法通过简单的微调有效恢复。这表明剪枝可能破坏了模型进行深度、多步思考的关键机制。 这三项研究共同表明,Transformer中许多被视为理所当然的设计选择,实际上可能在长上下文、训练效率和复杂推理等维度上付出了未被察觉的代价,呼吁对这些“祖传”设计进行更细致的重新评估。

marsbit08/17 10:29

Transformer祖传设计遭暴击,COLM顶会三篇论文发难

marsbit08/17 10:29

一夜之间,GPT-5.6 Sol被OpenAI加速了14倍

8月14日,OpenAI联合AI芯片厂商Cerebras正式预览了其旗舰模型GPT-5.6 Sol的新服务层级“超高速模式”。在该模式下,GPT-5.6 Sol的输出速度最高可达750 tokens/s,相比标准模式提速最高达14倍,且不降低质量。横向对比,其速度比Claude Fable 5快11倍,比Opus 4.8快5倍。 在“人类最后的考试”基准测试中,GPT-5.6 Sol超快模式仅用11小时11分钟就完成了全部2500道难题,而Claude Fable 5需要超过78小时。该模式在GDP-Val等基准上也实现了显著的端到端速度提升。 此次突破主要依赖于Cerebras的晶圆级硬件架构。其最新的WSE-3芯片集成了4万亿晶体管和44 GB片上SRAM,使模型参数能常驻在超高带宽的片上内存中,避免了传统GPU因内存带宽限制而产生的数据搬运延迟。对于参数量超过单芯片容量的模型,Cerebras采用了多晶圆流水线并行机制。 更快的推理速度为实时应用开辟了新可能,例如事件响应、金融分析、客户支持、商务推荐和实时研究等。OpenAI内部已在事件响应和研究迭代等场景中测试该模式,显著缩短了从发现问题到制定方案的延迟。 超高速模式将率先在OpenAI API中推出,目前已有部分客户获得有限预览。此举意味着许多原本需切换至次级模型的任务,现在可直接使用旗舰模型快速完成,有望改变AI使用方式。

marsbit08/14 00:02

一夜之间,GPT-5.6 Sol被OpenAI加速了14倍

marsbit08/14 00:02

活动图片