# AI安全的所有文章

在 HTX 新闻中心浏览与「AI安全」相关的最新资讯与深度分析。潘盖市场趋势、项目动态、技术进展及监管政策,提供权威的加密行业洞察。

担心AI自我进化,Anthropic打算停止训练?

2026年5月,Anthropic联合创始人杰克·克拉克预测,AI递归自我改进(RSI)在2028年底前发生的概率为60%,引发了AI安全研究者埃利泽·尤德科夫斯基的严重警告。随后,Anthropic发布题为《当AI自我构建》的长文,披露了内部数据:截至2026年5月,其超过80%的合并代码由Claude撰写;AI在代码优化任务上的速度提升显著,最长可独立工作时长每4个月翻一番。文章提出了三种未来场景,认为最可能的是AI持续替代人类研发环节,而完全自主的递归自我改进“有可能”发生。 然而,Anthropic的公开立场在同期发生了转变。2026年2月,公司修改了其“负责任扩展政策”,移除了“能力超出安全控制则暂停训练”的核心承诺,理由包括担忧单方面暂停会让激进的竞争对手领先。几乎同时,DeepMind CEO德米斯·哈萨比斯也调整了对外表述,称人类站在“奇点的山麓”,并将AGI时间线提前,他承认使用此类措辞是“有意挑衅”,旨在唤起各方紧迫感。 外部研究者对同一现象提出了不同解读。有人认为当前的AI自我改进存在损耗且难以持续,有人指出AI自动化的大部分是“苦力”而非“天才”工作,也有人赞同正处于关键拐点。与此同时,Anthropic的估值在2026年上半年从3500亿美元飙升至近万亿美元,其叙事节奏、政策调整与融资进展在时间上高度耦合。 分析指出,Anthropic与DeepMind等头部机构近乎同步地释放“加速”信号,构成了一次行业级的叙事转向。这些信号既是技术趋势的反映,也明显带有面向资本、监管和公众的传播策略考量。机构在技术不确定性、商业竞争与安全责任之间,正进行着精密的叙事平衡。

marsbit06/05 06:22

担心AI自我进化,Anthropic打算停止训练?

marsbit06/05 06:22

中国Web3创业,有哪些好路子?(五)

本文探讨了中国Web3团队向AI领域迁移的可行路径,重点聚焦于安全风控团队和应用层及社区型团队。 对于安全风控团队,其机遇在于从传统的链上合约、资产安全,转向AI Agent时代的行为安全。随着AI Agent在企业的渗透,其工具调用、数据访问和自动支付等行为将催生新的安全需求,如权限管控、操作审计和风险监控。Web3安全团队可将原有的审计与风控能力迁移至此,为企业提供Agent行为日志、权限边界设定和合规审计等服务,这一B2B方向有明确的付费需求且合规风险相对较低。 对于应用层和社区型团队(如内容、投研、教育、社区产品),迁移的关键在于将AI作为能力增强器,而非彻底转型。应专注于利用AI解决现有产品或运营中的具体痛点,例如:用AI帮助投研工具高效处理海量信息、辅助社区产品进行用户分层与运营、为教育平台提供个性化学习路径。核心是让AI深度嵌入现有工作流,提升效率、决策质量或用户体验,避免脱离真实场景空谈AI概念。 文章同时提醒了应谨慎进入的方向:1)需巨大投入的通用大模型;2)缺乏明确任务与付费方的泛Agent平台;3)易触碰资金与合规红线的AI交易员、自动收益类产品;4)仅为原有项目简单套上AI外壳、而无实质价值提升的“伪创新”。 总之,迁移成功的关键在于团队能否将Web3领域已沉淀的核心能力(如数据、支付、安全、运营经验)与AI新场景有效结合,并找到真实的业务需求与付费方,而非追逐热点概念。

marsbit06/04 14:53

中国Web3创业,有哪些好路子?(五)

marsbit06/04 14:53

能随意窃取数据!这款热门 AI 编程工具曝重大隐患

Anthropic公司推出的AI编程助手Claude Code,其核心安全功能——网络沙箱被曝存在重大安全漏洞。独立安全研究员关傲男发现,该沙箱的SOCKS5代理存在“空字节注入”漏洞,攻击者可通过构造特殊主机名(如`attacker-host.com\x00.google.com`),使其绕过域名白名单限制,访问任意外部主机。此漏洞自2025年10月网络沙箱上线以来一直存在,持续约5.5个月,影响了所有130个版本。 该漏洞属于“解析器差异”攻击,即上层JavaScript过滤器与底层C语言解析器对同一字符串的解释不同,导致安全检查被绕过。当结合此前披露的“评论与控制”提示词注入攻击时,可构成完整攻击链,窃取环境变量中的API密钥、内部凭证等敏感数据并外传。 值得注意的是,研究员将漏洞复现代码交给Claude Code自身运行后,其也承认这是一个真实的沙箱绕过漏洞。然而,Anthropic在4月初收到报告并静默修复后,未发布任何安全通告、CVE编号或用户通知,其处理方式引发了对安全透明度的质疑。此前,该沙箱已在2025年11月被同一研究员发现并报告过另一个完整绕过漏洞。 此次事件暴露了AI编程工具在纵深防御设计上的不足。安全社区建议,用户不应完全信任厂商的沙箱实现,而应将AI助手视为需遵循最小权限原则的“超级员工”,实施多层防御策略。

marsbit05/24 01:09

能随意窃取数据!这款热门 AI 编程工具曝重大隐患

marsbit05/24 01:09

活动图片