# 网络安全的所有文章

在 HTX 新闻中心浏览与「网络安全」相关的最新资讯与深度分析。潘盖市场趋势、项目动态、技术进展及监管政策,提供权威的加密行业洞察。

Anthropic造了套AI越狱「刑法」:你的请求,四种死法

近日,Anthropic公布了其AI安全系统Fable的详细拦截规则,并将用户请求分为四类进行管理:明确禁止的恶意行为(如勒索软件)、高风险双用途行为(如渗透测试)、低风险双用途行为(如漏洞扫描)以及理论上无害的行为(如调试代码)。然而,该系统因“宁可错杀,不可放过”的原则,导致大量正常请求被误拦截,引发了用户不满。 为更系统化地评估安全风险,Anthropic联合Glasswing联盟推出了“网络越狱严重性框架”(CJS)。该框架从能力增益、能力广度、武器化难度和可发现性四个维度对AI越狱行为进行0-10分的量化评分,并划分严重等级。CJS旨在为模型下架等决策提供“客观”依据,但其评分标准由Anthropic及其盟友主导制定,引发了对规则制定权垄断的担忧。 文章指出,此前Fable 5模型因美国出口管制政策被全球断服,标志着监管首次直接作用于模型API。如今,重新上线的模型已配备更严格的过滤系统。而更强大的Mythos模型仅对特定合作机构开放,形成了“技术分层”的管控格局。在此背景下,CJS框架也被视为递给监管者的“行刑尺”。 对于普通用户,文章建议在提示词中避免敏感词汇、注意模型降级信号,并耐心等待系统优化。最终,AI能力的边界已不纯粹是技术问题,更受到了商业策略与地缘政治规则的双重塑造。

marsbit07/06 00:24

Anthropic造了套AI越狱「刑法」:你的请求,四种死法

marsbit07/06 00:24

「AI几小时攻破NSA」刷屏,真相竟是一场红队演习?

一篇关于“AI几小时攻破NSA”的报道在网络上广泛传播,但事实真相可能被误读了。这句话源自《经济学人》的一篇报道,引用了美国参议员转述国家安全局(NSA)局长的话,称Anthropic的最强AI模型“Mythos”在几小时内攻破了NSA几乎所有机密系统。 然而,原文作者后来澄清,这句话不应按字面理解。实际情况是,Mythos是在一次授权进行的“红队演习”中,于特定的测试环境里,结合其他工具,快速发现了系统中的安全漏洞。这更像是一次内部防御测试(如同消防演习),而非真正的网络入侵事件。 尽管如此,Mythos在测试中表现出的、远超人类团队的漏洞发现与串联能力,仍然是一个强烈的安全预警信号。正因为其强大的网络攻击潜力,Anthropic通过“玻璃翼计划”严格限制该模型的访问,仅提供给通过审核的防御机构(包括NSA)用于自查。 美国政府对该模型的态度显得矛盾:一方面,曾以供应链风险为由切断与Anthropic的合作,并一度下达出口管制令;另一方面,其下属的NSA等机构却在持续使用Mythos来加强自身防御。这凸显了面对尖端AI能力时,封杀与依赖并存的复杂局面。事件的核心争议在于,对AI能力的评估和监管信息愈发不透明,公众难以看清真相。

marsbit06/23 00:53

「AI几小时攻破NSA」刷屏,真相竟是一场红队演习?

marsbit06/23 00:53

活动图片