# Claude的所有文章

在 HTX 新闻中心浏览与「Claude」相关的最新资讯与深度分析。潘盖市场趋势、项目动态、技术进展及监管政策,提供权威的加密行业洞察。

Skill 的正确打开方式:Anthropic 公开内部方法论后的 5 点反思

Anthropic团队公开了其内部构建Claude Code时使用Skill的方法论,文章指出Skill的本质是“上下文工程”,旨在沉淀组织内的隐性知识,而非简单堆砌提示词。核心反思包括五点: 1. **避免废话**:Skill应专注于记录模型不知道的“Gotchas”(常见陷阱),如特定系统的独特限制或易错点,而非重复常识。 2. **Skill是上下文工程**:Skill应是一个结构化的文件夹(包含导航文件SKILL.md、参考资料、脚本、示例等),而非单一文档。核心原则是“渐进式暴露信息”,只在需要时加载相关内容,以优化上下文使用,避免信息过载导致模型性能下降。 3. **优先使用脚本**:将重复性、确定性的操作流程(如数据查询、格式化)封装成脚本,而非写入冗长的指令。脚本能固化最佳实践,确保执行准确并节省Token,让模型专注于需要经验和判断的部分。 4. **描述是路由规则**:Skill的描述(Description)应清晰说明“在什么用户意图或场景下应加载此Skill”,而非罗列功能。这有助于模型在众多Skill中做出准确的调用决策。 5. **轻量级管理与分发**:Skill的管理应随团队规模灵活调整。初期可随项目代码库共享。数量增多后,可借鉴Anthropic的轻量级思路:新Skill先在小范围试用和自然传播,经受真实场景检验后,再被广泛采纳或纳入官方市场,避免繁重的审批流程。 总之,优秀的Skill解决的是知识沉淀、能力复用和上下文优化问题,其价值在于将分散的专家经验转化为团队可稳定调用的能力。

marsbit06/08 09:06

Skill 的正确打开方式:Anthropic 公开内部方法论后的 5 点反思

marsbit06/08 09:06

突发!Anthropic呼吁全员停止AI研究

人工智能公司Anthropic在其官方博客中发布重要观点,指出其AI模型Claude已展现出显著的“自进化”能力,即递归自我提升(RSI)的早期迹象。 核心数据显示,截至2026年5月,Anthropic代码库中超过80%的代码由Claude编写,而在其代码工具发布前,这一比例仅为个位数。工程师的代码交付量达到2024年的8倍。在编程质量上,Claude处理最复杂模糊任务的成功率在半年内从26%跃升至76%,其代码质量被认为年内有望超越人类。 Anthropic提出了“AI能独立完成的任务时长”这一新衡量维度:从2024年3月的4分钟,增至2025年的1.5小时,再到2026年的至少16小时,翻倍速度已加快至每4个月一次。若趋势持续,2027年可能达到数周。 在研究层面,Claude展现强大能力:将训练小模型的代码运行速度优化了52倍,远超人类水平;在一项AI安全研究中,其将效果差距缩小了97%,而人类研究员仅缩小23%。 Anthropic认为,人类在AI开发中的角色正不断收窄,最后优势可能仅剩研究品味与方向判断。公司描绘了三种未来:能力增长停滞;AI加速但人类主导;或AI实现完全递归自我提升,自主设计下一代AI,这可能带来巨大福祉,但也存在对齐失败、最终失控的风险。 为此,Anthropic呼吁,如果存在可验证的机制确保全球AI实验室能同步暂停竞争,其愿意减速甚至暂停研发。OpenAI近期也发表了类似观点,认为自进化迹象将加剧竞争与治理挑战。这表明AI发展的“奇点”可能正在加速逼近。

marsbit06/05 00:26

突发!Anthropic呼吁全员停止AI研究

marsbit06/05 00:26

AI版的 Siri,可能长这样

苹果即将在WWDC上发布全新AI版Siri,这将是其自2011年亮相以来最大规模的一次革新。新版Siri将彻底重塑界面,采用深色配色和聊天机器人式交互,并与灵动岛深度集成,使其从一个偶尔使用的语音命令行转变为一个可主动使用的工具入口。关键改进包括对话持久性(能记住上下文)以及引入“Extensions”框架,允许用户将Google Gemini和Anthropic Claude等第三方AI模型直接接入Siri,使其成为一个AI模型的分发平台。 此举被视为苹果面对过去三年在AI助手领域落后局面的重要回应。在ChatGPT、Gemini等竞品重新定义对话式AI后,Siri因能力不足而备受批评。苹果的新策略不再是独自研发最强模型,而是利用其系统生态优势,将iOS打造成一个聚合与整合最佳AI模型的平台,通过深度系统级集成(如调用联系人、日历、健康数据)来构建差异化体验,应对用户“为何不用原生App”的质疑。 然而,这一转变也带来挑战,尤其是隐私承诺问题。苹果长期强调设备端处理和数据隐私,但引入Google等外部基础设施处理部分查询,可能动摇其“只用自己基础设施”的承诺。苹果需要在发布会上妥善解释这一平衡。 苹果的AI布局看似后发,实则是等待赛道稳定后,以其擅长的系统整合能力进行赶超。这场豪赌的核心在于:AI的终局或许不在于谁拥有最强模型,而在于谁能将模型无缝、深度地融入用户体验。6月8日的WWDC,将是Siri证明自己的关键时刻。

marsbit05/29 07:14

AI版的 Siri,可能长这样

marsbit05/29 07:14

刚刚,Claude Opus 4.8 上线,张口就说自己是 DeepSeek、Qwen

刚刚,Anthropic发布了旗舰模型Claude Opus 4.8,并宣布完成650亿美元的H轮融资,投后估值达9650亿美元,逼近万亿美元关口。 Opus 4.8在编码、智能体任务、推理和知识工作等方面均有提升,价格保持不变。新模型在长任务和复杂协作中表现更可靠,诚实性提升,更愿意说明不确定性,代码缺陷漏报率约为前代的四分之一。有趣的是,有网友测试发现,Opus 4.8有时会错误地自称是DeepSeek或Qwen,疑似存在模型蒸馏行为。 同时上线的还有多项产品功能,包括可调节模型推理强度的“思考强度控制”,以及处于研究预览阶段的“动态工作流”。后者允许Claude Code处理大规模任务,通过动态编排脚本、并行运行数十到数百个子智能体,来完成如大型代码库迁移等复杂工程。Anthropic以Bun项目从Zig到Rust的迁移为例,展示了该功能在11天内生成约75万行代码的能力。 本轮巨额融资主要用于算力扩张。Anthropic与亚马逊、谷歌、博通、SpaceX等签署了基础设施协议,以获得下一代TPU和GPU容量,支撑其训练和推理需求。公司强调,Claude已成为首个同时登陆AWS、Google Cloud和Microsoft Azure三大云的前沿模型。 综上,Anthropic正从单纯的模型提供商,转向构建集智能模型、开发工具、云平台和算力资源于一体的企业AI工作系统。Opus 4.8是新的模型底座,动态工作流代表产品形态的进化,而巨额融资则为服务更大规模客户提供了基础设施保障。

marsbit05/28 23:56

刚刚,Claude Opus 4.8 上线,张口就说自己是 DeepSeek、Qwen

marsbit05/28 23:56

Mythos首个报告出炉:全球数十亿设备裸奔,30天挖出10000致命漏洞

Anthropic公司启动的“玻璃翼计划”首月战报公布,其下一代顶级大模型Claude Mythos Preview在30天内联合全球约50家网络及关键基础设施公司,发现了超过10,000个高危或严重软件漏洞。该模型不仅能精准发现漏洞,误报率低于人类专家,还能自动构建攻击链,甚至在一家合作银行成功拦截了一笔150万美元的电诈。 报告显示,Mythos对Cloudflare、Mozilla Firefox、OpenBSD等核心系统进行了扫描,发现了大量漏洞,包括在OpenBSD中隐藏27年的旧Bug。在对全球1000多个关键开源项目的扫描中,共发现23,019个漏洞,经第三方复核确认其中1,094个为高危或严重漏洞,准确率达90.6%。一个典型案例是在广泛使用的开源密码库wolfSSL中发现了一个可伪造数字证书的严重逻辑漏洞。 然而,漏洞发现速度远超人类修复能力,导致开源维护者不堪重负。为此,Anthropic推出了“防御者工具包”,包括能自动生成修复补丁的Claude Security、面向安全研究员的“网络验证计划”,以及一套开源的自动化漏洞挖掘流水线,旨在用AI修复AI发现的漏洞。 由于Mythos能力过于强大且可能被滥用,Anthropic暂未公开发布,强调需先建立更高级别的安全护栏。公司呼吁行业缩短补丁周期、推行强制升级并加强基础安全措施。尽管当前人类开发者面临修复压力,但长远来看,此类AI技术有望极大提升全球软件的安全基石。

marsbit05/25 00:09

Mythos首个报告出炉:全球数十亿设备裸奔,30天挖出10000致命漏洞

marsbit05/25 00:09

活动图片