Claude Code之父:Harness保质期只有半年,解开缰绳吧

marsbit發佈於 2026-07-30更新於 2026-07-30

文章摘要

Claude Code之父Boris Cherny建议,每六个月就应删掉系统提示词、工具和约束代码,重新评估其必要性。他认为AI模型如同活体生物,每代性格不同,不应预先猜测其需求,而应通过“消融实验”逐行测试指令的实际影响。他指出,模型能力的发展远超产品集成速度,存在“产品悬余”,因此需要“解缚”——给模型更困难的任务、允许其自由实验并学会自我验证,以激发其潜在能力。对于使用者和创业者,他主张摒弃寻找“奇技淫巧”的心态,以经验主义方式观察模型、放下控制欲,并将编程学习与实际应用结合。核心是保持迭代思维,大胆删除过时设计,让模型更自主地工作。

每六个月,删掉你的Claude.md,删掉你的skills,删掉你的hooks。

这是Boris Cherny——Claude Code之父给产品使用者们的建议。

YC7月28日新发布的访谈视频《Boris Cherny: We Cut 80% of Claude Code’s Prompt》中,Boris热情呼吁所有做AI产品的人都应该对自己的新产品勇敢按下删除键,大刀阔斧地去删除系统的提示词、工具、harness代码。

“你应该把整个系统提示词全删掉,然后一行一行加回来,看看每一行到底有什么影响。”

这个观点背后的概念是消融实验(ablation study),该概念贯穿了Boris Cherny的最新访谈,旨在控制其他条件不变的前提下,移除、替换或关闭一个模块,去比较性能、稳定性、效率或成本的变化。

访谈中Boris无不自豪地声称:实际上对于Opus 5,我们真心建议大家试试把这些东西全删掉,因为模型已经不需要了。

尽管最近的风波......用户也可以声称,“实际上对于Claude,真心建议把它删掉,因为我们已经不需要了。”(x)

除了“大胆删除”,Boris在访谈中还透露了更多关于自己对产品设计、模型使用和编程学习的价值性思考——

本文观点出自访谈视频,阅读重点如下:1、Boris的产品迭代策略:少一点预判,多去做测试2、“产品悬余”:同一时期内,模型能力总会超出产品边界3、“解缚”:让模型做更难的任务,独立工作更长的时间4、顶尖Claude用户是如何使用AI的?5、给编程学习者的3个建议

“模型是一种活体生物,它有自己的性格”

“今天Claude Code harness 里的代码,几乎只剩下安全、权限和静态分析的部分。”

7月24日,Anthropic发布了关于 Claude 5上下文工程的最新规则,其中针对Opus 5、Fable 5等新模型,Claude Code的system prompt被大幅精简,删除了超过 80% 的原有指令

具体可以参考量子位文章《Claude Code狂删80%提示词,Opus 5反手加回去了》。

针对此次变化,Boris在访谈中分享了自己的产品迭代策略:你不要去猜模型需要什么指令,因为你根本猜不对。你能做的就是一行行去删除,去测试,然后找到模型反复卡住的地方。

“你得把模型想成一个活的生物,一种更有机的东西。每一代模型的行为都不一样,性格都略有不同,你得花时间去了解它,然后据此调整harness。”

因此这对于Boris而言是更偏向“经验性”的,需要用科学的予以对待:不加预判地尝试,查看结果,迭代,重复。

而在这样一个不断推倒重来的世界里,Eval也未必能稳定使用。尽管它确实比harness和prompt耐用,但眼下模型进化太快,很多时候一套评测会被很快刷到满分。因此需要观察模型到底在哪不断挣扎,然后设计新的Eval。

一种思维:悬余、解缚

访谈中,Boris分享了一个概念叫“Product Overhang”,他认为这是一个对他做产品很有帮助的思考方式。

Overhang,什么意思?悬余

大模型以不连续的跳跃式速度跃迁,而产品集成却以连续的增量式节奏推进。这导致模型所具备的能力总会超出现有产品所能释放出的边界。

Boris举了一个例子:2024年底sonnet 3.5刚推出的时候,这个模型就已经能一次性写整个文件的代码了。但当时的编程产品Copilot、Cursor早期版还在做补全代码这样的小事。

拥有完整终端权限的Claude Code一定程度上弥补了这种差距。这也是Boris提出的第二个概念“Unhobbling”,解缚,拿掉限制。

他分享了Anthropic内部的案例:有人尝试给Opus 5接入OpenCV(全球最大开源计算机视觉库),结果发现模型能自己画出人物肖像、动物风景,而在此前他们从未训练过模型去画画。

这就是“模型激发”(model elicitation),在不改变模型权重的前提下,通过提示词、上下文、工具或产品形态的设计,让模型表现出它本已具备、但此前未被调用的能力。

尽管这里或许还存在着疑问:如何归因?究竟是模型被激发出了原本就具备的能力,还是模型因为“脚手架”设计而学会了新的技能?

不过这或许并不重要,不管怎样,Boris毫不怀疑此间存有巨大的商业机会:

我不是说所有创业公司都能抓住。但我知道有人在思考这些问题,这里真的有巨大的机会,能从模型身上激发出那些令人惊叹、有趣、而且有商业价值的行为。

为此,Boris提出了三条他本人的模型“解缚”方法。

第一,给模型比你想象中更难做的任务。描述清楚目标和边界和退出条件,然后就放手。

第二,多去做实验。允许模型做一些没有明确商业目的但好玩的尝试,“给自己自由去玩模型、去做有创意的事”。

第三,让模型自己验证成果。如今的重点已经不是“prompt engineering”了,问题在于,“当你给Claude分配了一个非常困难的任务之后,你怎么让它在过程中就去验证自己做的工作?”

Boris认为第三点可能是如今大家做的最不尽如人意的一件事。因为如果模型不能自我验证任务,它就无法长时间独立运行

他自己的例子也许能给大家启发:

Boris:“好吧,我要你做的是——把Electron 应用重写成 Swift。我要你在Mac虚拟机里运行Electron应用,截屏,然后逐像素对比,跟Swift版本比,没做完就不要停。”主持人:这就是你的prompt?Boris:这就是我的prompt。主持人:跑了多久?Boris:还在跑。主持人:什么时候开始的?Boris:已经跑了两个多星期了,大概 14 天、15 天吧......Claude 还决定做直播,它做的事情是在内部建了一个Slack频道,然后每隔几分钟就发一张进度截图。

Boris给AI使用者和创业者的实用建议

在访谈末尾,主持人抛出问题:

那么,Boris,我们要怎么才能像你一样用好Claude呢?

Boris表示,最重要的是别去听LinkedIn上那些网红说的,别去刷Twitter。

关于使用AI,“每个人都在找那种‘奇技淫巧’。但根本就不存在那种东西。没有那种东西。”

他建议大家用经验主义方式对待模型,忘掉过去对旧模型的经验和课堂上学的计算机科学理论,直接观察模型在哪里卡壳,再针对性调整。

所以它已经不是一门理论科学了,它已经变成了一门经验科学。我觉得那些特别擅长放下自己的先验,放下那些“以前不行”的想法,愿意再试一次的人——会非常非常成功。

更重要的是保持一种心态,那就是放下自己对模型的“控制欲”,把模型当同事一样相处,不过度指定,不做太具体的要求,不试图让模型完全按照你会做的方式去做任务。因为“模型不是那样工作的”

对于那些还在学习编程的人,Boris呼吁不要只学纯计算机科学理论,要学如何应用。例如他本人最初学习编程的动力也是为了在数学考试中作弊。

通常这关乎创业,关乎做产品,关乎培养你自己的设计感、商业感,学会怎么做数据科学,学会怎么跟用户对话......当你把它们和计算机科学、工程结合起来的时候,才会变得真正有价值。

总之,“先做自己想要的东西,再升级去做别人想要的东西”。

本文来自微信公众号 “量子位”(ID:QbitAI),作者:关注前沿科技

相關問答

QBoris Cherny(Claude Code之父)在访谈中提出的核心建议是什么?

A他的核心建议是:每六个月,删掉你的Claude Code相关的文件(如Claude.md)、技能(skills)和钩子(hooks),进行消融实验。他主张大胆删除系统提示词和工具代码,然后一行行加回来测试影响,因为新一代模型(如Opus 5)能力已大幅提升,很多旧的设计已不再需要。

Q什么是Boris提到的“Product Overhang”(产品悬余)概念?

A“产品悬余”是指大模型的能力以不连续的跳跃式速度增长,而产品集成则是连续的增量式推进,这导致模型具备的能力总是超出当前产品所能释放的边界。例如,当模型已能一次性写整个文件代码时,很多编程产品还停留在代码补全阶段。

QBoris认为该如何对模型进行“解缚”(Unhobbling)?他提出了哪三个方法?

A“解缚”是指拿掉对模型的限制,激发其潜在能力。他提出的三个方法是: 1. 给模型比你想象中更难的任务。 2. 多进行没有明确商业目的的实验和创意尝试。 3. 让模型自己验证成果,以实现长时间独立运行。

Q对于如何更好地使用AI(如Claude),Boris给出了哪些实用建议?

A他的建议包括: 1. 不要盲目追随社交媒体上的“技巧”,因为不存在万能“奇技淫巧”。 2. 用经验主义方式对待模型,直接观察模型在哪里卡壳,并针对性调整。 3. 放下对模型的过度控制欲,像对待同事一样与之相处,不过度指定具体步骤。

QBoris对编程学习者提出了什么建议?

A他建议编程学习者不要只学习纯计算机科学理论,而要学习如何应用。应该将计算机科学、工程与创业、产品设计、商业感知、数据科学、用户对话等技能结合起来,这样知识才会变得真正有价值。他强调应先做自己想做的项目,再升级去做满足他人需求的产品。

你可能也喜歡

中国已形成专供神经网络内容使用的“人脸租赁”市场

在中国,一个全新的生物特征数据许可市场已经形成。普通公民、前演员、群众演员和网红可以合法出租自己的面部图像,用于人工智能生成的内容,该模式已广泛应用于微短剧、广告和电子游戏制作。专业数字平台为制片人提供丰富的面容目录,项目方则根据需求选择合适的类型。 例如,深圳的ActID和成都的New Claw等服务平台允许用户自行设定其数字分身的使用范围并定价,价格在15至700美元之间。为避免恶性竞争,New Claw设置了每张图像74美元的最低价格。平台负责人指出,出售肖像权成为一种可靠的增收方式,且行业对真实人类面容需求旺盛,因为完全合成的面孔常因不自然而影响观感。 数据显示,行业规模增长迅速。根据2026年5月发布的报告,2026年第一季度全国上线约12.8万部微短剧,其中AI微短剧占比超过95%,显示视频内容生产正加速转向自动化。 该新兴市场的关键特点包括:按年龄、性别和具体类型(如“邻家女孩”、“粗犷型”)精细筛选;权利人可严格限制自身数字形象的使用场景;提供生物特征数据无需传统表演技能。 分析认为,对真实生物特征数据的需求与“恐怖谷”效应有关。完全合成的面部常因不自然的微表情引发观众潜意识排斥,而使用真实照片为基础能保留算法目前难以凭空生成的细微神态。这标志着行业从纯粹生成转向混合建模,人类成为“活体模板”。 此发展模式也带来了新的脆弱性。研究人员警告存在未经许可克隆外貌的风险,数字版权保护技术目前滞后于生成式模型的进步。如何在商业利益与个人数据安全之间取得长期平衡,仍是待解课题。

cryptonews.ru40 分鐘前

中国已形成专供神经网络内容使用的“人脸租赁”市场

cryptonews.ru40 分鐘前

交易

現貨
活动图片