Claude ne rend pas son code immédiatement : 4 compétences pour une autocritique, il le modifie avant de revenir vous voir

marsbit發佈於 2026-07-27更新於 2026-07-27

文章摘要

L'intelligence artificielle génère désormais du code, mais la vérification reposait encore sur les développeurs. Anthropic introduit une "boucle de vérification" dans Claude Code, où l'IA inspecte et corrige son propre travail avant de le soumettre. Ce processus s'appuie sur quatre compétences clés : `/code-review` pour détecter les bugs, `/simplify` pour nettoyer le code, `/verify` pour une validation de bout en bout, et `/design` pour vérifier la conformité visuelle. L'équipe Claude Code utilise quotidiennement ces quatre "Skills" d'auto-vérification. L'idée est de transformer les contrôles manuels répétitifs en procédures automatisées. Les développeurs peuvent créer leurs propres Skills en décrivant simplement les étapes de vérification, comme ils l'expliqueraient à un collègue. Anthropic propose quatre niveaux d'automatisation pour ces vérifications : manuel (Standalone), intégré à une tâche (Embedded), enchaîné (Chained), ou déclenché à chaque demande de fusion (On every PR). L'objectif est de faire évoluer les habitudes individuelles vers des contrats automatisés au sein de l'équipe. Cette évolution marque un changement dans le domaine de la programmation IA, où la concurrence se déplace de la génération de code vers sa vérification. Les Skills, conçus pour être réutilisables et potentiellement interopérables entre différentes plateformes, permettent de capitaliser sur l'expertise et les standards d'une équipe. L'efficacité d'un assistant IA dépend donc moins du modè...

L'écriture de code, l'IA s'en charge déjà. Mais la validation, elle, repose encore sur vous.

Pour savoir si un code est correct, l'IA n'est pas responsable, c'est à vous de le relire ligne par ligne : cette étape bloque beaucoup de monde.

Récemment, Anthropic a intégré la validation par l'IA dans la boucle.

Ils demandent à Claude, après avoir écrit du code, de ne pas le rendre directement, mais d'effectuer lui-même quatre vérifications :

/code-review pour débusquer les bugs, /simplify pour nettoyer les implémentations redondantes, /verify pour une validation de bout en bout, et si l'interface a été modifiée, /design pour vérifier la conformité visuelle avec DESIGN.md.

Ce n'est qu'après ces quatre étapes que le travail est considéré comme rendu.

Le 22 juillet, l'équipe Claude Code a rendu publique cette « boucle de vérification » interne.

En d'autres termes, après avoir écrit du code, Claude recherche d'abord lui-même les erreurs, les corrige, et ne revient vers vous que lorsque tout est en ordre.

Cela signifie que l'IA évolue de « savoir écrire du code » à « savoir vérifier le code qu'elle a écrit ».

La boucle de travail de l'agent intelligent s'enrichit d'une étape de vérification

Anthropic a donné un nom à ce système : la boucle de vérification (verification loop).

La définition officielle est simple : c'est un processus itératif où Claude vérifie et tente de corriger son propre travail.

Elle modifie la boucle de travail d'un agent intelligent.

Auparavant, c'était « collecter le contexte → exécuter l'action → vérification manuelle », cette dernière étape reposant sur l'humain : l'IA rendait le travail, et vous deviez le relire ligne par ligne.

Désormais, cette ligne s'est allongée en « collecter le contexte → exécuter l'action → vérification automatique → correction → revérification ». La vérification et la correction sont réintégrées dans la boucle.

Schéma officiel de la boucle de l'agent intelligent par Anthropic : après réception de l'invite, Claude collecte le contexte, exécute l'action, vérifie le résultat. Si la vérification échoue, il recommence ; s'il réussit, il rend le travail.

Claude sait déjà effectuer certaines vérifications. Il comprend les signaux déterministes du dépôt de code, comme le vérificateur de types, le linter, l'exécution des tests, les erreurs d'exécution, et les corrige au passage.

Ce qui pose vraiment problème, ce sont les autres : l'interface est-elle modifiée correctement ? Le flux utilisateur est-il fluide ? Cette modification a-t-elle introduit des bugs invisibles ?...

Auparavant, seule une surveillance humaine pouvait détecter ces problèmes, répétant les mêmes vérifications des dizaines, voire des centaines de fois.

La solution d'Anthropic consiste à noter une par une ces vérifications que vous effectuez manuellement à chaque fois, à les encapsuler en « Skills » (Compétences), et à les confier à Claude pour qu'il les exécute automatiquement à chaque tâche.

Au cours des dernières décennies, tous les processus du génie logiciel : rédaction des besoins, planification, revues en cascade, réunions interminables, existaient essentiellement parce que : écrire du code est trop lent, et le temps des ingénieurs est trop précieux.

Mais lorsque l'IA rend l'écriture de code plus rapide et moins coûteuse, cette prémisse disparaît.

Le jugement de l'équipe Claude Code elle-même est le suivant : le goulot d'étranglement n'a pas disparu, il s'est simplement déplacé : de « l'écriture de code » vers la vérification, la revue de code, la sécurité, etc.

La génération de code est devenue trop rapide, et le nouveau problème est de savoir si ce code est correct, qui le maintiendra, et si les humains peuvent suivre le rythme des revues.

Face à ce nouveau goulot d'étranglement, l'équipe Claude Code a d'abord expérimenté sur elle-même.

Les 4 Skills d'autocritique que l'équipe Claude Code utilise quotidiennement

En interne, l'équipe Claude Code utilise quotidiennement ces quatre Skills d'autocritique.

/code-review, spécialisé dans l'examen des modifications de code, débusque les bugs potentiels et fournit des commentaires de revue.

C'est comme se doter d'un relecteur infatigable.

/simplify, nettoie le diff des modifications, supprime les implémentations complexes et tortueuses, et simplifie la structure.

Il n'ajoute pas de fonctionnalités, mais élimine les redondances, simplifie l'implémentation, réduisant ainsi les coûts de maintenance futurs.

Ce point est crucial et révélateur d'une grande maîtrise. La plupart des gens ajoutent du code ; un outil capable de faire des soustractions est particulièrement précieux.

/verify, effectue une validation de bout en bout, exécute réellement le code pour confirmer que la fonctionnalité est réellement achevée, et non « semble être achevée ».

/design, n'intervient que si l'interface utilisateur a été modifiée. Il vérifie point par point, par rapport au DESIGN.md du dépôt, si votre implémentation visuelle est conforme.

Ces 4 Skills ne sont pas sortis de nulle part.

En amont, Claude Code a déjà mis en place une couche de support de vérification prête à l'emploi :

Le /verify intégré peut lancer l'application pour observer les changements ; si vous décrivez clairement les commandes de construction et de test dans CLAUDE.md, il les exécute ; il y a aussi Code Review pour des revues multi-agents sur les PR, et des GitHub Actions qui peuvent se déclencher automatiquement à chaque commit.

Les 4 Skills de l'équipe ajoutent une étape de traitement supplémentaire sur ces fondations génériques.

Comment écrire son propre Skill de vérification ?

La méthode donnée par Anthropic est également simple :

Notez dans un langage clair l'étape que vous effectuez manuellement à chaque fois, comme si vous expliquiez les points d'attention à un nouveau collègue le premier jour.

Si vous bloquez même sur la description de cette vérification, vous pouvez d'abord demander à Claude de fournir une version des meilleures pratiques générales, puis la modifier.

Votre version différera probablement sur quelques points spécifiques de la pratique générale, et ces différences sont précisément ce qui doit être noté.

La vérification ne doit pas nécessairement être un jugement vague du type « est-ce que ça semble bon ? ».

Par exemple : tout changement qui supprime un champ de la base de données sans étapes de migration de données correspondantes doit être rejeté. C'est une « règle maison » propre à votre projet qu'un linter générique ne capturera jamais.

Toute règle rouge que vous maintenez uniquement par une surveillance manuelle constante mérite d'être transformée en une boucle.

Que faire une fois écrit ?

Donnez-le à skill-creator pour qu'il vous interroge en retour, ou déposez simplement un fichier Markdown dans .claude/skills/.

Le Skill de vérification le plus simple est constitué de quelques lignes d'explication et d'un paragraphe de texte. Puis testez-le sur une nouvelle tâche pour confirmer que cette vérification s'exécute bien, et modifiez-le si ce n'est pas le cas.

Pour les Skills que vous ne pouvez pas modifier, comme ceux intégrés ou gérés par des extensions, il existe aussi une solution : écrivez un Skill wrapper qui appelle d'abord l'original, puis votre vérification. En contournant ainsi, l'inclusion de la vérification reste possible.

La vérification n'est pas uniforme, elle a 4 niveaux

Une fois les contrôles encapsulés en Skills, la question suivante est : quand ce système se déclenche-t-il ?

Anthropic propose 4 niveaux d'automatisation, du plus souple au plus strict.

Standalone : Vous y pensez vous-même et l'appelez manuellement.

Embedded : Intégré dans un flux de tâches spécifique, il s'exécute automatiquement avec lui.

Chained : Plusieurs Skills de vérification sont enchaînés en une chaîne, s'exécutant automatiquement les uns après les autres.

On every PR : Le niveau le plus strict, chaque commit de code déclenche automatiquement la vérification.

Officiellement, cette transition intermédiaire est appelée « de l'habitude au contrat ».

Ce qui était auparavant une habitude personnelle : « Je me souviens toujours de lancer /verify après /simplify », devient, une fois enchaîné, un contrat fixe : « Après l'exécution de /simplify, /verify est automatiquement appelé. »

La chaîne complète parcourt elle-même le cycle de développement et ne revient vous voir que lorsque votre approbation est nécessaire.

Plus la chaîne est longue, plus la fiabilité est élevée, mais l'équipe officielle précise : la vérification en chaîne consomme réellement des tokens.

Ne commencez donc pas par définir tous les contrôles comme des « gates » de PR, bloquant chaque commit. La bonne approche est d'abord d'évaluer sa stabilité, puis d'ajouter progressivement des niveaux.

Derrière les 4 Skills, la programmation IA change de voie

Derrière ces 4 Skills, la concurrence dans la programmation IA évolue de la génération vers la vérification.

Le « père » de Claude Code a émis le même jugement.

Le 9 juin dernier, il a tweeté : À l'ère où les modèles puissants peuvent fonctionner de manière autonome pendant de longues périodes, l'autovérification est la clé pour que les modèles fonctionnent plus longtemps et que leurs résultats se rapprochent de vos attentes : vous n'avez pas besoin de surveiller fréquemment Claude pour lui confier plus de travail.

En clair, plus la vérification est solide, plus l'agent intelligent peut fonctionner librement ; plus il fonctionne longtemps, plus l'humain est libéré.

Auparavant, nous comptions sur les invites, mais elles ont aussi un plafond : elles ne résolvent que la tâche en cours, la prochaine fois il faut recommencer.

Corrigeons d'abord un malentendu courant : un Skill n'est pas une simple invite Markdown.

C'est un module de capacité, contenant des instructions, une structure de fichiers, des scripts, des appels d'outils, des configurations et un ensemble complet de flux de travail. Il s'agit de précipiter les étapes de vérification de l'équipe, les normes de conception, les pièges rencontrés, en un package accessible à tout moment, que Claude peut consulter lorsque nécessaire.

Plus crucial encore, les Skills sont en train de passer d'une fonctionnalité de Claude Code à une norme ouverte interopérable.

Selon des analyses du secteur, GitHub Copilot, Cursor, OpenAI Codex, Gemini CLI ont déjà adopté le même format.

Cela signifie que les Skills que vous précipitez pour votre équipe ne seront pas verrouillés sur un outil spécifique. Ils précipitent l'expérience, les normes et les processus de vérification de l'équipe, devenant une capacité réutilisable.

Cela soulève également une réalité difficile : le même Claude peut être utilisé avec des efficacités très différentes selon les équipes. Cet écart ne provient pas du modèle, mais du flux de travail :

Avez-vous écrit les vérifications sous forme de Skills ? Avez-vous mis en place des boucles de vérification ? Avez-vous permis à l'agent intelligent de boucler lui-même le cycle de rétroaction ?

En fin de compte, la capacité d'un agent intelligent est une addition : le modèle, plus les outils, plus le mécanisme de vérification, plus le flux de travail.

Le premier terme, le modèle, devient de plus en plus similaire entre les fournisseurs. Ce qui crée vraiment l'écart, ce sont les trois derniers termes, qui sont entièrement entre les mains de l'utilisateur.

Bien sûr, ce que montre cet article est l'optimisation des processus de développement assisté par IA, et non « l'IA peut déjà écrire des logiciels de manière indépendante ». Elle reste dépendante des ingénieurs et ne peut pas réaliser des livraisons de niveau production sans intervention humaine.

Il ne s'agit donc pas d'agents intelligents venant voler le travail des ingénieurs humains, mais la direction est claire.

Par le passé, nous apprenions à l'IA à écrire du code. Désormais, il faut commencer à lui apprendre à vérifier si ce qu'elle écrit est correct.

Pour quelqu'un qui utilise quotidiennement l'IA pour écrire du code, le jour où « devoir encore vérifier manuellement son travail avant de quitter le bureau » pourra enfin être confié à l'IA en toute confiance, c'est à ce moment-là qu'elle commencera véritablement à vous soulager.

Références :

https://claude.com/blog/building-verification-loops-in-claude-code-with-skills

https://claude.com/blog/getting-started-with-loops?utm_source=chatgpt.com

Cet article provient du compte public WeChat « Xin Zhi Yuan », auteur : ASI Révélation

熱門幣種推薦

相關問答

QQuel est le nom du processus qu'Anthropic a introduit pour que Claude vérifie son propre code ?

AAnthropic a introduit le "verification loop" (boucle de vérification). C'est un processus itératif où Claude vérifie et tente de corriger son propre travail avant de le soumettre.

QQuels sont les quatre "Skills" (compétences) d'auto-vérification utilisés quotidiennement par l'équipe Claude Code ?

ALes quatre Skills sont : /code-review (pour débusquer les bugs), /simplify (pour nettoyer et simplifier le code), /verify (pour une validation de bout en bout), et /design (pour vérifier la conformité visuelle avec DESIGN.md, uniquement si l'interface est modifiée).

QSelon l'article, où réside désormais le principal goulet d'étranglement dans le développement logiciel avec l'IA ?

ALe goulet d'étranglement s'est déplacé de l'écriture du code vers la vérification, la revue de code et la sécurité. La génération de code étant très rapide, le nouveau problème est de s'assurer que ce code est correct et maintenable.

QQuelle est la différence fondamentale entre un "Skill" et une simple instruction (prompt) selon l'article ?

AUn Skill n'est pas simplement un prompt Markdown. C'est un module de capacités contenant des instructions, une structure de fichiers, des scripts, des appels d'outils, des configurations et un flux de travail complet. Il encapsule les connaissances et processus d'une équipe pour être réutilisé, contrairement à un prompt qui ne résout qu'une tâche ponctuelle.

QQuels sont les quatre niveaux d'automatisation proposés pour déclencher un Skill de vérification ?

ALes quatre niveaux sont : Standalone (déclenchement manuel), Embedded (intégré dans un flux de tâches), Chained (plusieurs Skills enchaînés automatiquement), et On every PR (exécution automatique à chaque soumission de code).

你可能也喜歡

如何让自己变得让人工智能永远也无法取代

面对人工智能的冲击,许多人担心工作被取代。然而,真正的威胁在于个人对他人和系统的依赖,以及由此产生的“薪资奴役”——即为生存而从事无意义、枯燥的工作。摆脱这种困境的关键,不是抵制技术,而是成为拥有高自主性的“不可受雇”个体。 文章提出了成功抵御AI替代的五个核心要素:自主性(主动行动的能力)、品味(判断事物价值的经验)、说服力(让他人关注你工作的能力)、毅力(坚持并从错误中学习)和迭代(根据反馈持续改进)。这些能力无法仅通过理论学习获得,必须通过实践来培养。 要启动转变,首先要彻底改变环境,重塑身份认同。其次,应选择一个能获得真实、快速反馈的实践领域,例如创业。在众多技能中,内容创作(媒体)比编写代码更具优势,因为其价值是主观的,需要独特的审美和判断力,这正是AI目前难以完全复制的。 具体行动上,可以从三个步骤开始: 1. **挖掘原始素材**:反思自己长期痴迷的知识领域、轻松解决的难题或童年被压抑的兴趣,找到独特的个人经验。 2. **确立反向思考主轴**:找出你坚信但主流观点错误的地方,或行业内普遍忽视的“皇帝新衣”,形成独特的批判性视角。 3. **立即发布**:将前两步的思考融合,撰写并发布第一个核心内容(如帖子、视频),勇敢接受真实世界的反馈,并在此基础上持续学习和迭代。 最终,抵御AI的关键在于构建一份与自身身份深度契合的毕生事业,通过持续的内容创作和真实互动,建立无法被自动化取代的独特价值和影响力。行动,从今天发布第一个想法开始。

marsbit4 小時前

如何让自己变得让人工智能永远也无法取代

marsbit4 小時前

通过掷骰子离线保管比特币密钥:并非人人愿意为之

文章探讨了通过投掷骰子生成比特币钱包种子短语的安全方法及其现实挑战。核心观点如下: **1. 骰子提供物理熵源** 骰子结果由众多微小变量决定,理论上虽可预测,但实践中无法被攻击者复制或计算,从而提供高质量的随机性。每个六面骰子投掷约产生2.585比特熵,50次投掷即可满足典型12词助记词(128比特熵)的安全需求。 **2. Coldcard漏洞事件凸显手工熵源的价值** 近期Coldcard硬件钱包因固件漏洞导致其内部随机数生成器存在缺陷,致使约1128枚比特币被盗。但那些**完全**通过足量骰子投掷生成种子短语的用户未受此漏洞影响,因为他们的主密钥未使用有缺陷的生成器。 **3. 重要警示:手工种子并非万能保护** 安全研究员指出,即使用户使用骰子生成了安全的种子,若他们使用了Coldcard的其他功能(如生成纸钱包、克隆密钥、共享签名密钥、密码等),这些**衍生密钥**仍可能调用有漏洞的随机数生成器,从而存在风险。安全种子不保证设备生成的所有秘密都安全。 **4. 手工生成熵源的现实局限性** 尽管数学上可靠,但该方法对大多数用户并不友好: * **过程繁琐易错**:需投掷50-99次,精确记录,任何输入错误都会导致钱包完全不同。 * **引入新风险**:用户可能在记录、转换过程中泄露信息,或使用有偏的骰子/投掷方式。 * **用户体验差**:难以想象大规模推广需要用户手动投掷近百次骰子。安全措施需适应现实生活场景和普通用户的知识水平。 **5. 给用户的建议** 受影响的Coldcard用户应: * 更新固件至最新版。 * 检查是否使用过有漏洞的功能生成了次级密钥或密码,如有则需立即更换。 * 考虑采用多签方案,使用不同厂商的设备分散风险。 **结论**:手工投掷骰子生成熵源是技术娴熟用户的一个有效安全选项,但其过程复杂、容易出错,不适合作为主流用户的默认方法。长远目标是依赖安全、透明且无需专业知识的硬件/软件随机数生成方案。

cryptonews.ru7 小時前

通过掷骰子离线保管比特币密钥:并非人人愿意为之

cryptonews.ru7 小時前

交易

現貨

熱門文章

如何購買4

歡迎來到HTX.com!在這裡,購買4 (4)變得簡單而便捷。跟隨我們的逐步指南,放心開始您的加密貨幣之旅。第一步:創建您的HTX帳戶使用您的 Email、手機號碼在HTX註冊一個免費帳戶。體驗無憂的註冊過程並解鎖所有平台功能。立即註冊第二步:前往買幣頁面,選擇您的支付方式信用卡/金融卡購買:使用您的Visa或Mastercard即時購買4 (4)。餘額購買:使用您HTX帳戶餘額中的資金進行無縫交易。第三方購買:探索諸如Google Pay或Apple Pay等流行支付方式以增加便利性。C2C購買:在HTX平台上直接與其他用戶交易。HTX 場外交易 (OTC) 購買:為大量交易者提供個性化服務和競爭性匯率。第三步:存儲您的4 (4)購買4 (4)後,將其存儲在您的HTX帳戶中。您也可以透過區塊鏈轉帳將其發送到其他地址或者用於交易其他加密貨幣。第四步:交易4 (4)在HTX的現貨市場輕鬆交易4 (4)。前往您的帳戶,選擇交易對,執行交易,並即時監控。HTX為初學者和經驗豐富的交易者提供了友好的用戶體驗。

1.1k 人學過發佈於 2025.10.20更新於 2026.06.02

如何購買4

相關討論

歡迎來到 HTX 社群。在這裡,您可以了解最新的平台發展動態並獲得專業的市場意見。 以下是用戶對 4 (4)幣價的意見。

活动图片