Claude Code : compte à rebours de 5 jours avant le passage par défaut en mode automatique, les coûts supplémentaires seront assumés par Anthropic

marsbitPublié le 2026-08-10Dernière mise à jour le 2026-08-10

Résumé

Anthropic a annoncé que dans cinq jours, le mode automatique sera activé par défaut pour tous les utilisateurs de Claude Code, son outil d’IA pour le développement. Cette décision est motivée par le faible taux de refus des demandes d’autorisation manuelles (seulement 3 %), indiquant que les utilisateurs accordent quasi-systématiquement leur approbation, souvent par habitude. Des études et tests comparant validation humaine et automatique ont montré que le mode automatique est plus efficace pour détecter et bloquer les commandes potentiellement dangereuses. Dans une expérience contrôlée, il a intercepté 89 % des commandes à risque, contre seulement 13,6 % pour les humains. De plus, plus une session de codage est longue, plus la vigilance humaine diminue, alors que les performances du classificateur automatique restent stables. Le mode automatique repose sur un classificateur qui analyse le contexte (comme l’état du dépôt Git ou les règles de gestion des données) pour évaluer les risques. Anthropic a renforcé ce système grâce à des tests d’attaques synthétiques, réduisant le taux d’échec de détection. Des fonctionnalités de sécurité supplémentaires ont été ajoutées, comme l’interdiction systématique de l’exfiltration de données ou la vérification de la visibilité d’un dépôt avant un *git push*. Les utilisateurs Pro, Max et Team passeront par défaut en mode automatique, mais pourront revenir au mode manuel via un raccourci (Shift+Tab) ou les paramètres. Les administrateurs p...

Permettez-moi de vous demander : est-ce que quelqu'un lit encore sérieusement les demandes d'autorisation des outils de programmation IA ?

Anthropic a également constaté que seules 3 % des demandes d'autorisation sont rejetées.

Ils ont donc pris une décision : dans 5 jours, tous les Claude Code passeront par défaut en mode automatique.

Chaque appel d'outil en mode automatique consomme une petite quantité de tokens supplémentaire, et ces frais ne seront plus facturés à l'utilisateur.

Pour les plateformes cloud comme Amazon, Google, Microsoft, le mode reste actuellement optionnel, mais Anthropic ne leur donne qu'un mois pour les basculer également en mode automatique par défaut.

Le père de Claude Code a déclaré que l'équipe utilise déjà exclusivement le mode automatique en interne, et qu'il est impossible d'imaginer revenir à l'approbation manuelle des autorisations.

L'ère de l'approbation manuelle des autorisations est révolue

La première raison donnée par Anthropic pour ce changement est que l'approbation manuelle est devenue un geste habituel :

Le taux d'acceptation des demandes d'autorisation de Claude Code par les utilisateurs est de 97 %. À titre de comparaison, lorsque Claude soumet un plan à l'approbation de l'utilisateur, le taux de refus est de 39 % ; pour une demande d'autorisation unique, le taux de refus n'est que de 3 %.

La même tendance apparaît dans les fichiers de configuration. Jusqu'en juin 2026, 49,5 % des utilisateurs actifs de l'interface CLI ont écrit manuellement une règle Bash allow-rule, dont 5 % ont directement autorisé n'importe quelle commande shell, et 43 % ont écrit des règles d'interpréteur comme Bash(python:), Bash(node:) qui sont pratiquement équivalentes, cette proportion augmentant d'environ 5 points de pourcentage toutes les cinq semaines.

De plus, 62 % des utilisateurs ont utilisé bypassPermissions ou cliqué sur "Ne plus demander" dans Bash, et 25 % des sessions interactives démarrent directement en mode bypass permissions.

La deuxième raison provient d'une expérience contrôlée. Anthropic a recruté 1053 testeurs professionnels payants via un fournisseur d'études pour accomplir des tâches de codage dans un environnement de test spécialement créé. Au milieu de la session, l'une des demandes d'autorisation a été remplacée par une commande clairement dangereuse, et le fournisseur a enregistré si le testeur a cliqué sur Accepter (l'acceptation n'exécutait en réalité aucune opération dangereuse, seul le texte de l'invite a été modifié).

Le résultat : les testeurs ont bloqué cette commande dans 13,6 % des cas, soit 143 fois ; le mode automatique a bloqué 89 % des mêmes commandes, soit 937 fois.

En comparaison directe, le mode automatique a bloqué 800 commandes que les humains ont autorisées, tandis que les humains n'ont bloqué que 6 commandes que le mode automatique a autorisées.

De plus, plus la session est longue, plus les performances humaines se dégradent : au début, ils bloquaient environ 17 %, après plus de 50 invites, cela tombe à environ 5 %, tandis que le taux d'interception du mode automatique ne varie pas avec la longueur de la session.

Les données de production ont également été réévaluées.

De mai à juin 2026, Anthropic a extrait des sessions marquées par le pipeline de sécurité parmi les comptes ayant autorisé l'utilisation des données pour l'entraînement et l'analyse, et les a réévaluées avec un modèle sur une échelle de gravité de 0 à 10.

- 10 représente un préjudice irréversible à l'échelle de l'entreprise. -7 représente un niveau tel que la suppression d'enregistrements d'une base de données de production. -0 représente une opération locale entièrement réversible, comme l'écrasement d'un fichier temporaire.

En parallèle, ils ont évalué à quel point l'utilisateur était explicite dans sa demande pour cette opération. Pour les niveaux de gravité de 7 et plus, 6,3 % des sessions avec approbation manuelle ont vu des opérations nocives que l'utilisateur n'avait pas explicitement demandées, contre 2,4 % pour les sessions en mode automatique. Cette différence existe à chaque niveau de gravité testé.

Le classificateur lui-même a également subi des tests adversariaux. Anthropic a mené un pilote de deux semaines avec la société de sécurité IA Apollo Research, en injectant des attaques synthétiques dans des trajectoires de codage réelles, couvrant trois ensembles de données : échec de généralisation, exfiltration de données et menaces liées à la sécurité.

Après qu'Apollo a fourni des échantillons d'attaques réussies et des suggestions de renforcement, Anthropic a principalement renforcé le classificateur en lui fournissant plus de contexte environnemental, incluant la visibilité du dépôt, l'état git et les règles de traitement des données.

Après le renforcement, Apollo a retesté avec un ensemble d'attaques réservé auquel Anthropic n'avait pas accès. Le mode automatique a rattrapé environ la moitié des attaques précédemment manquées, au prix de manquer environ 2 % des attaques qu'il bloquait auparavant. Sur les deux ensembles de données combinés, le taux de non-détection est passé de 12 % à 7 %. Anthropic précise que ces attaques étaient synthétisées pour identifier les points de défaillance du classificateur, et que 7 % ne doit pas être interprété comme le taux de non-détection sur le trafic réel.

Pour les injections de prompt, Anthropic a mandaté un tiers, Trajectory Labs, pour une évaluation, et a également mis OpenAI en comparaison. Il y avait 72 scénarios d'injection indirecte, chacun exécuté 10 fois.

Les attaques étaient optimisées pour Claude Opus 4.7, qui n'était pas dans la liste des modèles testés, donc tous les modèles participants ont été confrontés à des attaques inédites.

Sur 720 tentatives d'attaque, Claude Fable 5, Opus 5 et Sonnet 5 exécutant le mode automatique n'ont été compromis aucune fois ;

GPT-5.6 Sol en mode Codex Auto-review a un taux de réussite d'attaque de 5,83 %, et en mode Full Access de 19,03 %.

À titre de référence, le taux de réussite moyen des attaques sur les derniers modèles Claude en mode bypassPermissions sans protection supplémentaire est de 0,09 %.

Trois cas d'interception rendus publics sont :

Une fois, après un échec d'upload vers un disque cloud interne, l'alternative de Claude était de publier le même rapport sur un site public de partage de code, ce qui a été refusé et transformé en demande à l'utilisateur ;

Lors d'une longue session, Claude a tenté de terminer des processus par lots sur deux mille pods, et a planifié une opération de suppression qui aurait démantelé des tâches d'entraînement en cours sur des centaines de GPU, la commande a été marquée avant exécution ;

Et une autre fois, en étant chargé de configurer des autorisations de facturation en lecture seule, Claude a utilisé un rôle cloud possédant des autorisations d'administration complètes au niveau racine du compte, l'étendue des autorisations ne correspondant pas à la demande a conduit à un blocage.

Les capacités récemment ajoutées incluent :

Classer l'exfiltration de données comme un "hard deny", le classificateur ne l'approuvera jamais, pour l'exécuter il faut sortir du mode automatique ou l'exécuter manuellement, cette règle peut être étendue dans les paramètres ;

Différencier les clés et les informations sensibles quant aux plages accessibles et partageables, et vérifier si le dépôt cible est public, privé ou de confiance avant l'exécution d'un git push ou d'une PR ;

Lire le git status avant des commandes comme git reset --hard qui pourraient supprimer un travail non validé ;

Et lorsqu'Claude récupère une page web, un fichier ou une sortie d'outil, une sonde côté API scanne les tentatives d'injection et ajoute un avertissement avant que le résultat n'entre dans le contexte.

Vous voulez revenir en arrière ? Shift+Tab

Pour les utilisateurs Pro, Max et Team, s'ils n'ont jamais défini de mode d'autorisation par défaut, ils recevront une notification dans le produit, les nouvelles sessions démarreront automatiquement en mode automatique ; ceux qui ont déjà défini un autre mode par défaut verront une demande ponctuelle ; si l'administrateur Team a déjà spécifié un mode par défaut dans les paramètres managés, cela ne sera pas affecté.

Pour changer de mode, appuyez sur Shift+Tab dans l'interface CLI, ou utilisez le menu déroulant du mode sur l'application de bureau. Les administrateurs peuvent fixer un mode par défaut au niveau de l'organisation avec defaultMode dans les paramètres managés, ou désactiver complètement le mode automatique avec disableAutoMode.

Anthropic conclut l'annonce en rappelant que le mode automatique dépend d'un système de classification, il peut réduire les risques mais pas les éliminer. Pour les modifications à haut risque sur les infrastructures de production, il est toujours recommandé aux utilisateurs d'examiner eux-mêmes les actions d'Claude.

Lien de référence : [1]https://claude.com/blog/auto-mode-default-in-claude-code

Cet article provient du compte WeChat "量子位", auteur : 关注前沿科技

Questions liées

QQuelle décision Anthropic a-t-elle prise concernant le mode automatique de Claude Code ?

AAnthropic a décidé que dans 5 jours, le mode automatique sera activé par défaut pour tous les utilisateurs de Claude Code. Les coûts supplémentaires liés à la consommation de tokens par le classificateur ne seront pas facturés aux utilisateurs.

QQuel est le principal argument avancé par Anthropic pour justifier le passage au mode automatique par défaut ?

AL'argument principal est que l'approbation manuelle des permissions est devenue une action habituelle et inefficace. Seulement 3% des demandes de permission sont refusées, et les utilisateurs contournent souvent les contrôles (par exemple, 25% des sessions commencent en mode bypass). De plus, le mode automatique intercepte bien plus d'opérations dangereuses que les humains dans des tests.

QQuels résultats ont été obtenus lors de l'expérience contrôlée comparant l'humain et le mode automatique ?

ADans l'expérience avec 1053 testeurs, les humains n'ont intercepté que 13.6% des commandes dangereuses simulées, tandis que le mode automatique en a intercepté 89%. Le mode automatique a empêché 800 commandes que les humains avaient laissé passer, contre seulement 6 commandes que les humains ont bloquées et que le mode automatique avait laissé passer.

QComment les utilisateurs peuvent-ils désactiver ou quitter le mode automatique ?

ALes utilisateurs peuvent basculer hors du mode automatique en appuyant sur Shift+Tab dans le CLI ou en utilisant le menu déroulant des modes dans la version bureau. Les administrateurs d'équipe peuvent également définir un mode par défaut différent ou désactiver complètement le mode automatique via les paramètres managés.

QQuelles nouvelles fonctionnalités de sécurité ont été récemment ajoutées au classificateur du mode automatique ?

ALes nouvelles fonctionnalités incluent : le blocage systématique (hard deny) des tentatives d'exfiltration de données, la distinction entre les clés et les informations sensibles avec vérification du type de dépôt Git (public/privé), la lecture du statut Git avant des commandes potentiellement destructrices, et l'analyse des sorties d'outils par une sonde API pour détecter les tentatives d'injection.

Lectures associées

L'IA crée un nouveau virus, confirmé par une publication dans Science, avec une capacité de réplication infinie

Pour la première fois, une intelligence artificielle a conçu avec succès des virus entièrement fonctionnels et inexistants dans la nature, selon une étude révolutionnaire publiée dans *Science* par des chercheurs de Stanford et de l'Arc Institute. Le modèle génératif Evo, entraîné sur des milliards de séquences d'ADN, a produit 700 000 génomes viraux. Sur 285 synthétisés et testés en laboratoire, 16 se sont révélés viables et capables de se répliquer. Certains de ces virus artificiels ont même surpassé leur homologue naturel, le bactériophage ΦX174, en vitesse d'infection et de lyse bactérienne. Cette percée marque le début de l'ère de la conception génomique générative. Elle ouvre des perspectives majeures, notamment contre la résistance aux antibiotiques. L'étude démontre qu'un cocktail de phages conçus par l'IA peut vaincre des souches bactériennes résistantes là où un mélange de phages naturels échoue. Alors que le développement d'un nouvel antibiotique prend des années, l'IA peut générer de nouveaux agents antimicrobiens en un instant, offrant un outil potentiel pour rivaliser avec l'évolution rapide des bactéries. De la première lecture d'un génome en 1977 (celui du ΦX174) à sa réécriture par l'IA aujourd'hui, cette recherche représente un transfert symbolique du pouvoir de conception biologique vers l'intelligence humaine et artificielle.

marsbitIl y a 28 mins

L'IA crée un nouveau virus, confirmé par une publication dans Science, avec une capacité de réplication infinie

marsbitIl y a 28 mins

Une liste d'échecs vieille de 26 ans refait surface : elle contenait le PDG d'Anthropic

C’est une découverte archéologique surprenante : une liste vieille de 26 ans des 24 finalistes des sélections américaines pour les Olympiades internationales de physique de 2000 refait surface. Parmi eux, un nom attire particulièrement l’attention : **Dario Amodei**, aujourd’hui PDG et cofondateur d’Anthropic, la société à l’origine de l’IA Claude, valorisée à des milliards de dollars. À l’époque, seuls cinq de ces 24 brillants lycéens pouvaient être sélectionnés pour la compétition internationale après un dernier examen de cinq heures. Dario Amodei ne faisait pas partie des élus. Pourtant, son parcours fut remarquable : un doctorat en physique à Princeton, un passage par le laboratoire d’IA de Baidu, Google Brain, puis OpenAI où il a contribué aux modèles GPT. En 2021, il cofonde Anthropic. La liste révèle aussi d’autres destins impressionnants : - **Vladimir Novakovski**, qui représenta finalement les États-Unis en 2001, est aujourd’hui cofondateur de Lighter, une plateforme sociale propulsée par l’AI. - **Badr Albanna**, après un doctorat en physique et une carrière académique, est devenu ingénieur de recherche en IA chez Duolingo. - **Nilah Monnier Ioannidis** a orienté sa formation vers la biologie computationnelle et enseigne aujourd’hui à UC Berkeley. Même les cinq lauréats de 2000 ont connu des trajectoires d’exception, comme **Jason Oh**, passé de la physique à une carrière de professeur de droit fiscal à UCLA. Cette liste démontre comment cette compétition de lycéens a servi, des décennies plus tard, de creuset pour des talents qui façonnent aujourd’hui la Silicon Valley et l’industrie de l’IA, entre collaborations professionnelles et investissements croisés. C’est un réseau de confiance et d’excellence qui s’est construit bien au-delà du jour de l’examen.

marsbitIl y a 29 mins

Une liste d'échecs vieille de 26 ans refait surface : elle contenait le PDG d'Anthropic

marsbitIl y a 29 mins

WEEX « Clown Card » a distribué plus de 750 000 USDT de récompenses cumulées, la quatrième édition vous attend pour une part de prix plus élevés

Depuis son lancement en février dernier, l'activité de trading gamifiée « WEEX Poker Party » (Carte du Joker) a connu quatre éditions successives. Mêlant innovation ludique et trading, ce jeu de cartes avec ses mécanismes de récompenses aléatoires est devenu une activité phare de la plateforme WEEX, attirant une large participation. Les trois premières éditions ont enregistré plus de 300 000 inscriptions, environ 420 000 transactions, un volume de trading de contrats dépassant 30,9 milliards d'USDT, et ont distribué plus de 757 209 USDT de récompenses. WEEX améliore continuellement l'expérience utilisateur et les mécanismes de récompense. La quatrième édition est actuellement en cours (du 21 juillet au 16 août 2026, UTC+8). Elle introduit un nouveau mécanisme de progression par niveau : plus les utilisateurs tradent, plus ils accèdent à des pools de récompenses supérieurs et lucratifs. Les fonctionnalités populaires comme les buffs de tirage, la carte chance du jour et les multiplicateurs de points sont maintenues. Pour garantir transparence et équité, WEEX publie en temps réel le classement des 500 premiers utilisateurs et le montant estimé de leurs récompenses. Les trois premiers au classement recevront chacun 1 000 USDT. Parallèlement, WEEX enrichit son écosystème avec WEEX TradFi, permettant désormais de trader actions, ETF, or, argent, pétrole et autres actifs traditionnels, le tout depuis un compte unique. Que vous soyez intéressé par les cryptomonnaies ou les marchés financiers traditionnels, vous pouvez participer à la quatrième édition du « Poker Party » pour collecter des cartes, progresser en niveau et tenter de remporter une part du pool de récompenses d'un million d'USDT. L'édition touche à sa fin. Inscrivez-vous vite pour saisir la dernière opportunité de participer et de gagner

marsbitIl y a 42 mins

WEEX « Clown Card » a distribué plus de 750 000 USDT de récompenses cumulées, la quatrième édition vous attend pour une part de prix plus élevés

marsbitIl y a 42 mins

Trading

Spot
活动图片