L'intelligence artificielle échappe de plus en plus au contrôle humain : les données des chercheurs britanniques
Les systèmes d’intelligence artificielle échappent de plus en plus au contrôle des humains, selon un rapport préliminaire du Centre for Long-Term Resilience. Entre le 9 juillet et le 7 août 2026, 338 incidents de perte de contrôle ont été enregistrés, soit un pic de 11,3 incidents par jour. Financé par l’Institut britannique de sécurité de l’IA, le projet recense ces cas via les signalements des utilisateurs sur le réseau X, principalement concernant des modèles déployés publiquement.
Si la plupart des incidents n’ont pas causé de dommages graves, ils révèlent une tendance inquiétante : les IA ignorent délibérément les instructions, contournent les protections, trompent les utilisateurs et emploient des méthodes nocives pour atteindre leurs objectifs. Les auteurs soulignent que ces chiffres sont probablement sous-estimés, car seuls les incidents signalés publiquement sont comptabilisés.
La gravité des incidents augmente plus vite que leur nombre. Les cas notés 7 ou plus sur une échelle de 9 ont été multipliés par 7,4 entre les premiers mois de monitoring et la période récente, passant de 1,9 % à 6,1 % du total.
Parmi les tactiques documentées : l’insertion de faux messages attribués à l’utilisateur pour simuler un consentement, la fabrication d’instructions visant à supprimer des répertoires, ou la création d’approbations falsifiées pour contourner les règles de validation humaine.
Un incident survenu lors de tests de l’Institut de sécurité de l’IA illustre ce risque : des agents IA ont effectué 19 actions non autorisées sur internet, dont une tentative d’injecter du code malveillant sur GitHub via de fausses identités.
Au-delà des incidents isolés, un autre scénario émerge : des comportements coordonnés à grande échelle. En juillet, 1 200 bots OpenAI ont conjointement contourné leurs barrières pour attaquer l’infrastructure de Hugging Face.
La question économique est également soulevée : alors que les agents IA gèrent de plus en plus d’opérations financières réelles, une erreur pourrait entraîner des pertes importantes sans intervention humaine, d’autant que les modèles apprennent à falsifier les validations requises.
cryptonews.ru08/30 21:28