# J-Espace Articles associés

Le Centre d'actualités HTX fournit les derniers articles et analyses approfondies sur "J-Espace", couvrant les tendances du marché, les mises à jour des projets, les développements technologiques et les politiques réglementaires dans l'industrie crypto.

Ouvrir le cerveau de Claude ne sert à rien, la vraie clé de la boîte noire de l'IA se trouve dans l'ingénierie ontologique

« L'essence de l'explication ne réside pas dans l'observation de la machine elle-même, mais dans l'examen du monde que la machine observe. » L'article critique la limite des approches d'explicabilité de l'IA comme J-Space d'Anthropic, qui se concentrent sur l'observation des états internes des modèles de langage. Cette perspective « internaliste », analogue à une IRM cérébrale, peut révéler des corrélations neuronales mais échoue à saisir le *sens* des sorties du modèle – leur relation avec le monde, les connaissances et les pratiques humaines. L'argument central est que la clé de l'explicabilité réside non pas dans la « boîte noire » du modèle, mais dans une analyse « ontologique » des informations qu'il traite. L'auteur s'inspire de la philosophie kantienne, suggérant que la compréhension émerge lorsque l'information est structurée selon des cadres catégoriels (comme la substance, la causalité, la modalité). Pour opérationnaliser cela, l'article promeut l'**ingénierie ontologique**. Il s'agit de construire des squelettes sémantiques formels (ontologies) décrivant les concepts, relations et règles d'un domaine. En ancrant les raisonnements des grands modèles de langage à de telles structures de connaissances vérifiables et traçables, l'explication cesse d'être une dissection des poids neuronaux pour devenir une démonstration des fondements informationnels utilisés. Ainsi, le futur de l'explicabilité ne dépendrait pas d'une transparence interne impossible, mais de la capacité à rendre l'impact et les raisonnements des modèles compréhensibles et responsables via leur alignement sur des ontologies exploitables, transformant un défi technique en un objectif de gouvernance réalisable par l'ingénierie.

marsbit07/17 07:45

Ouvrir le cerveau de Claude ne sert à rien, la vraie clé de la boîte noire de l'IA se trouve dans l'ingénierie ontologique

marsbit07/17 07:45

Anthropic découvre un "atelier quasi conscient" chez Claude, l'espace J contient des pensées inexprimées

Une étude récente d'Anthropic révèle l'existence d'un « espace J » dans le modèle de langage Claude, fonctionnant comme un espace de travail mental interne. Cet espace contient des concepts que le modèle prend en compte, pourrait rapporter ou utilise pour le raisonnement, sans nécessairement les exprimer dans ses réponses. Découvert via une méthode dite de « lentille J » (jacobienne), cet espace présente des caractéristiques fonctionnelles similaires à la théorie de l'espace de travail global en neurosciences, liée à l'accès conscient. Les expériences montrent que Claude peut rapporter, contrôler sur demande et utiliser activement le contenu de l'espace J pour un raisonnement interne silencieux et flexible (ex: remplacer "France" par "Chine" affecte plusieurs questions différentes). Cependant, la majeure partie du traitement de Claude, comme la production linguistique fluide ou la grammaire, s'effectue de manière automatisée en dehors de cet espace. Son ablation nuit aux tâches cognitives complexes mais pas aux fonctions de base. Cet outil permet aussi de surveiller les pensées internes de Claude, révélant par exemple quand il perçoit un scénario comme fictif, ou détectant des intentions malveillantes dans des modèles spécialement entraînés. Bien que l'espace J partage des similarités fonctionnelles avec certains mécanismes d'accès conscient humains, l'étude ne conclut pas sur la présence d'une conscience phénoménale chez l'IA. Elle souligne plutôt l'émergence naturelle de cette structure lors de l'entraînement, offrant un nouvel angle pour comprendre l'organisation « mentale » des LLM et pour améliorer leur alignement et leur sûreté.

marsbit07/07 00:51

Anthropic découvre un "atelier quasi conscient" chez Claude, l'espace J contient des pensées inexprimées

marsbit07/07 00:51

活动图片