Sam Altman, le PDG d'OpenAI, a une fois de plus étonné le monde technologique.
Lors d'une récente conversation avec des stagiaires de la Silicon Valley, il a déclaré sans détour que "l'assistant IA ultime" n'était qu'à "une itération de modèle / 6 mois".
Dans les six prochains mois, nous allons entrer dans un monde où les successeurs de ChatGPT pourront regarder votre écran, enregistrer chaque réunion et appel, et maîtriser parfaitement tout le contexte de votre vie.
Nous ne sommes qu'à une itération de modèle de rendre cette fonctionnalité extrêmement pratique.
Notez qu'il ne parle pas seulement d'"une mémoire plus puissante" ou d'un "contexte plus large", mais bien d'une surveillance continue de votre écran, de l'enregistrement de chaque réunion et appel, et de la maîtrise du contexte parfait de toute votre vie.
Ce sera un changement qualitatif dans la relation homme-machine : passer du dialogue à la symbiose. Mais cette fois, la prédiction d'Altman est-elle fiable ?
Altman : Laissez l'IA mémoriser toute votre vie
Au cours des deux dernières années, Altman a évoqué à plusieurs reprises une vision : souhaiter un tout petit modèle de raisonnement, mais avec un contexte de mille milliards de tokens, capable de se souvenir de toute votre vie, et de l'enrichir continuellement.

Lors de la conférence Sequoia AI Ascent en mai dernier, Altman a fait une observation très convaincante.
Il a fait une distinction approximative mais claire :
Les personnes plus âgées utilisent ChatGPT comme un substitut à Google ;
Les 20-30 ans s'en servent comme conseiller de vie ;
Les étudiants l'utilisent directement comme système d'exploitation.
La tendance va plus loin : les jeunes "consultent d'abord ChatGPT pour les grandes décisions de leur vie".

Tout cela sont des signaux de la nouvelle forme future de l'IA. Mais cette fois, il ne se contente plus de parler de "mémoire", il mentionne directement la perception de l'écran et l'enregistrement complet des réunions.
Altman affirme avec audace : Dans les 6 prochains mois, la prochaine génération d'IA vous comprendra complètement.
Ce sera un véritable saut, passant d'une "utilisation occasionnelle" à une "présence continue", d'une "tâche ponctuelle" à "l'accumulation d'un contexte à l'échelle d'une vie entière". Plus vous investissez votre vie dans cette IA, plus le coût pour la quitter sera élevé.
La mémoire : de la conservation passive à la synthèse active
Les prémisses commencent déjà à apparaître : la version bureau de ChatGPT en mode vocal peut déjà accéder au contexte de l'écran, et la version entreprise dispose depuis longtemps de fonctions d'enregistrement et de synthèse de réunions.
Le 21 avril de cette année, OpenAI a lancé une version de recherche préliminaire d'une fonctionnalité nommée Chronicle dans son produit de programmation Codex.
Grâce à des captures d'écran intermittentes en arrière-plan + OCR, elle génère des souvenirs sur "ce que vous avez fait récemment", enregistrés dans des fichiers Markdown locaux chiffrés, aidant Codex à comprendre des références comme "ceci", "cela" ou un projet datant de deux semaines, sans que l'utilisateur n'ait à répéter constamment.
Après l'avoir testé, Greg Brockman, le président d'OpenAI, a dit deux mots : "surprisingly magical" (étonnamment magique).

Son nom de code interne est "telepathy" (télépathie). Altman lui-même a déclaré : "C'est exactement ce que ce nom évoque."

Mais Chronicle ≠ le "contexte de vie" complet. Il sert principalement au flux de travail de programmation de Codex, capturant le contenu récent de l'écran pour compléter le contexte, plutôt que d'enregistrer continuellement les réunions/appels ou de construire un profil personnel complet. L'utilisateur peut le suspendre à tout moment.
De plus, les risques sont importants ; la documentation officielle met clairement en garde contre les injections de prompt, le stockage local non chiffré et la nécessité d'une autorisation de l'utilisateur.
Un autre mouvement d'OpenAI est le lancement de Dreaming V3 sur ChatGPT en juin de cette année.

Dreaming V3 est la dernière architecture du système de mémoire de ChatGPT : le backend synthétise automatiquement l'état de la mémoire à partir de l'historique des conversations, possède une perception temporelle, réduit les informations obsolètes et améliore le rappel des faits et le suivi des préférences.
L'utilisateur peut consulter/modifier via la page de résumé des mémoires.
Le plus intéressant est sa capacité d'évolution automatique. Si vous avez dit "je vais à Singapour en juillet", une fois le temps écoulé, le système modifiera automatiquement la mémoire en "vous êtes allé à Singapour en juillet". La mémoire n'est plus statique, elle suit le temps.
Dans les évaluations internes d'OpenAI, cette mise à jour a entraîné une amélioration significative des performances :
Taux de rappel des faits : passé de 67,9 % en 2025 à 82,8 % ;
Suivi des préférences : passé de 55,3 % à 71,3 % ;
Précision temporelle : passé de 52,2 % à 75,1 %.

De plus, l'efficacité de calcul a été améliorée d'environ 5 fois, ce qui explique pourquoi elle peut être déployée pour les utilisateurs gratuits.
Dreaming V3 et Chronicle sont des progrès parallèles mais sur des lignes de produits différentes — l'un se concentre sur le contexte de l'écran (scénario de programmation Codex), l'autre sur la synthèse des conversations (ChatGPT général).
Ensemble, ils se rapprochent davantage de la direction décrite par Altman : "toujours actif, profondément personnalisé", mais ils en sont encore au stade de la prévisualisation de recherche / du déploiement par étapes.
La mémoire : en train de devenir le nouveau fossé concurrentiel
La vision d'Altman n'est pas isolée. En prenant un peu de recul, on constate que ces derniers mois, presque toute l'industrie de l'IA a parié sur la même direction au même moment.
Du côté de Google, c'est la voie entreprise.
Memory Bank a été lancé sur la plateforme d'agents d'entreprise de Gemini. Les développeurs peuvent ajouter à leurs agents IA une couche de capacité de mémoire persistante entre les sessions, qui extrait automatiquement les préférences de l'utilisateur, les points clés et les instructions explicites des conversations.
Cette ligne est actuellement plus orientée infrastructure pour développeurs et n'a pas encore été étendue à la boîte de dialogue grand public de Gemini, mais la direction est la même que celle d'OpenAI.
Anthropic n'est pas en reste.
En mars de cette année, la mémoire persistante a été déployée en masse pour tous les utilisateurs de Claude, versions gratuite et payante, le backend synthétisant discrètement vos données à partir des conversations.
En avril, une version bêta publique de la mémoire persistante a été ajoutée aux Managed Agents côté développeurs. Des clients entreprises comme Netflix l'utilisent déjà en environnement de production, avec une réduction des erreurs de 97 % pour certains utilisateurs entreprises.
Des tiers entrent aussi en scène, mais avec une approche opposée.
Des projets de couche mémoire comme Mem0 veulent devenir une couche intermédiaire de mémoire multiplateforme, s'interfaçant simultanément avec OpenAI, Anthropic, des modèles open-source, permettant aux développeurs de ne pas être enfermés chez un seul acteur.
Cela montre précisément que l'industrie a pris conscience du problème — si chaque géant construit son propre silo de mémoire, ce seront les utilisateurs et développeurs pris au piège qui en souffriront.

Aujourd'hui, presque tous les géants sprinte dans cette direction.
Mais ce que personne ne veut vraiment dire ouvertement, c'est que votre mémoire d'IA est désormais verrouillée sur la plateforme que vous utilisez le plus. Passer de ChatGPT à Claude, la mémoire est vide, tout recommence à zéro. Utiliser trois outils ensemble, c'est comme élever trois "vous" différents qui ne communiquent pas entre eux et se développent sur des trajectoires complètement distinctes.
C'est un fossé concurrentiel plus insidieux que la performance des modèles.
La force d'un modèle peut changer de classement en trois mois, mais la mémoire s'accumule et s'épaissit avec le temps. Plus elle s'accumule longtemps, plus le coût pour la quitter est élevé. Celui qui accumulera suffisamment de mémoire utilisateur en premier, sera celui qui soudra les utilisateurs à sa plateforme.
Comprendre cette couche permet de voir que la déclaration d'Altman n'est pas seulement une vision produit, mais aussi un jugement commercial.
Références :
https://x.com/OpenAIDevs/status/2046288243768082699
https://x.com/haider1/status/2087219995466224120
https://x.com/cory/status/2087060650870907170
https://www.youtube.com/watch?v=gXsutRiJbZI
https://inferencebysequoia.substack.com/p/openais-sam-altman-on-building-the?utm_source=publication-search
Cet article provient du compte WeChat officiel "新智元 (Nouvelle ère de l'intelligence)", auteur : ASI启示录





