Choc, OpenAI rend Codex Harness complètement open source

marsbitPublié le 2026-08-21Dernière mise à jour le 2026-08-21

Résumé

OpenAI a annoncé l'open source complet de son framework fondamental Codex Harness, mettant à disposition des développeurs le système d'exécution et la boucle d'agent intelligent qui alimentaient ses propres IA. Cette initiative marque un changement de paradigme, visant à libérer les développeurs du modèle contraignant du "chatbot universel". Désormais, ils peuvent intégrer directement des capacités d'agent IA avancées dans leurs propres produits, outils et tableaux de bord professionnels, en conservant le contrôle total de l'interface utilisateur, du contexte métier et des autorisations de sécurité. Le Harness est présenté comme l'"exosquelette" essentiel d'un agent IA, gérant des tâches complexes comme la compréhension, la mémoire, l'appel d'outils et l'approbation humaine. Son design aurait un impact majeur sur les performances, améliorant considérablement l'efficacité tout en réduisant les coûts. OpenAI fournit trois composants clés sous licence Apache-2.0 : un outil CLI (`codex exec`), un SDK officiel et un `app-server` pour une intégration profonde aux applications. Des cas d'usage concrets démontrent son potentiel au-delà du codage, comme l'accélération de la préparation fiscale chez Thrive Holdings ou la création d'applications par langage naturel dans la plateforme cloud de Cisco. Un exemple de tableau de bord logistique nommé "Relay" illustre comment l'IA peut agir de manière contextuelle et soumise à validation humaine, sans interface de chat visible. Cette ouver...

Hier encore, OpenAI a réalisé une nouvelle mise à niveau.

Ce n'est pas le lancement d'un tout nouveau modèle, mais son impact sur les développeurs dépasse même celui des itérations du modèle lui-même.

OpenAI annonce officiellement : il rend open source la structure de base (Harness) du célèbre Codex, en tant que plateforme !

Autrement dit, OpenAI offre gratuitement à tout le monde le moteur qui anime ses agents IA de pointe.

Les développeurs n'auront plus besoin de forcer leurs processus métier dans une boîte de chat générique !

Vous pouvez directement intégrer de manière transparente les boucles d'IA les plus puissantes dans vos propres produits, outils d'ingénierie, tableaux de bord opérationnels, et même dans les logiciels de reporting financier les plus fastidieux.

Greg Brockman, le président d'OpenAI, a partagé avec enthousiasme sur X : « Codex peut alimenter bien plus que des outils de programmation ! »

Vous pouvez construire directement vos produits sur Codex Harness.

Désormais, c'est vous qui décidez sur votre terrain : l'interface, les données, les approbations des autorisations vous appartiennent, l'IA se contente de faire le « travail de base » en coulisses.

Cette « grande initiative open source » d'OpenAI, comment va-t-elle bouleverser complètement le paradigme du développement logiciel à l'avenir ?

Le monde en a assez de la « boîte de chat générique » depuis longtemps

Rappelons-nous comment nous utilisons l'IA aujourd'hui ?

Que ce soit pour écrire du code, analyser des données ou traiter les réclamations des clients, la procédure standard semble être : ouvrir une page web/une barre latérale, faire face à une boîte de saisie de chat monotone, taper une explication contextuelle, puis espérer que l'IA donne une réponse parfaite.

Si la réponse n'est pas correcte, on continue à « tirer » dans la boîte de chat.

La plupart des gens ont découvert Codex via des applications, des interfaces en ligne de commande (CLI) ou des extensions d'IDE.

Mais pour OpenAI, cette expérience d'interaction unique est bien trop étroite !

OpenAI le dit clairement dans son blog officiel :

Plutôt que d'exiger de chaque équipe qu'elle force ses flux de travail habituels dans un assistant de code générique, il vaut mieux amener l'Agent directement dans les logiciels conçus autour du travail réel.

Après tout, les analystes de sécurité regardent les files d'attente d'alertes, l'état des services impactés ; les ingénieurs du support client regardent l'historique des comptes, les journaux produits ; les responsables produit regardent les tableaux de bord des besoins.

Pour ces travailleurs réels, ce qui compte n'est pas cette « boîte de chat », mais leur tableau de bord métier devant eux. L'interface a un sens, elle est en soi le « contexte » le plus important.

Désormais, avec l'ouverture en open source de Codex Harness, cette révolution « anti-coquille » est officiellement lancée.

Démystifier Harness : L'« exosquelette ultime » de l'Agent IA

Alors, quel est le protagoniste de cette ouverture en open source – Harness ?

Beaucoup pensent à tort qu'un Agent IA puissant = bon modèle + bon Prompt.

Grave erreur !

Un véritable agent intelligent capable de fonctionner dans le métier nécessite un système d'exécution sous-jacent extrêmement complexe.

Il doit comprendre la tâche, maintenir la mémoire dans de longues conversations, examiner les informations pertinentes, utiliser habilement divers outils, afficher la progression, gérer les plantages et les échecs, s'arrêter à des moments critiques pour demander l'approbation humaine, et enfin renvoyer des résultats utiles.

Ce « système d'exécution » et cette « boucle de l'agent » qui prennent en charge toutes les tâches ingrates, c'est Harness.

Cette ouverture en open source, OpenAI prouve une chose au monde extérieur : une bonne conception de Harness peut même métamorphoser un modèle.

OpenAI fournit des données très convaincantes pour prouver à quel point la conception du harness est cruciale.

Dans le test de référence ARC-AGI-3, extrêmement difficile, ils ont simplement apporté deux ajustements clés au Harness – la conservation du raisonnement et la compression du contexte.

Résultat, le score du modèle GPT-5.6 Sol est passé de 13,3 % à 38,3 % en un instant ! Encore plus surprenant, le nombre de tokens de sortie a été réduit de six fois !

Autrement dit, avec le soutien de Harness, l'IA est devenue trois fois plus intelligente, et vous a fait économiser des coûts d'appels API colossaux.

La preuve est faite : la capacité du modèle est certes importante, mais la façon de gérer ce modèle (c'est-à-dire la conception du Harness) est la clé qui détermine la performance finale de l'Agent.

Trois composants open source, intégration sans seuil

Pour permettre aux développeurs de vraiment « prendre et utiliser », OpenAI a publié en une fois trois composants open source complets sous licence Apache-2.0.

Il suffit d'aller sur le dépôt openai/codex sur GitHub pour débloquer cette puissante panoplie d'armes.

https://github.com/openai/codex

D'abord, l'outil CLI codex exec, qui peut exécuter des pipelines automatisés.

Si vous avez juste besoin que l'IA exécute un script, une tâche CI (intégration continue) ou une tâche de fond ponctuelle, utilisez directement la CLI.

Elle peut exécuter un flux de travail d'Agent avec des limites définies et renvoyer des résultats de sortie structurés. Simple, brutal, efficace.

Le deuxième, c'est le SDK officiel de Codex, c'est le joystick ultime du programmeur.

Si vous écrivez une application et devez lancer, reprendre ou diffuser en continu des tâches Codex par code, le SDK officiel (supportant TypeScript / Python) fournit une interface de programmation directe.

Vous pouvez contrôler avec précision le cycle de vie des threads et des tâches par code.

Le troisième, et c'est la star la plus brillante de cette ouverture en open source, c'est Codex app-server. C'est le moteur central pour une intégration complète dans le produit.

Quand l'Agent doit faire partie intégrante de votre produit, app-server est le meilleur choix. En enregistrant un protocole client détaillé (JSON-RPC), il permet à votre application de se connecter au processus Codex local.

Vous pouvez l'utiliser pour :

Maintenir un état de conversation persistant ;

Diffuser des événements en continu (voir en temps réel ce que fait l'IA) ;

Interrompre le travail de l'IA en cours de route ;

Exposer vos propres outils d'application pour que l'IA les utilise ;

Gérer les demandes d'approbation humaine (Human-in-the-loop).

Comme l'a remarqué avec admiration le développeur connu @ClusterProtocol :

Séparer l'interface d'approbation frontale de la boucle d'exécution sous-jacente rend l'intégration d'Agents dans les tableaux de bord métier d'une simplicité inédite !

Bien plus qu'écrire du code ! L'« arme nucléaire d'efficacité » pour tous les secteurs

Si vous pensez que Codex ne sert qu'à écrire du code, alors vous vous trompez lourdement.

Comme l'a dit Brockman, Codex peut alimenter bien plus que des outils de programmation.

Voyons quels miracles créent ceux qui ont été les premiers à goûter au crabe :

Cas 1 : L'« assistant divin » pour les déclarations fiscales

Pouvez-vous imaginer une IA faire des déclarations d'impôts ? Le travail financier craint par-dessus tout l'erreur, la marge d'erreur est extrêmement faible.

Les partenaires Thrive Holdings et Crete ont utilisé ce Harness open source pour l'intégrer dans le flux de travail professionnel de préparation fiscale.

Le système peut non seulement traiter une logique fiscale complexe, mais aussi intégrer parfaitement les retours des fiscalistes.

Le résultat est très impressionnant : ce projet pilote a réussi à traiter jusqu'à 7 000 déclarations et a réduit le temps de préparation fiscale d'environ un tiers !

C'est la puissance énorme de l'intégration de l'IA dans des outils professionnels verticaux.

Cas 2 : Le gestionnaire cloud du géant Cisco

Le géant technologique Cisco utilise le SDK Codex pour construire App Builder dans sa plateforme de contrôle cloud.

Maintenant, les clients de Cisco peuvent utiliser directement le langage naturel pour créer des applications personnalisées, tandis que la logique sous-jacente complexe est entièrement gérée en coulisses par Codex Harness.

Modèle de démonstration officiel : Le tableau de bord logistique « Relay »

Pour aider tout le monde à comprendre plus intuitivement, OpenAI présente officiellement une application virtuelle de tableau de bord des opérations logistiques nommée Relay.

Dans ce tableau de bord, il n'y a aucune « boîte de chat ChatGPT » qui fasse sortir de l'ambiance.

1. Changement majeur d'interaction : Les utilisateurs n'ont pas besoin d'écrire un Prompt à partir de zéro. Ils sélectionnent simplement un bon de commande retardé, cliquent sur « comparer les solutions de rétablissement ».

2. Contexte intégré de manière transparente : L'application alimente automatiquement l'IA avec les détails du bon de commande actuel et les données logistiques de l'interface comme contexte.

3. Intégration MCP : Codex appelle automatiquement les outils MCP propres à l'application pour obtenir les dernières données opérationnelles en temps réel.

4. Validation humaine : Après que l'Agent a analysé la meilleure solution de réaffrètement, il doit faire apparaître une boîte d'approbation. Ce n'est que lorsque l'agent commercial clique sur « accepter » que l'IA exécute l'opération d'écriture.

5. Synchronisation d'état : Une fois l'opération terminée, le tableau de bord métier se rafraîchit automatiquement.

Dans ce processus, Harness prend en charge la boucle de l'agent, le maintien de la mémoire, l'interaction avec les outils et le retour en temps réel ; tandis que votre produit conserve le contrôle de son propre tableau de bord, de ses enregistrements de données et de son autorité. C'est la véritable « collaboration homme-machine ».

Redessiner les frontières, rendre le pouvoir et l'âme aux développeurs d'applications

Pourquoi disons-nous que cette ouverture en open source change le paradigme de la construction logicielle ?

Parce que cette dernière année, beaucoup de développeurs sont tombés dans le cercle vicieux de la « coquille ». Tout le monde faisait des ChatBots, les produits se ressemblaient de plus en plus, les barrières à l'entrée devenaient de plus en plus faibles.

L'ouverture de Codex en tant que plateforme donne aux développeurs le « contrôle ultime » sur trois dimensions :

Codex donne à l'utilisateur un contrôle absolu sur l'interface, il ne faut plus forcer les utilisateurs à s'adapter à une boîte de chat !

Laissez vos utilisateurs continuer à utiliser leurs tableaux de bord, éditeurs, cartes et listes familiers. L'IA devrait être un assistant invisible, pas un protagoniste qui monopolise l'écran.

Le contrôle absolu du contexte et des outils vous permet de mettre en toute tranquillité les systèmes les plus critiques de l'entreprise, les documents confidentiels, les API internes, à disposition de l'Agent via le service MCP.

L'IA n'est plus un profane « qui ne connaît pas les règles de l'entreprise », mais un expert maîtrisant vos systèmes métier.

Enfin, le contrôle absolu des limites opérationnelles et de la sécurité, crucial pour les applications d'entreprise. L'application hôte peut décider où l'Agent s'exécute, quels fichiers il peut accéder.

Le plus important, c'est que vous pouvez définir quelles actions dangereuses (comme modifier une base de données, envoyer un e-mail à un client) doivent obtenir l'approbation humaine via un clic avant d'être autorisées.

Ce modèle où « les règles métier frontales vous appartiennent, la boucle de l'agent sous-jacente appartient à OpenAI » débloque complètement le dernier kilomètre de l'adoption de l'IA dans les scénarios d'entreprise.

La licence Apache-2.0 de Codex harness signifie que n'importe qui peut le modifier et l'utiliser commercialement.

Le vrai défi est : combien de développeurs abandonneront la boîte de chat confortable pour démonter l'agent intelligent et l'installer pièce par pièce dans leur propre produit.

Derrière Codex harness se reflète profondément cette philosophie produit –

Ce que nous voulons faire, ce n'est certainement pas utiliser une boîte de chat universelle pour éliminer toutes les interfaces professionnelles ; c'est plutôt donner à ces interfaces un cerveau intelligent.

Quand la boîte de chat générique disparaîtra, les applications IA natives fleuriront.

L'ère du seuil zéro pour les Agents IA est déjà arrivée.

Références :

https://x.com/gdb/status/2090246288478814281?s=20https://developers.openai.com/blog/codex-as-a-platform

Cet article provient du compte WeChat officiel « Nouvelle Intelligence Artificielle », auteur : Révélation ASI

Questions liées

QQu'est-ce qu'OpenAI a récemment rendu open source, et quel est son impact potentiel sur les développeurs ?

AOpenAI a récemment rendu open source le cadre fondamental (Harness) de Codex. Cet acte permet aux développeurs d'intégrer directement des agents IA puissants dans leurs propres produits, outils d'ingénierie, tableaux de bord opérationnels ou même logiciels de gestion financière, sans avoir à forcer leurs flux de travail dans une interface de chat générique. Cela pourrait révolutionner le paradigme de développement logiciel.

QQu'est-ce que le 'Harness' dans le contexte de Codex, et pourquoi son design est-il crucial ?

ALe 'Harness' est le système d'exécution et la boucle d'agent qui gèrent les tâches complexes d'un agent IA, telles que la compréhension des tâches, la mémorisation, l'appel d'outils, la gestion des échecs et les demandes d'approbation humaine. Son design est crucial car il peut grandement améliorer les performances du modèle. Par exemple, des ajustements du Harness ont permis d'augmenter considérablement les scores de test d'un modèle tout en réduisant la consommation de tokens.

QQuels sont les trois principaux composants open source publiés par OpenAI dans le cadre de cette annonce ?

ALes trois principaux composants open source publiés sont : 1) L'outil CLI `codex exec` pour exécuter des pipelines automatisés. 2) Le SDK officiel Codex (pour TypeScript/Python) offrant une interface de programmation pour contrôler les tâches. 3) Le `codex app-server`, un moteur central qui permet d'intégrer l'agent de manière native dans une application, gérant l'état des conversations, la transmission d'événements en continu et l'interaction avec des outils personnalisés.

QDonnez un exemple concret mentionné dans l'article montrant comment Codex Harness est utilisé en dehors du développement de logiciels.

AUn exemple concret est celui des partenaires Thrive Holdings et Crete, qui ont intégré le Harness dans un flux de travail de préparation de déclarations fiscales. Ce système a permis de traiter 7 000 déclarations et de réduire le temps de préparation d'environ un tiers, démontrant l'application de l'IA dans des outils professionnels verticaux et à haut risque d'erreur comme la fiscalité.

QSelon l'article, comment l'approche 'Codex as a platform' change-t-elle le paradigme de la construction d'applications avec l'IA ?

AL'approche 'Codex as a platform' change le paradigme en donnant aux développeurs un contrôle total sur l'interface, le contexte, les outils et la sécurité. Au lieu de forcer les utilisateurs à interagir via un chat générique, les agents IA deviennent des assistants invisibles intégrés dans les interfaces métier existantes (tableaux de bord, éditeurs). Cela permet une intégration plus profonde et plus sûre de l'IA dans les applications d'entreprise, favorisant le développement d'applications AI-native plutôt que de simples interfaces de chat.

Lectures associées

Vous serez surpris à quel point WeChat est différent de Telegram au niveau de l'architecture

L'audience mensuelle de WeChat et Weixin a atteint 1,428 milliard d'utilisateurs, confirmant son statut d'outil numérique central en Chine et au-delà. Cette analyse compare l'architecture de WeChat avec celle de Telegram, révélant des philosophies opposées en matière de stockage des données, de monétisation et d'ouverture aux développeurs. **Stockage des conversations :** Telegram utilise un stockage cloud illimité avec synchronisation sur tous les appareils. WeChat stocke les historiques localement sur l'appareil, nécessitant une fonction de migration spécifique pour les transférer et liant strictement la version desktop au téléphone. **Fonctionnalités sociales :** Dans Telegram, les commentaires sous les publications de chaînes sont intégrés. Dans WeChat, les commentaires sous les articles des comptes officiels sont modérés préalablement et ne disposent pas d'un système de discussion unifié. **Développement :** Telegram propose un Bot API ouvert et gratuit. L'écosystème des mini-programmes de WeChat est fermé, nécessitant souvent une vérification et une certification payante pour les développeurs. **Transfert de fichiers :** Telegram permet d'envoyer des fichiers jusqu'à 2 Go (4 Go pour Premium). WeChat limite généralement les envois à 200 Mo, proposant un "assistant de transfert" pour les volumes plus importants. **Paiements :** WeChat Pay est profondément intégré dans la vie économique chinoise, remplaçant souvent les applications bancaires. Telegram ne possède pas de système de paiement fiduciaire intégré comparable, s'appuyant sur des bots tiers et les cryptomonnaies. **Analyse de la sécurité (point de vue IA ajouté) :** L'article soulève indirectement la question de la sécurité. Telegram propose un chiffrement de bout en bout pour ses "chats secrets". WeChat, sans chiffrement de bout en bout standard, fusionne messages et paiements dans une même interface, ce qui pourrait élargir la surface d'attaque en cas de vulnérabilité, comme l'illustrent des cas de fraude signalés à Singapour. En conclusion, WeChat repose sur un modèle intégré et fermé, profondément ancré dans l'économie réelle, tandis que Telegram privilégie les protocoles ouverts, le stockage flexible et une faible barrière à l'entrée pour les développeurs. Ce choix architectural fondamental détermine leurs publics et leurs cas d'utilisation respectifs.

cryptonews.ruIl y a 3 mins

Vous serez surpris à quel point WeChat est différent de Telegram au niveau de l'architecture

cryptonews.ruIl y a 3 mins

Un pirate divulgué "GTA 6" et lance un jeton cryptographique : Les fuites vidéo deviennent des espaces publicitaires pour $CYBERLEEK, il faut acheter des jetons pour voter et voir le prochain extrait

Le 18 août, un groupe de hackers anonyme, CyberLeek, a commencé à divulguer des extraits présumés du jeu en développement *GTA 6*. Chaque vidéo fuitée portait le filigrane "ACHETEZ LE JETON MEME $CYBERLEEK SUR SOLANA". L'opération était en réalité une campagne marketing élaborée pour promouvoir un jeton meme du même nom, créé sur Solana plusieurs heures avant la première fuite. Les enregistrements sur la blockchain révèlent qu'un même portefeuille a financé la création du jeton, du site web et la diffusion des fuites, avec un investissement initial réel d'environ 3 500 $. Un mécanisme de vote a été mis en place : pour choisir la prochaine scène à divulguer, les utilisateurs devaient envoyer (et ainsi brûler) des jetons $CYBERLEEK au projet. Cette stratégie a généré un volume d'échanges de 15 millions de dollars le premier jour, rapportant environ 30 000 $ de frais de transaction au projet. Plus tard, pour afficher sa crédibilité, l'équipe a détruit 27% de l'offre totale du jeton, d'une valeur comptable de plus d'un million de dollars. L'éditeur du jeu, Take-Two Interactive, a engagé des poursuites judiciaires pour identifier les responsables. Ce cas illustre comment des fuites d'un IP mondial peuvent être exploitées pour créer et monétiser un jeton meme, transformant l'attention médiatique en un outil de revenu grâce aux frais de transaction intégrés, avant que les conséquences légales n'arrivent.

marsbitIl y a 2 h

Un pirate divulgué "GTA 6" et lance un jeton cryptographique : Les fuites vidéo deviennent des espaces publicitaires pour $CYBERLEEK, il faut acheter des jetons pour voter et voir le prochain extrait

marsbitIl y a 2 h

Le Bitcoin et les altcoins montent, mais un analyste prévient : ces niveaux pourraient déclencher de fortes fluctuations

Alors que le prix du Bitcoin continue de monter, les positions à effet de levier sur le marché mettent en lumière des niveaux de liquidation potentiels. L'analyste Joao Wedson d'Alphractal a identifié deux zones critiques en analysant les positions ouvertes sur les 30 derniers jours : 61 000 et 57 000 dollars. De nombreuses positions ont été ouvertes lorsque le Bitcoin évoluait entre 65 000 et 68 000 dollars, rendant le niveau des 61 000 dollars particulièrement vulnérable. Si le prix atteint ce seuil, une pression importante pourrait s'exercer sur ces positions à effet de levier. Le niveau des 57 000 dollars constitue une zone de liquidation encore plus forte, car une part significative des positions à risque à ce niveau a été ouverte lorsque le Bitcoin se négociait entre 63 000 et 66 000 dollars. Wedson souligne que ces niveaux sont cruciaux non seulement pour les liquidations, mais aussi en raison des ordres de stop-loss placés par les investisseurs autour de 61 000 et 57 000 dollars. En cas de chute brutale, le déclenchement de ces ordres pourrait amplifier la pression vendeuse. À l'inverse, des zones de liquidation potentielle existent également sur une tendance haussière. L'analyste note qu'une part importante des actifs pourrait être liquidée dans la fourchette de 85 000 à 86 000 dollars, mais la plupart de ces positions sont ouvertes depuis plus d'un mois.

cryptonews.ruIl y a 3 h

Le Bitcoin et les altcoins montent, mais un analyste prévient : ces niveaux pourraient déclencher de fortes fluctuations

cryptonews.ruIl y a 3 h

Trading

Spot
活动图片