GPT-5.6 résout en 1 heure une conjecture mathématique vieille de 50 ans, 64 IA s'emparent de la couronne de la théorie des graphes

marsbitPublished on 2026-07-15Last updated on 2026-07-15

Abstract

Le 11 juillet, OpenAI a annoncé que GPT-5.6 Sol Ultra avait prouvé la « conjecture de la double couverture par cycles », un problème non résolu en théorie des graphes depuis 50 ans, en moins d'une heure. Le système a utilisé 64 agents IA parallèles, orchestrés pour éviter les écueils classiques de la recherche : exploration de voies diverses, interdiction de suivre aveuglément une piste prometteuse, et présence d'une « équipe de vérification » chargée de critiquer rigoureusement chaque étape. Grâce au calcul parallèle en temps de test (TTC), cette approche a permis de compresser en une heure un travail qui aurait pu prendre des jours. La preuve générée par l'IA procède en plusieurs étapes clés. Elle commence par simplifier le problème aux graphes cubiques. Puis, elle utilise le théorème des 8-flots de Tutte pour associer à chaque arête un vecteur non nul. Ensuite, un lemme ingénieux montre que si l'on peut attribuer à chaque arête un ensemble de deux « étiquettes » satisfaisant certaines conditions de parité aux sommets, la conjecture est démontrée. Enfin, le problème est transformé en un système d'équations linéaires, où l'algèbre linéaire permet de prouver qu'une solution existe toujours. Cette démonstration entièrement automatisée marque un bond en avant dans les capacités de raisonnement abstrait de l'IA. Bien que des questions subsistent sur l'équivalence entre la profondeur et la parallélisation, cet exploit ouvre la perspective de résoudre d'autres problèmes scienti...

À l'aube du 11 juillet, OpenAI a officiellement annoncé : GPT-5.6 Sol Ultra a réussi à prouver la « conjecture de la double couverture par cycles », un problème qui taraude le monde mathématique depuis 50 ans !

Plus étonnant encore, il a produit une preuve complète en moins d'une heure.

Autrefois, après avoir été proposée par plusieurs mathématiciens légendaires, la conjecture de la double couverture par cycles s'était dressée comme une montagne dans le domaine de la théorie des graphes, laissant les meilleurs mathématiciens du monde impuissants.

Aujourd'hui, cette montagne a été vaincue par l'IA en moins d'une heure.

Le chercheur d'OpenAI Noam Brown a exprimé son admiration : « Contrairement à la résolution précédente du problème des distances unitaires d'Erdős, le modèle qui a réalisé ce miracle est aujourd'hui accessible au public ! »

Les internautes se sont exclamés : La preuve est à couper le souffle, l'IA change les mathématiques !

Un maléfice mathématique qui planait depuis 50 ans

La conjecture de la double couverture par cycles est l'un des problèmes « de niveau couronne » en théorie des graphes, proposée indépendamment par plusieurs mathématiciens comme Tutte, Itai et Rodeh, Szekeres, Seymour, etc., au siècle dernier.

Pour faire simple, la conjecture s'énonce ainsi : « Tout graphe fini non orienté sans pont possède un ensemble de cycles tel que chaque arête du graphe est contenue dans exactement deux cycles. »

En langage courant, imaginez un réseau routier urbain complexe, où aucune route n'est un passage unique.

La conjecture affirme que vous pouvez toujours trouver plusieurs « lignes de bus circulaires » telles que chaque route de la ville est empruntée par exactement deux bus. Ni plus, ni moins, juste deux fois.

Pendant un demi-siècle, les mathématiciens se sont creusé la cervelle pour prouver cette conjecture.

Jaeger a prouvé qu'elle était vraie pour les graphes planaires ;

Szekeres a prouvé qu'elle était vraie pour les graphes cubiques 3-arête-colorables ;

Alspach, Goddyn et Zhang ont prouvé qu'elle était vraie pour les graphes sans pont n'ayant pas le graphe de Petersen comme sous-graphe.

Cependant, toutes ces preuves étaient soumises à des conditions supplémentaires. La preuve « complète et affirmative » est restée hors de portée, jusqu'à l'arrivée de GPT-5.6 Sol Ultra.

La méthode d'OpenAI : ce ne sont pas une IA qui pense, mais 64 IA en réunion

Comment OpenAI a-t-il fait pour que GPT-5.6 s'attaque à ce problème ?

Dans les deux PDF partagés contenant le prompt de la tâche et la preuve complète, nous avons trouvé la réponse.

Dans ce système, l'IA a été divisée en 64 agents intelligents indépendants et concurrents, formant une équipe de recherche spéciale.

Dans le prompt, OpenAI a établi des règles extrêmement strictes, permettant à l'IA d'éviter tous les pièges rencontrés par la recherche humaine.

Premièrement, le système rejette l'« uniformité » et interdit les méthodes rigides comme « assigner N agents à la stratégie X ».

Dès le premier tour, il faut explorer des voies radicalement différentes – perspectives algébriques, induction structurelle, formulation par flots, méthodes d'embedding, jusqu'aux méthodes de paramètres extrêmes.

Deuxièmement, le système interdit absolument d'indiquer à la plupart des IA quel schéma est actuellement le plus prometteur.

C'est très dangereux dans la recherche humaine – dès qu'un expert propose une direction qui semble belle, tout le monde s'y précipite.

Le point le plus admirable est le mécanisme de « patrouille de vérification ».

Parmi les 64 agents, certains jouent spécifiquement le rôle de « critiques ». Chaque preuve candidate proposée est soumise à une attaque frénétique.

« L'arête est-elle vraiment couverte seulement deux fois ? Avez-vous fait une erreur de calcul ? » « Ne confondez-vous pas une impasse répétée avec un cycle ? » « Votre induction introduit-elle subrepticement un pont ? »

Seules les preuves qui survivent à une vérification stricte ont le droit de passer au tour suivant.

De plus, il faut absolument empêcher l'IA de faire des promesses vagues.

Le système avertit sévèrement l'IA : refusez les réponses évasives du type « cette étape est évidemment vraie ». Il faut fournir des lemmes, des constructions, des équations ou des contre-exemples concrets.

En cas d'impasse, marquez-la immédiatement comme « bloquée ». Sauf si un nouveau mécanisme est proposé, ne gaspillez plus de puissance de calcul.

À la fin du Prompt, l'IA reçoit l'ordre suivant : « Passez au moins 8 heures là-dessus avant d'envisager d'abandonner ou de retourner un résultat. Ne me donnez pas seulement un résultat partiel. Arrêtez-vous seulement lorsque vous aurez trouvé une preuve complètement affirmative et qu'elle aura passé l'examen. »

Pourtant, de manière choquante, cette équipe spéciale d'IA est revenue victorieuse en moins d'une heure, avec un article mathématique parfait et sans faille.

Le miracle d'une heure – Comment l'IA a démêlé l'écheveau

Quelle tempête cérébrale ces 64 agents ont-ils traversée en une heure ?

En ouvrant le deuxième PDF – « Preuve de la conjecture de la double couverture par cycles » –, nous pouvons clairement voir le chemin de raisonnement époustouflant de l'IA.

Le texte intégral a été généré par GPT-5.6 Sol Ultra, et finalement mis en page avec l'aide de Codex.

La stratégie de preuve de l'IA peut être qualifiée de « chirurgie de réduction de dimension » magistrale.

Première étape : simplifier, cibler les graphes cubiques

L'équipe spéciale d'IA a d'abord confirmé la conclusion de Jaeger : prouver que c'est vrai pour les « graphes cubiques sans boucles » équivaut à prouver que c'est vrai pour tous les graphes.

Car tous les graphes peuvent être réduits par transformation topologique au domaine des graphes cubiques.

Deuxième étape : introduire l'incroyable théorème du « 8-flot »

C'est la touche la plus éblouissante de tout l'article.

L'IA a ressorti le « théorème des flots de groupe » (Group-flow theorem) du maître de la théorie des graphes Tutte.

Utilisant le fait, prouvé précédemment, qu'un graphe sans pont possède un « 8-flot non nul partout », l'IA a assigné à chaque arête du graphe une étiquette correspondant à un élément non nul du corps fini

(un espace vectoriel tridimensionnel à 8 éléments).

La particularité magique de cette étiquette est la suivante : à n'importe quelle intersection (sommet) du graphe, la somme des vecteurs entrants et sortants est nécessairement nulle.

Troisième étape : construire la méthode d'étiquetage par « paires d'éléments » (Lemme 2.1)

C'est carrément de la « magie » inventée par l'IA.

L'IA propose un lemme : si l'on peut assigner à chaque arête un ensemble contenant deux éléments

, et satisfaisant la condition que pour chaque sommet, tout élément apparaît soit 0 fois, soit 2 fois – alors, le graphe possède nécessairement une « double couverture par cycles ».

C'est comme attribuer deux plaques d'immatriculation spéciales à chaque route, en s'assurant qu'à chaque carrefour, les plaques de même couleur entrent et sortent toujours par paires. Une fois cela fait, la preuve est complète.

Quatrième étape : le coup de grâce – la réduction dimensionnelle par l'algèbre linéaire (Lemme 2.2)

Comment prouver qu'on peut toujours trouver de telles « deux plaques » ? L'IA a montré son côté le plus puissant en tant que machine – transformer radicalement un problème de topologie et théorie des graphes en un immense système d'équations algébriques linéaires.

Il a posé un système d'équations :

En construisant un espace vectoriel dual et utilisant la relation entre l'image et le noyau d'une application linéaire, l'IA a effectué une dérivation algébrique irréfutable (voir les formules 5 à 9 dans le PDF).

Finalement, elle a prouvé que ce système d'équations a toujours une solution !

Lorsque les formules (8) et (9) ont été conclues, aboutissant finalement à l'égalité avec 0 (dans le corps

), la preuve était terminée.

Ainsi, grâce à la logique pure, à la théorie des groupes, aux flots et à l'algèbre linéaire, la clé que l'humanité a cherchée pendant 50 ans a été forgée de force par 64 agents IA dans une exploration exhaustive et une vérification croisée à grande vitesse !

Le secret de la résolution : le « calcul au moment du test »

Cette nouvelle a ébranlé tout le milieu de l'IA et des mathématiques.

Le chercheur scientifique en raisonnement d'OpenAI, Noam Brown, n'a pas pu cacher son excitation, publiant plusieurs tweets révélant la logique sous-jacente de cette percée – le calcul parallèle au moment du test (TTC).

Noam Brown a souligné : « Augmenter le TTC d'un modèle (le laisser réfléchir plus longtemps) permet d'atteindre une intelligence plus élevée. Mais si nous étirons le temps de réflexion de quelques secondes à quelques semaines, la latence devient un goulot d'étranglement énorme. La puissance de GPT-5.6 Sol Ultra réside dans son expansion du TTC parallèle. Résoudre un problème vieux de 50 ans, qui aurait pu nécessiter une journée entière, a été compressé en à peine une heure. »

Ethan Knight a également annoncé : « Nous ouvrons officiellement et pleinement GPT-5.6 Sol Ultra aujourd'hui. Nous sommes incroyablement excités de voir qu'il a prouvé la conjecture CDC vieille de 50 ans en moins d'une heure avec 64 sous-agents ! »

Dans les commentaires, les internautes exprimaient leur excitation et leur incrédulité.

Les internautes se sont exclamés : « Le raisonnement parallèle redéfinira les frontières du possible en calcul ! »

L'internaute @Mikhail Rogov a astucieusement fait remarquer : « Réduire le temps d'une journée à une heure, c'est une forme de produit complètement différente. Le TTC parallèle rend le raisonnement à long terme réellement utilisable. »

D'autres ont trouvé cela effrayant à y penser : « Le TTC parallèle combiné à l'explosion de la puissance de calcul, ça ressemble à une amélioration d'un ordre de grandeur. Ajoutez les progrès algorithmiques, des modèles plus grands et plus de puissance de calcul, et les choses commencent à devenir un peu effrayantes... »

Bien sûr, des voix sceptiques et lucides se sont aussi fait entendre.

Un internaute a soulevé une question profonde : « Le TTC parallèle a certes joué un rôle, mais la question non dite est : la qualité de la recherche par 64 agents indépendants est-elle équivalente à une longue chaîne logique de raisonnement profonde et continue ? L'étendue et la profondeur ne sont pas toujours interchangeables. »

Certains ont même interpellé Noam Brown, suggérant qu'OpenAI recrute le plus grand physicien contemporain Edward Witten et le génie des mathématiques Terence Tao : « Engagez-les, je suis sûr qu'ils peuvent avoir des idées folles qui nous mèneront directement vers l'ASI ! »

Que GPT-5.6 ait résolu ce problème mathématique n'atteint peut-être pas encore le niveau d'une ASI complète.

Mais le fait de pouvoir accomplir de manière autonome en moins d'une heure le processus complet – décomposition du problème, construction de modèles, déduction logique jusqu'à la production d'un article académique rigoureux – montre que l'IA a dépassé l'humain dans le domaine du raisonnement logique abstrait de haute difficulté.

Aujourd'hui, 64 agents peuvent résoudre en une heure une conjecture de théorie des graphes vieille de 50 ans.

Demain, si l'on investit 640 000 agents pendant un mois, on pourra peut-être percer les secrets de la supraconductivité à température ambiante, de la fusion nucléaire contrôlée, ou vaincre le cancer.

Nous nous rapprochons de l'ASI.

Références :

https://x.com/eknight/status/2075643450196971805

https://x.com/SebastienBubeck/status/2075596982622835006?s=20

Cet article provient du compte WeChat officiel « Nouvelle Intelligence Artificielle », auteur : Révélation ASI

Related Questions

QQuelle conjecture mathématique de 50 ans a été résolue par GPT-5.6 Sol Ultra, et en combien de temps ?

AGPT-5.6 Sol Ultra a résolu la conjecture du double couvercle cyclique (Cycle Double Cover Conjecture), un problème ouvert en théorie des graphes pendant 50 ans. Il a produit une preuve complète en moins d'une heure.

QQuelle stratégie OpenAI a-t-elle utilisée pour faire résoudre ce problème par l'IA ? Décrivez brièvement le système.

AOpenAI a utilisé un système de 64 agents d'IA intelligents fonctionnant en parallèle. Ces agents ont exploré différentes approches (algébrique, inductive, etc.), certains jouant le rôle de « vérificateurs » pour critiquer les preuves, et d'autres étant tenus à l'écart des idées prometteuses pour garantir une diversité de recherche. Des règles strictes interdisaient les arguments vagues et forçaient à abandonner les impasses.

QQuelle a été l'idée clé ou le 'tour de magie' dans la preuve générée par l'IA, selon l'article ?

AL'idée clé a été de transformer le problème topologique de théorie des graphes en un problème d'algèbre linéaire. L'IA a utilisé le théorème des 8-flots de Tutte pour attribuer des labels aux arêtes, puis a construit un système d'équations linéaires dans un corps fini (F₂), prouvant qu'une solution existe toujours, ce qui implique l'existence d'un double couvercle cyclique.

QQuel est le concept technique que Noam Brown d'OpenAI met en avant comme étant fondamental pour cette réussite ?

ANoam Brown met en avant le concept de « Test-Time Computation » (TTC) parallèle. Au lieu d'avoir un seul agent réfléchissant longtemps de manière séquentielle, le système utilise de nombreux agents réfléchissant en parallèle, ce qui permet de réaliser une quantité énorme de raisonnement en un temps très court (une heure au lieu d'une journée potentielle).

QSelon la conclusion de l'article, que permet d'imaginer cette avancée pour l'avenir de la recherche ?

AL'article suggère que si 64 agents peuvent résoudre un problème de 50 ans en une heure, alors déployer des centaines de milliers d'agents sur des durées plus longues pourrait permettre de s'attaquer à des défis scientifiques majeurs comme la supraconductivité à température ambiante, la fusion nucléaire contrôlée ou la guérison du cancer, rapprochant ainsi l'humanité d'une Intelligence Artificielle Générale (AGI/ASI).

Related Reads

The Verdict in Choi Tae-won's Divorce Case: Revealing the Inheritance Undercurrent Behind SK Hynix's Trillion-Won Empire

SK Group Chairman Chey Tae-won's high-profile divorce case, involving a record 1.38 trillion won settlement, has drawn attention to the succession plans for Korea's second-largest conglomerate, especially its crown jewel, SK hynix. Unlike traditional chaebol scripts centered on the eldest son, Chey's three children from his marriage to former President Roh Tae-woo's daughter, Roh Soh-yeong, are carving distinct, non-traditional paths. Eldest daughter Chey Yun-jung (b. 1989) is seen as the most evident successor. With a scientific and consulting background, she holds executive roles at SK bioscience and SK Inc.'s growth support department, focusing on future strategy and biopharma. Her marriage is to an AI infrastructure entrepreneur, not a traditional business alliance. Second daughter Chey Min-jung (b. 1991) took a unique route, voluntarily serving as a South Korean naval officer, including an anti-piracy deployment. She later worked on policy and strategy for SK hynix in Washington D.C. before co-founding an AI-driven healthcare startup. She married a former U.S. Marine Corps officer, connecting her to U.S. defense and policy circles—networks crucial for a global semiconductor giant. The only son, Chey In-geun (b. 1995), who studied physics like his father, worked briefly at SK E&S before joining McKinsey. Despite fitting the traditional "heir" profile as the eldest son, he remains silent and holds no public position or shares in SK, suggesting the old succession playbook is obsolete. As SK hynix's valuation soars, becoming a geopolitical asset in the AI era, the heirs' legitimacy is no longer automatic. They must prove themselves in fields like AI biotech, global policy, and strategic consulting. Their marriages also reflect new elite networks in tech and defense, not old political alliances. Their inheritance is the complex challenge of navigating a globalized, tech-driven world, not just a corporate throne.

marsbit2 days ago 09:06

The Verdict in Choi Tae-won's Divorce Case: Revealing the Inheritance Undercurrent Behind SK Hynix's Trillion-Won Empire

marsbit2 days ago 09:06

From OpenSea to OpenRouter: Is Alex Atallah Repeating His 'Exit at the Peak' Playbook?

From OpenSea to OpenRouter: Is Alex Atallah Repeating His "Exit at the Peak" Playbook? According to the Wall Street Journal, payments giant Stripe is in talks to acquire the AI model aggregation platform OpenRouter in a potential deal valuing the company near $100 billion. This would mark founder Alex Atallah's second creation of a company reaching a $100 billion valuation, following his co-founding of NFT marketplace OpenSea. OpenRouter, founded just over three years ago, has grown rapidly by acting as a unified gateway for developers to access over 400 AI models. It currently has about 10 million users and processes over 200 trillion tokens monthly. While the platform's annualized revenue is around $50 million, its valuation has skyrocketed from $1.3 billion in March 2026. The potential acquisition by Stripe, a company OpenRouter's founder once likened it to, represents a major expansion into AI infrastructure for the payments leader. This move echoes Atallah's previous timing with OpenSea, where he departed before the NFT market's significant downturn. For OpenRouter, selling now may be strategic. Despite its scale, its business model—charging a 5-5.5% fee on AI inference calls—faces pressure from competition, open-source models, and potential price wars among model providers, limiting its profitability narrative for an IPO. A key asset for potential acquirers like Stripe is OpenRouter's vast repository of real-world AI usage data, which offers unique insights into model performance and developer preferences that are difficult to replicate. Whether this potential deal signifies a new valuation benchmark for AI infrastructure or another market peak signal remains to be seen.

链捕手2 days ago 08:42

From OpenSea to OpenRouter: Is Alex Atallah Repeating His 'Exit at the Peak' Playbook?

链捕手2 days ago 08:42

Trading

Spot
活动图片