GPT-5.6 résout en 1 heure une conjecture mathématique vieille de 50 ans, 64 IA s'emparent de la couronne de la théorie des graphes

marsbitPublicado a 2026-07-15Actualizado a 2026-07-15

Resumen

Le 11 juillet, OpenAI a annoncé que GPT-5.6 Sol Ultra avait prouvé la « conjecture de la double couverture par cycles », un problème non résolu en théorie des graphes depuis 50 ans, en moins d'une heure. Le système a utilisé 64 agents IA parallèles, orchestrés pour éviter les écueils classiques de la recherche : exploration de voies diverses, interdiction de suivre aveuglément une piste prometteuse, et présence d'une « équipe de vérification » chargée de critiquer rigoureusement chaque étape. Grâce au calcul parallèle en temps de test (TTC), cette approche a permis de compresser en une heure un travail qui aurait pu prendre des jours. La preuve générée par l'IA procède en plusieurs étapes clés. Elle commence par simplifier le problème aux graphes cubiques. Puis, elle utilise le théorème des 8-flots de Tutte pour associer à chaque arête un vecteur non nul. Ensuite, un lemme ingénieux montre que si l'on peut attribuer à chaque arête un ensemble de deux « étiquettes » satisfaisant certaines conditions de parité aux sommets, la conjecture est démontrée. Enfin, le problème est transformé en un système d'équations linéaires, où l'algèbre linéaire permet de prouver qu'une solution existe toujours. Cette démonstration entièrement automatisée marque un bond en avant dans les capacités de raisonnement abstrait de l'IA. Bien que des questions subsistent sur l'équivalence entre la profondeur et la parallélisation, cet exploit ouvre la perspective de résoudre d'autres problèmes scienti...

À l'aube du 11 juillet, OpenAI a officiellement annoncé : GPT-5.6 Sol Ultra a réussi à prouver la « conjecture de la double couverture par cycles », un problème qui taraude le monde mathématique depuis 50 ans !

Plus étonnant encore, il a produit une preuve complète en moins d'une heure.

Autrefois, après avoir été proposée par plusieurs mathématiciens légendaires, la conjecture de la double couverture par cycles s'était dressée comme une montagne dans le domaine de la théorie des graphes, laissant les meilleurs mathématiciens du monde impuissants.

Aujourd'hui, cette montagne a été vaincue par l'IA en moins d'une heure.

Le chercheur d'OpenAI Noam Brown a exprimé son admiration : « Contrairement à la résolution précédente du problème des distances unitaires d'Erdős, le modèle qui a réalisé ce miracle est aujourd'hui accessible au public ! »

Les internautes se sont exclamés : La preuve est à couper le souffle, l'IA change les mathématiques !

Un maléfice mathématique qui planait depuis 50 ans

La conjecture de la double couverture par cycles est l'un des problèmes « de niveau couronne » en théorie des graphes, proposée indépendamment par plusieurs mathématiciens comme Tutte, Itai et Rodeh, Szekeres, Seymour, etc., au siècle dernier.

Pour faire simple, la conjecture s'énonce ainsi : « Tout graphe fini non orienté sans pont possède un ensemble de cycles tel que chaque arête du graphe est contenue dans exactement deux cycles. »

En langage courant, imaginez un réseau routier urbain complexe, où aucune route n'est un passage unique.

La conjecture affirme que vous pouvez toujours trouver plusieurs « lignes de bus circulaires » telles que chaque route de la ville est empruntée par exactement deux bus. Ni plus, ni moins, juste deux fois.

Pendant un demi-siècle, les mathématiciens se sont creusé la cervelle pour prouver cette conjecture.

Jaeger a prouvé qu'elle était vraie pour les graphes planaires ;

Szekeres a prouvé qu'elle était vraie pour les graphes cubiques 3-arête-colorables ;

Alspach, Goddyn et Zhang ont prouvé qu'elle était vraie pour les graphes sans pont n'ayant pas le graphe de Petersen comme sous-graphe.

Cependant, toutes ces preuves étaient soumises à des conditions supplémentaires. La preuve « complète et affirmative » est restée hors de portée, jusqu'à l'arrivée de GPT-5.6 Sol Ultra.

La méthode d'OpenAI : ce ne sont pas une IA qui pense, mais 64 IA en réunion

Comment OpenAI a-t-il fait pour que GPT-5.6 s'attaque à ce problème ?

Dans les deux PDF partagés contenant le prompt de la tâche et la preuve complète, nous avons trouvé la réponse.

Dans ce système, l'IA a été divisée en 64 agents intelligents indépendants et concurrents, formant une équipe de recherche spéciale.

Dans le prompt, OpenAI a établi des règles extrêmement strictes, permettant à l'IA d'éviter tous les pièges rencontrés par la recherche humaine.

Premièrement, le système rejette l'« uniformité » et interdit les méthodes rigides comme « assigner N agents à la stratégie X ».

Dès le premier tour, il faut explorer des voies radicalement différentes – perspectives algébriques, induction structurelle, formulation par flots, méthodes d'embedding, jusqu'aux méthodes de paramètres extrêmes.

Deuxièmement, le système interdit absolument d'indiquer à la plupart des IA quel schéma est actuellement le plus prometteur.

C'est très dangereux dans la recherche humaine – dès qu'un expert propose une direction qui semble belle, tout le monde s'y précipite.

Le point le plus admirable est le mécanisme de « patrouille de vérification ».

Parmi les 64 agents, certains jouent spécifiquement le rôle de « critiques ». Chaque preuve candidate proposée est soumise à une attaque frénétique.

« L'arête est-elle vraiment couverte seulement deux fois ? Avez-vous fait une erreur de calcul ? » « Ne confondez-vous pas une impasse répétée avec un cycle ? » « Votre induction introduit-elle subrepticement un pont ? »

Seules les preuves qui survivent à une vérification stricte ont le droit de passer au tour suivant.

De plus, il faut absolument empêcher l'IA de faire des promesses vagues.

Le système avertit sévèrement l'IA : refusez les réponses évasives du type « cette étape est évidemment vraie ». Il faut fournir des lemmes, des constructions, des équations ou des contre-exemples concrets.

En cas d'impasse, marquez-la immédiatement comme « bloquée ». Sauf si un nouveau mécanisme est proposé, ne gaspillez plus de puissance de calcul.

À la fin du Prompt, l'IA reçoit l'ordre suivant : « Passez au moins 8 heures là-dessus avant d'envisager d'abandonner ou de retourner un résultat. Ne me donnez pas seulement un résultat partiel. Arrêtez-vous seulement lorsque vous aurez trouvé une preuve complètement affirmative et qu'elle aura passé l'examen. »

Pourtant, de manière choquante, cette équipe spéciale d'IA est revenue victorieuse en moins d'une heure, avec un article mathématique parfait et sans faille.

Le miracle d'une heure – Comment l'IA a démêlé l'écheveau

Quelle tempête cérébrale ces 64 agents ont-ils traversée en une heure ?

En ouvrant le deuxième PDF – « Preuve de la conjecture de la double couverture par cycles » –, nous pouvons clairement voir le chemin de raisonnement époustouflant de l'IA.

Le texte intégral a été généré par GPT-5.6 Sol Ultra, et finalement mis en page avec l'aide de Codex.

La stratégie de preuve de l'IA peut être qualifiée de « chirurgie de réduction de dimension » magistrale.

Première étape : simplifier, cibler les graphes cubiques

L'équipe spéciale d'IA a d'abord confirmé la conclusion de Jaeger : prouver que c'est vrai pour les « graphes cubiques sans boucles » équivaut à prouver que c'est vrai pour tous les graphes.

Car tous les graphes peuvent être réduits par transformation topologique au domaine des graphes cubiques.

Deuxième étape : introduire l'incroyable théorème du « 8-flot »

C'est la touche la plus éblouissante de tout l'article.

L'IA a ressorti le « théorème des flots de groupe » (Group-flow theorem) du maître de la théorie des graphes Tutte.

Utilisant le fait, prouvé précédemment, qu'un graphe sans pont possède un « 8-flot non nul partout », l'IA a assigné à chaque arête du graphe une étiquette correspondant à un élément non nul du corps fini

(un espace vectoriel tridimensionnel à 8 éléments).

La particularité magique de cette étiquette est la suivante : à n'importe quelle intersection (sommet) du graphe, la somme des vecteurs entrants et sortants est nécessairement nulle.

Troisième étape : construire la méthode d'étiquetage par « paires d'éléments » (Lemme 2.1)

C'est carrément de la « magie » inventée par l'IA.

L'IA propose un lemme : si l'on peut assigner à chaque arête un ensemble contenant deux éléments

, et satisfaisant la condition que pour chaque sommet, tout élément apparaît soit 0 fois, soit 2 fois – alors, le graphe possède nécessairement une « double couverture par cycles ».

C'est comme attribuer deux plaques d'immatriculation spéciales à chaque route, en s'assurant qu'à chaque carrefour, les plaques de même couleur entrent et sortent toujours par paires. Une fois cela fait, la preuve est complète.

Quatrième étape : le coup de grâce – la réduction dimensionnelle par l'algèbre linéaire (Lemme 2.2)

Comment prouver qu'on peut toujours trouver de telles « deux plaques » ? L'IA a montré son côté le plus puissant en tant que machine – transformer radicalement un problème de topologie et théorie des graphes en un immense système d'équations algébriques linéaires.

Il a posé un système d'équations :

En construisant un espace vectoriel dual et utilisant la relation entre l'image et le noyau d'une application linéaire, l'IA a effectué une dérivation algébrique irréfutable (voir les formules 5 à 9 dans le PDF).

Finalement, elle a prouvé que ce système d'équations a toujours une solution !

Lorsque les formules (8) et (9) ont été conclues, aboutissant finalement à l'égalité avec 0 (dans le corps

), la preuve était terminée.

Ainsi, grâce à la logique pure, à la théorie des groupes, aux flots et à l'algèbre linéaire, la clé que l'humanité a cherchée pendant 50 ans a été forgée de force par 64 agents IA dans une exploration exhaustive et une vérification croisée à grande vitesse !

Le secret de la résolution : le « calcul au moment du test »

Cette nouvelle a ébranlé tout le milieu de l'IA et des mathématiques.

Le chercheur scientifique en raisonnement d'OpenAI, Noam Brown, n'a pas pu cacher son excitation, publiant plusieurs tweets révélant la logique sous-jacente de cette percée – le calcul parallèle au moment du test (TTC).

Noam Brown a souligné : « Augmenter le TTC d'un modèle (le laisser réfléchir plus longtemps) permet d'atteindre une intelligence plus élevée. Mais si nous étirons le temps de réflexion de quelques secondes à quelques semaines, la latence devient un goulot d'étranglement énorme. La puissance de GPT-5.6 Sol Ultra réside dans son expansion du TTC parallèle. Résoudre un problème vieux de 50 ans, qui aurait pu nécessiter une journée entière, a été compressé en à peine une heure. »

Ethan Knight a également annoncé : « Nous ouvrons officiellement et pleinement GPT-5.6 Sol Ultra aujourd'hui. Nous sommes incroyablement excités de voir qu'il a prouvé la conjecture CDC vieille de 50 ans en moins d'une heure avec 64 sous-agents ! »

Dans les commentaires, les internautes exprimaient leur excitation et leur incrédulité.

Les internautes se sont exclamés : « Le raisonnement parallèle redéfinira les frontières du possible en calcul ! »

L'internaute @Mikhail Rogov a astucieusement fait remarquer : « Réduire le temps d'une journée à une heure, c'est une forme de produit complètement différente. Le TTC parallèle rend le raisonnement à long terme réellement utilisable. »

D'autres ont trouvé cela effrayant à y penser : « Le TTC parallèle combiné à l'explosion de la puissance de calcul, ça ressemble à une amélioration d'un ordre de grandeur. Ajoutez les progrès algorithmiques, des modèles plus grands et plus de puissance de calcul, et les choses commencent à devenir un peu effrayantes... »

Bien sûr, des voix sceptiques et lucides se sont aussi fait entendre.

Un internaute a soulevé une question profonde : « Le TTC parallèle a certes joué un rôle, mais la question non dite est : la qualité de la recherche par 64 agents indépendants est-elle équivalente à une longue chaîne logique de raisonnement profonde et continue ? L'étendue et la profondeur ne sont pas toujours interchangeables. »

Certains ont même interpellé Noam Brown, suggérant qu'OpenAI recrute le plus grand physicien contemporain Edward Witten et le génie des mathématiques Terence Tao : « Engagez-les, je suis sûr qu'ils peuvent avoir des idées folles qui nous mèneront directement vers l'ASI ! »

Que GPT-5.6 ait résolu ce problème mathématique n'atteint peut-être pas encore le niveau d'une ASI complète.

Mais le fait de pouvoir accomplir de manière autonome en moins d'une heure le processus complet – décomposition du problème, construction de modèles, déduction logique jusqu'à la production d'un article académique rigoureux – montre que l'IA a dépassé l'humain dans le domaine du raisonnement logique abstrait de haute difficulté.

Aujourd'hui, 64 agents peuvent résoudre en une heure une conjecture de théorie des graphes vieille de 50 ans.

Demain, si l'on investit 640 000 agents pendant un mois, on pourra peut-être percer les secrets de la supraconductivité à température ambiante, de la fusion nucléaire contrôlée, ou vaincre le cancer.

Nous nous rapprochons de l'ASI.

Références :

https://x.com/eknight/status/2075643450196971805

https://x.com/SebastienBubeck/status/2075596982622835006?s=20

Cet article provient du compte WeChat officiel « Nouvelle Intelligence Artificielle », auteur : Révélation ASI

Preguntas relacionadas

QQuelle conjecture mathématique de 50 ans a été résolue par GPT-5.6 Sol Ultra, et en combien de temps ?

AGPT-5.6 Sol Ultra a résolu la conjecture du double couvercle cyclique (Cycle Double Cover Conjecture), un problème ouvert en théorie des graphes pendant 50 ans. Il a produit une preuve complète en moins d'une heure.

QQuelle stratégie OpenAI a-t-elle utilisée pour faire résoudre ce problème par l'IA ? Décrivez brièvement le système.

AOpenAI a utilisé un système de 64 agents d'IA intelligents fonctionnant en parallèle. Ces agents ont exploré différentes approches (algébrique, inductive, etc.), certains jouant le rôle de « vérificateurs » pour critiquer les preuves, et d'autres étant tenus à l'écart des idées prometteuses pour garantir une diversité de recherche. Des règles strictes interdisaient les arguments vagues et forçaient à abandonner les impasses.

QQuelle a été l'idée clé ou le 'tour de magie' dans la preuve générée par l'IA, selon l'article ?

AL'idée clé a été de transformer le problème topologique de théorie des graphes en un problème d'algèbre linéaire. L'IA a utilisé le théorème des 8-flots de Tutte pour attribuer des labels aux arêtes, puis a construit un système d'équations linéaires dans un corps fini (F₂), prouvant qu'une solution existe toujours, ce qui implique l'existence d'un double couvercle cyclique.

QQuel est le concept technique que Noam Brown d'OpenAI met en avant comme étant fondamental pour cette réussite ?

ANoam Brown met en avant le concept de « Test-Time Computation » (TTC) parallèle. Au lieu d'avoir un seul agent réfléchissant longtemps de manière séquentielle, le système utilise de nombreux agents réfléchissant en parallèle, ce qui permet de réaliser une quantité énorme de raisonnement en un temps très court (une heure au lieu d'une journée potentielle).

QSelon la conclusion de l'article, que permet d'imaginer cette avancée pour l'avenir de la recherche ?

AL'article suggère que si 64 agents peuvent résoudre un problème de 50 ans en une heure, alors déployer des centaines de milliers d'agents sur des durées plus longues pourrait permettre de s'attaquer à des défis scientifiques majeurs comme la supraconductivité à température ambiante, la fusion nucléaire contrôlée ou la guérison du cancer, rapprochant ainsi l'humanité d'une Intelligence Artificielle Générale (AGI/ASI).

Lecturas Relacionadas

Fallo del caso de divorcio de Chey Tae-won: Revelando las líneas ocultas de sucesión detrás del imperio trillonario de SK Hynix

El caso de divorcio de Choi Tae-won, presidente de SK Group, concluyó con una sentencia histórica de división patrimonial. Este hecho pone bajo el foco la sucesión en el imperio de SK Hynix, cuyo valor se disparó un 700% alcanzando los 1.000 billones de wones. A diferencia del guion tradicional de los *chaebol* coreanos, centrado en el primogénito varón, los tres hijos de Choi Tae-won siguen trayectorias atípicas. La hija mayor, Choi Yoon-jung (1989), es considerada la candidata más visible. Con formación en biología y un doctorado, ocupa un puesto directivo en SK Bioscience y supervisa la estrategia de crecimiento del grupo. Se casó con el cofundador de una *startup* de IA. La segunda hija, Choi Min-jung (1991), forjó un camino único: sirvió como oficial en la Marina de Corea, trabajó en políticas globales para SK Hynix en Washington y ahora es fundadora de una empresa de salud con IA. Se casó con un ex oficial del Cuerpo de Marines de EE.UU. El hijo menor, Choi In-geun (1995), a pesar de ser el primogénito varón y seguir el patrón formativo típico (consultoría en McKinsey), permanece en un discreto silencio público sin un rol definido dentro del grupo. El divorcio de sus padres, Choi Tae-won y Roh Soh-yeong, hija del expresidente Roh Tae-woo, culminó en una batalla legal multimillonaria que involucró a los tres hijos, quienes presentaron peticiones judiciales no divulgadas. Mientras SK Hynix se convierte en un activo geopolítico global, la sucesión ya no es un asunto meramente familiar. Los herederos de la tercera generación no heredan simplemente una empresa, sino el complejo desafío de navegar la era de la IA, las políticas globales y encontrar nuevas fuentes de crecimiento, redefiniendo así el legado del *chaebol*.

marsbitHace 2 días 09:13

Fallo del caso de divorcio de Chey Tae-won: Revelando las líneas ocultas de sucesión detrás del imperio trillonario de SK Hynix

marsbitHace 2 días 09:13

¡En solo 2 meses su valoración ha pasado de 8.800 millones a 68.000 millones de euros! OpenRouter, la mayor centralita de la IA, podría ser adquirida

Stripe está en conversaciones para adquirir la startup de inteligencia artificial OpenRouter, el mayor mercado de modelos de IA que actúa como intermediario, por un monto cercano a los 100.000 millones de dólares. Esta valoración representa un aumento de casi siete veces respecto a los 13.000 millones de dólares de hace dos meses. La plataforma de OpenRouter permite a los desarrolladores acceder a más de 400 grandes modelos de lenguaje a través de una única API, optimizando automáticamente la selección del modelo según la complejidad de la tarea, el coste y la velocidad, similar a un comparador de precios. Fundada en 2023 por Alex Atallah (cofundador de OpenSea) y Louis Vichy, la empresa tiene un ingreso anualizado de 50 millones de dólares y más de un millón de desarrolladores usuarios. Para Stripe, líder mundial en pagos en línea, esta adquisición es un paso estratégico hacia la consolidación de su infraestructura para la economía de la IA, tras la compra reciente de Metronome, una plataforma de facturación por uso. El objetivo es ofrecer un paquete integral que gestione desde la selección de modelos y la facturación por tokens hasta los pagos, convirtiéndose en el centro de control para las aplicaciones de IA. Aunque la transacción aún podría fracasar, refleja la apuesta por el crecimiento explosivo del sector y el valor de controlar la capa de intermediación que decide cómo se distribuyen las consultas y los costes entre los distintos proveedores de modelos.

链捕手Hace 2 días 09:04

¡En solo 2 meses su valoración ha pasado de 8.800 millones a 68.000 millones de euros! OpenRouter, la mayor centralita de la IA, podría ser adquirida

链捕手Hace 2 días 09:04

Trading

Spot
活动图片