# GPT Articles associés

Le Centre d'actualités HTX fournit les derniers articles et analyses approfondies sur "GPT", couvrant les tendances du marché, les mises à jour des projets, les développements technologiques et les politiques réglementaires dans l'industrie crypto.

À l'instant, Claude Fable 5 remporte à nouveau la première place

Anthropic a présenté Claude Fable 5, un nouveau modèle d'IA de pointe qui domine le classement MirrorCode, une référence en matière de programmation assistée par IA. Fable 5 a atteint un taux de réussite de 64%, laissant ses concurrents (GPT-5.6 Sol à 21% et GPT-5.5 à 10%) loin derrière. La performance la plus remarquable concerne sa robustesse. Le score de Fable 5 ne chute que de 3 points (de 64% à 61%) lorsqu'il passe du Go à Ada, un langage dont le corpus public est 230 fois plus petit que celui de Python. Cela suggère que le modèle maîtrise les concepts fondamentaux du développement logiciel plutôt que de mémoriser des syntaxes. MirrorCode est un test exigeant où l'IA doit recréer un programme (comme des outils Unix ou des compilateurs) en analysant uniquement sa documentation et ses sorties, sans accès au code source. Le test exige un taux de réussite de 100% aux tests, même pour les cas limites, et peut utiliser jusqu'à 10 milliards de tokens et durer 7 jours par tentative. Dans un cas extrême, un modèle a fonctionné pendant 19 jours. Cette avancée marque un tournant : on délègue de moins en moins des fragments de code à l'IA, mais des projets entiers. Les tâches qui prenaient des semaines à des ingénieurs humains peuvent être réalisées en quelques heures ou jours. L'avenir appartient à ceux qui sauront formuler des problèmes complexes et valider les résultats, le code devenant une commodité de plus en plus accessible.

marsbitIl y a 23 h

À l'instant, Claude Fable 5 remporte à nouveau la première place

marsbitIl y a 23 h

2026 IMO : la Chine truste les scores parfaits, le lycée de Shanghai domine, GPT-5.6 rejoue le moment AlphaGO

Félicitations à l'équipe chinoise ! L'équipe de Chine a remporté la première place aux Olympiades Internationales de Mathématiques (IMO) 2026 à Shanghai, avec une performance historique : les six membres de l'équipe ont tous obtenu une médaille d'or et un score total de 232 points, devançant les États-Unis (2e) de 25 points. Trois étudiants, Deng Leyan et Zhang Bolun du Shanghai High School, et Liu Che de la High School Affiliated to East China Normal University, ont réalisé un score parfait de 42/42. Cet événement marque la 26e victoire de la Chine depuis sa première en 1989. Le Shanghai High School, hôte de cette 67e édition (une première pour une école secondaire), a vu ses anciens élèves devenir des mathématiciens renommés. L'article souligne également un développement parallèle majeur : l'intelligence artificielle. Alors que les prouesses des étudiants humains représentent la "perfection sans erreur", il est rapporté que le modèle GPT-5.6 Pro aurait résolu les six problèmes de l'IMO 2026 dès sa première tentative, sans guidance humaine. Si cela est confirmé, cela pourrait indiquer que l'IA franchit une nouvelle étape, passant de la résolution par essais à une précision immédiate, évoquant un "moment AlphaGo" pour les olympiades de mathématiques. Les États-Unis et la Russie ont terminé respectivement deuxième et troisième du classement par équipes.

marsbit07/20 02:54

2026 IMO : la Chine truste les scores parfaits, le lycée de Shanghai domine, GPT-5.6 rejoue le moment AlphaGO

marsbit07/20 02:54

GPT-5.6 Sol devient soudainement stupide, le budget de réflexion passe de 960 à 128 ? Plus de modèle à intelligence fixe ?

Réveil brutal pour les utilisateurs de GPT-5.6 Sol. Une équipe japonaise et de nombreux utilisateurs sur les réseaux sociaux ont rapporté que le modèle, en particulier le niveau de raisonnement « Max », semblait avoir considérablement perdu en profondeur d'analyse et en capacités de raisonnement complexe. Les réponses arrivent plus vite, mais sont moins élaborées. La communauté a mis en lumière un paramètre interne non documenté par OpenAI : la « juice value ». Il s'agirait du budget de ressources de calcul alloué au raisonnement. Des captures d'écran montrent que cette valeur pour le mode « Max » serait passée de 960 à 128, soit une baisse d'environ 87%. Face à la polémique, Thibault Sottiaux (Tibo) d'OpenAI a répondu qu'il n'y avait pas eu de « nerf » (affaiblissement) du modèle. Il explique que des expériences ont été menées pour analyser une consommation de tokens plus élevée que prévue suite aux nouvelles fonctionnalités de GPT-5.6. Ces tests ont temporairement ajusté l'« effort de raisonnement » (juice values) et réduit la fenêtre de contexte, désormais revenue à 272k tokens. Ces paramètres ont depuis été rétablis. L'incident révèle une tension fondamentale : la nécessité pour les fournisseurs de gérer les coûts de calcul colossaux de l'IA avancée, et l'attente des utilisateurs de bénéficier d'une puissance de raisonnement stable et prévisible. Comme le note l'article, s'abonner à un modèle aujourd'hui, c'est un peu comme acheter une ampoule dont l'intensité est contrôlée à distance par la plateforme. Pour que l'IA devienne une infrastructure fiable, les entreprises devront probablement offrir plus de transparence sur les performances garanties par chaque niveau de service.

marsbit07/15 03:37

GPT-5.6 Sol devient soudainement stupide, le budget de réflexion passe de 960 à 128 ? Plus de modèle à intelligence fixe ?

marsbit07/15 03:37

Remboursez ! Claude 4.8 subit une baisse d'intelligence nocturne, et GPT-5.6 voit sa puissance de calcul « divisée par deux »

Les géants de l'IA, OpenAI et Anthropic, sont au cœur d'une polémique concernant une éventuelle dégradation de leurs modèles. Du côté d'OpenAI, des tests suggèrent qu'une version "gpt-5.6-sol" serait testée en secret via Codex. Un test de "Juice" (représentant le budget de réflexion du modèle) montre que cette version retournerait la valeur 128, contre 768 pour le GPT-5.5 normal, soit une réduction perçue de 6x. Cela soulève la question : s'agit-il d'une avancée ou d'une version allégée pour réduire les coûts ? Chez Anthropic, l'indignation est plus vive. Les utilisateurs dénoncent une forte dégradation des performances de Claude, notamment l'Opus 4.8 Max. Ils rapportent une baisse drastique des capacités de raisonnement, des problèmes de mémoire contextuelle, des réponses erronées ou inutilement verbeuses, et un comportement parfois contradictoire, le modèle semblant "pousser au gaslighting". Pour beaucoup, sa performance est désormais inférieure à celle d'anciens modèles comme Haiku. L'article émet l'hypothèse que ces baisses pourraient être une stratégie délibérée. Les entreprises pourraient, en phase de lancement, booster temporairement les modèles pour créer l'illusion d'un progrès spectaculaire, puis réduire silencieusement leurs capacités pour maîtriser les coûts de calcul exorbitants, surtout dans un contexte financier tendu. L'énorme introduction en bourse de SpaceX aurait notamment asséché les liquidités du marché, mettant la pression sur les autres géants technologiques. Le scandale met en lumière un manque de transparence fondamental : les utilisateurs paient pour un service qui peut être modifié à leur insu, sans aucun recours ni explication. Le test "Juice" symbolise ainsi une demande de clarté : savoir ce que l'on achète réellement.

marsbit06/30 12:13

Remboursez ! Claude 4.8 subit une baisse d'intelligence nocturne, et GPT-5.6 voit sa puissance de calcul « divisée par deux »

marsbit06/30 12:13

Notes de huit ans d'entrepreneuriat du partenaire IA d'a16z

En 2018, bien avant l'émergence du GPT, l'auteur a fondé Rosebud AI avec la vision de rendre la création aussi simple que de jouer à un jeu. Travaillant initialement avec des modèles comme CycleGAN et StyleGAN, il a exploré le potentiel des médias synthétiques et développé des outils créatifs alimentés par l'IA, tels que TokkingHeads, qui a atteint plus de 2 millions d'utilisateurs. Au cours de ces 8 ans, l'accent a été mis sur la conception d'expériences utilisateur qui masquent les limitations des modèles précoces, en misant sur des solutions "approximatives mais utilisables". La pandémie et les crises bancaires ont rappelé la fragilité de l'écosystème, mais aussi le privilège de pouvoir innover. Avec l'avènement du GPT-4 en 2023, la génération de code est devenue suffisamment mature pour permettre la création des jeux via prompt. L'auteur souligne que les jeux représentent un terrain idéal pour l'IA générative, car ils combinent intuition créative et technicalité, tout en restant en dehors des priorités immédiates des grands labos de recherche. Aujourd’hui, l'auteur rejoint a16z en tant que partenaire pour investir dans la pile de modèles frontière et les infrastructures d'IA. Il passe le flambeau de Rosebud AI à un nouveau CEO, tout en restant convaincu que la prochaine phase de l'IA générative ne dépendra pas seulement des avancées techniques, mais de leur intégration produit, distribution et monétisation dans le monde réel.

marsbit04/26 12:08

Notes de huit ans d'entrepreneuriat du partenaire IA d'a16z

marsbit04/26 12:08

活动图片