Anthropic dévoile de nouveaux modèles « gourmands », la puissance de Fable 5 déçoit

marsbitPublié le 2026-08-24Dernière mise à jour le 2026-08-24

Résumé

Anthropic, la société derrière l'IA Claude, voit deux nouveaux modèles, "Marshmallow" (guimauve) et "Melon", fuiter prématurément via des applications tierces. Des tests précoces suggèrent que Marshmallow, probablement une itération de niveau Opus, surpasse Opus 5 en fluidité conversationnelle, tandis que Melon est moins performant. Leur lancement officiel est attendu la semaine prochaine. Cette fuite intervient alors que le modèle phare d'Anthropic, Fable 5 (le plus puissant et le plus cher), connaît un accueil commercial frais depuis son lancement il y a deux mois. Selon des données de la plateforme Ramp, il ne représente qu'environ 11% des dépenses en tokens des entreprises américaines sur Anthropic, loin derrière les 25% du concurrent GPT-5.6 Sol d'OpenAI. Le problème principal est son prix prohibitif (le double d'Opus 4.8) pour un gain de performance perçu comme marginal dans de nombreux cas d'usage. Pire, le modèle Opus 5, sorti fin juillet à moitié prix de Fable 5, obtient des résultats comparables voire supérieurs dans certains benchmarks comme CursorBench, conduisant les entreprises à le privilégier. Parallèlement, les modèles open source gagnent massivement en popularité, représentant désormais 62% du volume de tokens utilisés tout en ne coûtant qu'une fraction des modèles propriétaires. Dans ce contexte, les nouveaux modèles "Marshmallow" et "Melon" semblent être une réponse d'Anthropic pour combler un vide crucial dans son offre : fournir des modèles à la fois ...

Anthropic a révélé par anticipation deux nouvelles cartes maîtresses !

Aujourd'hui, deux identifiants de modèles inconnus sont apparus successivement dans des applications tierces et la communauté Discord —

  • claude-mashmallow-eap (Guimauve)
  • claude-melon-eap (Melon)

Des tests précoces révèlent que Marshmallow est plus performant, avec un naturel de conversation dépassant Opus 5, tandis que Melon est légèrement inférieur.

Cependant, leurs capacités globales ne sont pas du « niveau Fable ». Ils seront déployés au plus tôt la semaine prochaine.

Alors que l'ensemble d'Internet s'enthousiasme, Anthropic a été secoué en interne par une « bombe » —

Deux mois après son lancement, Fable 5 rencontre un rejet quasi collectif.

Anthropic complète en urgence son jeu

Exposition des nouveaux modèles Claude

Cette mise à jour semble plus précipitée que les précédentes.

Les experts de l'IA spéculent que Marshmallow correspond probablement à une évolution de niveau Opus, peut-être Opus 5.1.

Melon, quant à lui, se rapprocherait plus du niveau Sonnet.

Les résultats d'un test SVG partagé par un internaute accentuent également l'écart entre les deux modèles.

Anthropic n'a pas encore officiellement réagi, mais les indices commencent à s'accumuler.

Si c'était juste une mise à jour normale, cela ne serait pas étrange en soi.

Ce qui est vraiment subtil, c'est : pourquoi maintenant précisément ?

Après tout, il y a un peu plus de deux mois, Anthropic venait juste de placer sur la table sa carte la plus puissante et la plus chère.

Il s'agit de Fable 5, au sommet de la pyramide Claude.

La puissance de Fable 5 déçoit

Il y a deux mois, Fable 5 faisait son entrée avec l'aura de « modèle phare ultime » d'Anthropic.

Le plus puissant, le plus cher, et aussi l'IA la plus sophistiquée de toute la gamme Claude.

Selon l'usage du secteur, à la sortie d'un nouveau modèle phare, les grandes entreprises migrent rapidement, orientant leur budget vers le modèle le plus récent et le plus puissant.

Cette fois, la règle s'est brisée sur Fable 5 !

La plateforme de paiement Ramp a suivi les données de consommation de tokens de plus de 70 000 entreprises américaines, et a découvert :

Un mois après le lancement de Fable 5, celui-ci n'absorbait que 6% du volume d'appels de tokens sur Anthropic par les entreprises, représentant 11,4% des dépenses.

Aujourd'hui, plus de deux mois plus tard, les dernières données obtenues par le FT montrent que cette part de dépenses stagne toujours autour de 11%.

Cela signifie que les développeurs et les grandes entreprises prêts à basculer vers Fable 5 sont rares.

En face, le modèle phare d'OpenAI, GPT-5.6 Sol, a capté 25% des tokens et 23% des dépenses sur la même période.

Sur le même terrain, la part du modèle haut de gamme d'Anthropic n'est que le quart de celle de son concurrent.

Plus gênant encore, la contribution totale au chiffre d'affaires de Fable 5 n'est qu'environ 75% de celle de GPT-5.6 Sol, bien que son coût par token soit deux fois plus élevé.

À quel point est-il cher ?

Le prix unitaire de Fable 5 est le double de celui d'Opus 4.8 d'Anthropic, et 10 fois celui de Haiku 4.5.

Bien que puissant, la plupart des scénarios quotidiens des entreprises n'ont pas besoin de ce niveau.

Opus 5 en interne, riposte au grand frère

Un autre modèle d'Anthropic a été le « coup direct » porté à Fable 5.

Fin juillet, Opus 5 est officiellement apparu, avec un prix seulement moitié de celui de Fable 5, mais dans les évaluations de programmation et de travail intellectuel, il a obtenu de meilleurs résultats.

Les résultats du test CursorBench 3.2 sont encore plus directs —

Opus 5 obtient un score de 70% avec la puissance de calcul maximale, à un coût de 8,23 $ par tâche. Fable 5 obtient 70,5%, soit 0,5 point de pourcentage de plus, mais à 17,32 $.

Cela équivaut à dépenser deux fois plus d'argent pour seulement 0,5% de performance supplémentaire.

Le vote des entreprises avec leurs pieds n'est pas surprenant : les données de Ramp montrent qu'après le lancement d'Opus 5, ses dépenses ont rapidement dépassé celles de Fable 5.

Mais le problème est : si un modèle phare n'est qu'une « vitrine », sur quel marché peut-on justifier une valorisation de 2 000 milliards de dollars ?

L'open source passe de 11% à 62% en seulement quatre mois

De plus, l'expansion frénétique de l'IA open source met également Anthropic sous pression.

Les statistiques de Vercel AI Gateway indiquent —

En avril, la part de tokens des modèles open source n'était que de 11%. En juin, ce chiffre a bondi à 29%. Les dernières données d'août montrent une poussée directe à 62%.

En l'espace de deux mois, de moins de 30% à plus de 60%. Et l'argent qu'ils coûtent représente moins de 4% des dépenses totales des entreprises.

En d'autres termes, les modèles qui font la plus grande partie du travail coûtent presque rien.

Cela rend la position de Fable 5 de plus en plus inconfortable.

En interne, Opus 5, pour moitié prix, est déjà sur ses talons ; à l'extérieur, les modèles open source continuent de faire baisser les prix tour après tour.

Fable 5 peut bien sûr continuer à repousser les limites des capacités.

Mais ce dont Anthropic a besoin de manière plus urgente, c'est un modèle que les entreprises sont réellement prêtes à utiliser à long terme et à grande échelle.

Vus sous cet angle, l'apparition soudaine de Marshmallow (Guimauve) et Melon (Melon) est moins surprenante.

Ce qu'ils doivent combler, c'est peut-être précisément la pièce la plus cruciale du « pack famille » Claude —

Assez puissant, mais aussi assez abordable ; capable de faire étalage de muscles, mais surtout d'être acheté.

Références :

https://x.com/kimmonismus/status/2091599817084412221?s=20

https://www.ft.com/content/5ee49718-c258-4f01-aa32-7e5b76ae5245?syn-25a6b1a6=1

Cet article provient du compte public WeChat « New Zhiyuan », auteur : ASI Apocalypse, éditeur : Taozi

Questions liées

QQuels sont les noms de code des deux nouveaux modèles Claude récemment révélés ?

ALes deux nouveaux modèles révélés sont 'claude-mashmallow-eap' (marshmallow/guimauve) et 'claude-melon-eap' (melon).

QPourquoi le modèle Fable 5 d'Anthropic est-il considéré comme un échec commercial relatif ?

ALe modèle Fable 5 est considéré comme un échec commercial relatif car, malgré sa puissance, son coût par token est extrêmement élevé (le double de l'Opus 4.8). Les données montrent qu'il n'a capté qu'environ 11% des dépenses en tokens des entreprises sur Anthropic, soit bien moins que son concurrent direct chez OpenAI, et a été rapidement dépassé en part de dépenses par l'Opus 5, plus rentable.

QQuelle est la principale raison pour laquelle l'Opus 5 est devenu plus attractif que le Fable 5 pour les entreprises ?

ALa principale raison est le rapport performance/prix. L'Opus 5, lancé fin juillet, coûte environ moitié moins cher que le Fable 5. Dans des tests comme le CursorBench 3.2, il a obtenu un score de 70% contre 70,5% pour le Fable 5, mais à un coût par tâche bien inférieur (8,23$ contre 17,32$), offrant une bien meilleure valeur.

QQuelle tendance des modèles open source inquiète probablement Anthropic, selon l'article ?

AL'article souligne l'expansion rapide et agressive des modèles open source. Selon les données de Vercel AI Gateway, leur part des tokens utilisés est passée de 11% en avril à 62% en août, tout en ne représentant que moins de 4% des dépenses totales des entreprises, exerçant une forte pression à la baisse sur les prix du marché.

QQuel est le rôle probable des nouveaux modèles 'Marshmallow' et 'Melon', selon la conclusion de l'article ?

ASelon la conclusion, les nouveaux modèles 'Marshmallow' (probablement un successeur de l'Opus) et 'Melon' (probablement de niveau Sonnet) sont probablement conçus pour combler une lacune cruciale dans la gamme Claude : offrir des modèles suffisamment performants mais aussi suffisamment abordables pour être adoptés massivement et durablement par les entreprises, au-delà des simples démonstrations de force technologique.

Lectures associées

La plus grande problématique de l'économie politique à l'ère de l'IA : Les robots deviennent de plus en plus compétents, comment l'humanité peut-elle partager la valeur ?

Dans un contexte où l'IA et la robotique progressent rapidement, un article de *The Economist* relance le débat sur un problème fondamental de l'ère numérique : comment les humains peuvent-ils partager la valeur créée par des machines de plus en plus compétentes ? Historiquement, les gains de productivité se traduisaient par une augmentation des salaires et de la consommation. Cependant, l'IA, en remplaçant non seulement le travail manuel mais aussi le travail cognitif, risque de rompre ce cycle. La croissance économique et les profits pourraient continuer tandis que le nombre d'humains participant directement à la création de valeur diminuerait, posant un défi crucial de répartition des richesses. La situation en Chine illustre cette tension : malgré des avancées significatives dans les nouvelles technologies, la consommation reste faible, révélant une difficulté à faire circuler les bénéfices de l'innovation vers les revenus des ménages. Ce phénomène est global : la valeur se concentre chez les géants technologiques, tandis que la part du travail dans le PIB recule. Face à ce défi, plusieurs voies sont envisagées : le modèle capitaliste traditionnel, une voie d'État-capitalisme, ou des mécanismes innovants comme des fonds souverains numériques, une actionnariat populaire ou un revenu de base. La capacité à construire un système de distribution équitable, permettant à tous de bénéficier des gains de productivité de l'IA, deviendra un facteur clé de compétitivité et de stabilité sociale au XXIe siècle. Pour la Chine, comme pour toutes les nations, résoudre cette équation sera essentiel pour façonner l'avenir.

marsbitIl y a 2 mins

La plus grande problématique de l'économie politique à l'ère de l'IA : Les robots deviennent de plus en plus compétents, comment l'humanité peut-elle partager la valeur ?

marsbitIl y a 2 mins

Sept trimestres consécutifs de gains : l'arbitrage sur les marchés émergents surpasse tout

Le carry trade sur les marchés émergents financé en dollars a généré des rendements positifs pendant sept trimestres consécutifs, soit la plus longue série depuis 2008, avec un gain cumulé d’environ 22 % depuis fin 2024. Cette stratégie, qui consiste à emprunter dans des devises à bas taux comme le dollar ou l’euro pour investir dans des actifs à haut rendement en monnaies émergentes (telles que la livre turque ou le peso colombien), a surperformé les obligations d’État américaines, les obligations souveraines et d’entreprise des marchés émergents. Les rendements ont été amplifiés par l’appréciation des devises émergentes face au dollar, notamment en Colombie où la combinaison du rendement obligataire et de la hausse du taux de change a rapporté 48 % sur un an. Malgré l’intervention historique conjointe des États-Unis et du Japon sur le marché des changes en août, qui a brièvement fait chuter le yen, le risque de liquidations désordonnées est jugé limité, les investisseurs ayant substitué l’euro et le franc suisse au yen comme monnaies de financement. Les risques principaux identifiés sont le calendrier de la politique monétaire de la Fed et la concentration excessive des capitaux sur cette stratégie, ce qui pourrait la rendre vulnérable à un retournement soudain. Les gestionnaires restent néanmoins confiants, citant les taux d’intérêt élevés dans des régions comme l’Amérique latine et l’Europe de l’Est, soutenus par des pressions inflationnistes persistantes et la géopolitique énergétique.

marsbitIl y a 19 mins

Sept trimestres consécutifs de gains : l'arbitrage sur les marchés émergents surpasse tout

marsbitIl y a 19 mins

Des mentors et disciples de Tsinghua et Wharton résolvent un cas non résolu depuis 40 ans, les mathématiques centrales sont entièrement rédigées par GPT, vous le pourriez aussi

L'algorithme d'apprentissage automatique fondamental, la descente de gradient, a été « condamné » par l'IA elle-même ? Une récente étude conjointe de l'Université Tsinghua et de la Wharton School de l'Université de Pennsylvanie apporte une conclusion attendue depuis 40 ans : pour atteindre une vitesse optimale, ajuster uniquement la taille des pas (le taux d'apprentissage) ne suffit pas. Historiquement, la descente de gradient standard a une vitesse de convergence en O(1/T). En 1983, Nesterov a introduit l'élan (momentum), atteignant O(1/T²). Une question persistante était de savoir si, sans modifier la structure de l'algorithme, un simple réglage minutieux de la séquence des pas pouvait égaler cette performance. En 2023, des chercheurs du MIT ont conçu la « silver stepsize », une séquence de pas fractale atteignant O(T^{-1.2716}). Les chercheurs Jianhao Ma (Tsinghua) et Yuxin Chen (Wharton) ont inversé la problématique : au lieu de chercher une meilleure séquence, ils ont prouvé qu'il existe une limite infranchissable. Le cœur de la preuve a été généré par GPT-5.6 Sol Pro. Guidés par le concept d'« oracle résistant », les chercheurs ont demandé à l'IA de construire une fonction convexe spécifique qui force la descente de gradient à suivre un chemin lent, quelle que soit la séquence de pas choisie. L'IA a proposé une construction géométrique dans un espace de haute dimension utilisant l'enveloppe de Moreau. Après plusieurs itérations de corrections, GPT-5.6 a établi une borne inférieure de convergence en Ω(T^{-1.9319}) pour toute séquence de pas prédéterminée. Cela signifie qu'il est mathématiquement impossible pour la descente de gradient pure (sans momentum) de dépasser cette vitesse, confirmant la nécessité de modifier la structure de l'algorithme pour une convergence optimale. La preuve a été formellement vérifiée sans aucune erreur par l'assistant de preuve Lean 4, garantissant sa solidité logique. Ce travail démontre le potentiel de l'IA en tant qu'assistant de recherche capable de résoudre des problèmes théoriques profonds, ouvrant la voie à de nouvelles collaborations homme-machine en science fondamentale.

marsbitIl y a 27 mins

Des mentors et disciples de Tsinghua et Wharton résolvent un cas non résolu depuis 40 ans, les mathématiques centrales sont entièrement rédigées par GPT, vous le pourriez aussi

marsbitIl y a 27 mins

Décrypter les vérités sur l'effet de levier, la liquidité et les risques liés au jetonnage d'actifs

La tokenisation des actifs du monde réel (RWA) ne se limite pas à créer un jeton représentant un actif. C’est un simple code-barres, non une chaîne d’approvisionnement financière complète. La vraie transformation vient de l’intégration à la DeFi, qui permet l’évaluation, le financement, la couverture et la liquidité. Les RWA fonctionnent sur plusieurs horloges temporelles : blockchain en temps réel, marchés traditionnels fermés la nuit/week-end, et processus de rachat lents. Ce décalage crée un risque de liquidation où la DeFi exige un règlement immédiat, mais le monde réel impose des délais. Ainsi, un jeton d’obligation d’État stable peut être plus risqué qu’un actif crypto volatil mais liquide 24h/24. La liquidité réelle ne se mesure pas par la TVL, mais par la capacité à sortir d’une position sous pression, dans un délai donné et sans décote excessive. Trois voies de sortie existent : vente sur le marché, rachat par l’émetteur, ou prêt garanti. Le levier est ce qui crée l’utilité économique, mais il accroît aussi la fragilité. Les paramètres de garantie (haircuts) doivent intégrer non seulement la volatilité, mais aussi l’exécutabilité légale, la fraîcheur des données, les délais de rachat et la concentration des holdings. Les risques des RWA forment un graphe de dépendances interconnectées (émetteur, gardien, oracle, marchés secondaires, protocoles de prêt). Une défaillance localisée peut se propager. Une surveillance proactive des files de rachat, de la profondeur du marché et du comportement des market makers est cruciale. Au-delà des obligations d’État, les actifs prometteurs sont la puissance de calcul (GPU) et l’énergie, avec leurs propres modèles de risque. Les actions tokenisées et les contrats perpétuels sur actions constituent un test majeur, combinant propriété et levier, mais nécessitent des garde-fous architecturaux pour éviter des spirales de liquidation. En somme, l’étape suivante n’est pas de tokeniser plus d’actifs, mais de construire la couche de marché qui transforme les jetons en infrastructures financières résilientes, capables de résister à un week-end de crise. Le jeton n’est que le code-barres ; le marché est la machine.

marsbitIl y a 42 mins

Décrypter les vérités sur l'effet de levier, la liquidité et les risques liés au jetonnage d'actifs

marsbitIl y a 42 mins

Trading

Spot
活动图片