Un professeur de Stanford diffuse en direct l'entraînement d'un modèle de 535B paramètres : le « boîte noire » de l'entraînement des modèles est-elle en train de s'ouvrir ?

marsbitPublié le 2026-08-24Dernière mise à jour le 2026-08-24

Résumé

Le professeur Percy Liang de Stanford et son équipe ont lancé un entraînement public en direct du modèle Marin 535B-A23B, un modèle de langage massif avec 535 milliards de paramètres. L'ensemble du processus, d'une durée prévue de trois mois, est diffusé en temps réel via des plateformes comme Weights & Biases, permettant à quiconque d'observer la progression du modèle, les courbes de perte, les données d'entraînement et les défis techniques. Cette initiative vise à démystifier le "boîte noire" que constitue généralement l'entraînement des grands modèles comme GPT-4 ou Claude. En rendant transparents les détails des données, des hyperparamètres et des problèmes rencontrés, le projet Marin cherche à favoriser l'observation, la discussion et la collaboration ouverte au sein de la communauté. Avant ce "hero run", l'équipe a préalablement entraîné une série de modèles plus petits pour anticiper les problèmes et prédire le comportement du modèle principal. Les réactions en ligne saluent cette transparence, la qualifiant d'incarnation de l'esprit open source. Certains y voient même une opportunité d'apprentissage unique, permettant aux observateurs d'analyser et de comprendre les dynamiques spécifiques de l'entraînement, comme les variations des normes de paramètres. Percy Liang, qui enseigne également un cours sur la construction de modèles de langage depuis zéro, semble déterminé à partager les connaissances pratiques de ce domaine en pleine évolution.

Ces deux derniers jours, un post d'un internaute nommé Max For AI@MaxForAI sur X a suscité un vif débat : « C'est fou – vous pouvez maintenant assister en direct à la formation d'un énorme modèle de 535B paramètres. »

En réalité, Percy Liang@percyliang, professeur à Stanford et fondateur de Simile AI, a annoncé le démarrage de l'entraînement du modèle Marin 535B-A23B par le laboratoire ouvert Marin, et tout le processus d'entraînement sera entièrement public.

Marin dispose de 535 milliards de paramètres au total et de 23 milliards de paramètres activés. Pour cela, Percy Liang et son équipe ont préparé un total de 18,75 billions de tokens de données d'entraînement et déployé 11 systèmes GB200 NVL72, soit environ 792 GPU GB200.

Le modèle devrait être entraîné en continu pendant environ 3 mois, avec un total de calculs d'entraînement d'environ 2,7e24 FLOPs. Une fois l'entraînement terminé, l'équipe poursuivra également la phase de post-formation (post-training).

Autrement dit : Au cours des prochains mois, tout le monde pourra observer comment un modèle d'IA de pointe se développe à partir de zéro.

Il est également intéressant de noter que Percy Liang a indiqué qu'avant de lancer officiellement cette session d'entraînement, l'équipe avait déjà entraîné une série d'échelons de mise à l'échelle (Scaling Ladder) en 4 étapes, allant de 1,6B-A61M (48B tokens) jusqu'à 27,7B-A1,2B (926B tokens).

« Cela a deux objectifs, premièrement, utiliser ces expériences à petite échelle pour détecter et déboguer rapidement les problèmes potentiels ; deuxièmement, baser les prévisions pour notre « entraînement principal » (hero run) sur les performances des modèles à différentes échelles. »

Bien sûr, Percy Liang a également déclaré : « C'est l'entraînement le plus important que nous ayons jamais réalisé, donc nous nous attendons effectivement à rencontrer des imprévus pendant le processus. »

Actuellement, le modèle principal a officiellement commencé son exécution, et tout le monde peut consulter directement les courbes d'entraînement en temps réel. Par la suite, les données d'entraînement, les journaux d'expérimentation et les problèmes techniques continueront d'être rendus publics.

Par exemple, au niveau des données, cela inclut les proportions de mélange des données d'entraînement, les méthodes de traitement des données, et comment les données de différents domaines sont introduites dans le modèle ; au niveau technique, cela inclut la configuration de l'entraînement, le code et la conception des expériences ; le processus d'entraînement, y compris les changements de perte (loss) en temps réel, l'état du modèle et les résultats prédictifs à différentes étapes.

Simultanément, Percy Liang a également rendu publics les canaux spécifiques pour suivre l'entraînement.

Consultez la composition des données : https://storage.googleapis.com/marin-public/held/harrier-k40-cluster-overview/2026.08.18/index.html?revision=uniform-sampling

Suivez le processus d'entraînement en temps réel sur Weights & Biases (wandb) : https://wandb.ai/marin-community/marin_moe/reports/535B-A23B-18T-Token-Hero-Run-Scaling-Ladder--VmlldzoxNzc2MDM5Ng

Consultez tous les détails sur GitHub : https://github.com/marin-community/marin/issues/8435

Après une analyse plus approfondie, il est facile de comprendre pourquoi cette initiative de Percy Liang a suscité autant d'attention. Parce que par le passé, pour des modèles comme GPT-4, Claude, Gemini, etc., on ne savait absolument pas comment ils étaient entraînés en détail, c'était comme une « boîte noire ».

On ne pouvait voir que les capacités finales du modèle, les scores sur des benchmarks, quelques descriptions dans des articles scientifiques, etc. Quant aux proportions de données, les échecs d'entraînement, les hyperparamètres efficaces, l'évolution de la perte, la précision des lois d'échelle (Scaling law), tout cela était inconnu.

Marin cherche à changer cela. Peut-être que l'entraînement des modèles peut également devenir comme les articles scientifiques ou les logiciels open source : observable, discutable, collaboratif.

Depuis l'annonce de cette nouvelle, l'enthousiasme des internautes ne cesse de croître.

Certains internautes estiment que c'est là le véritable esprit open source, « même si des problèmes surviennent pendant l'entraînement ou que les résultats s'écartent des attentes, rien n'est caché. »

D'autres internautes soulignent que, même si le modèle d'entraînement lui-même est déjà énorme, ce qui est vraiment impressionnant, c'est que tout le monde peut maintenant suivre en temps réel sur la plateforme WandB le processus de croissance étape par étape d'un grand modèle d'entraînement dont la valeur équivaut à des milliards de dollars ?

« C'est comme si la pièce sombre et fermée à clé d'un laboratoire d'IA de premier plan s'ouvrait soudainement, permettant à tout le monde de voir ce qui s'y passe. »

Au cours des trois prochains mois, ce qui est peut-être le plus attendu n'est pas les capacités finales du modèle, mais plutôt d'observer combien de fois ce modèle va « exploser », s'effondrer ou rencontrer des situations inattendues pendant son entraînement...

De plus, certains internautes pensent que cette initiative ne fournit pas seulement une perspective pour observer l'intégralité du processus d'entraînement d'un modèle, mais offre même une plateforme d'apprentissage et d'échanges.

L'internaute James Thewlis@jdthewlis a suivi le processus d'entraînement en temps réel. Pendant ce suivi, il ne comprenait pas « pourquoi, aux alentours de l'étape 500, les normes (paramètres de norme) présentaient un pic ? »

Après avoir trouvé la réponse par lui-même, il s'est répondu dans les commentaires : « Ce pic est entièrement dû au biais de routeur (router_bias). Ce n'est pas un paramètre appris par le biais du gradient, mais fait partie du mécanisme d'équilibrage des tokens (token balancing heuristic) dans le modèle MoE (Mixture of Experts), donc il a une dynamique différente de celle des paramètres ordinaires du modèle. »

Il existe de nombreux cas similaires.

Par ailleurs, il est intéressant de mentionner qu'en plus de cette mise en pratique concrète, Percy Liang, en tant que professeur à Stanford, donne également un cours théorique : « CS336: Language Models From Scratch » (Modèles de langage à partir de zéro), dont l'objectif est que les étudiants comprennent pleinement comment un grand modèle de langage est construit.

Il semble que Percy Liang veuille vraiment apprendre à tout le monde à « construire » de grands modèles. Les internautes intéressés peuvent en savoir plus.

Lien vers le cours : https://www.youtube.com/playlist?list=PLoROMvodv4rMqXOcazWaTUHhq-yembLCV

Et vous ? Que pensez-vous de cette diffusion en direct qui met véritablement l'entraînement des grands modèles sur le devant de la scène ? N'hésitez pas à laisser vos commentaires !

Liens de référence :

https://x.com/MaxForAI/status/2091270116067750089

https://x.com/percyliang/status/2090918065634684997

https://x.com/CopyRebeldia/status/2091231950774112412?s=20

https://www.youtube.com/playlist?list=PLoROMvodv4rMqXOcazWaTUHhq-yembLCV

Cet article provient du compte officiel WeChat « Machine Heart » (ID : almosthuman2014), auteur : Attention à l'IA

Questions liées

QQui est à l'origine de l'entraînement en direct du modèle de langage massif de 535 milliards de paramètres et quelle est son affiliation ?

APercy Liang, professeur à l'Université de Stanford et fondateur de Simile AI, est à l'origine de ce projet d'entraînement public, mené par le laboratoire ouvert Marin.

QQuelles sont les ressources de calcul principales utilisées pour entraîner le modèle Marin 535B-A23B ?

ALe projet utilise 11 systèmes GB200 NVL72, ce qui équivaut à environ 792 GPU GB200, pour réaliser l'entraînement.

QQuelle est la durée prévue pour la phase principale d'entraînement du modèle ?

ALa phase principale d'entraînement du modèle devrait durer environ trois mois.

QQuel est l'objectif principal du projet d'entraînement public mené par Percy Liang et le laboratoire Marin selon l'article ?

AL'objectif principal est de rendre le processus d'entraînement des grands modèles de langage observable, discutable et collaboratif, en ouvrant ce qui était traditionnellement un 'boîte noire'.

QOù le public peut-il suivre en temps réel la progression de l'entraînement du modèle ?

ALe public peut suivre l'entraînement en temps réel sur la plateforme Weights & Biases (wandb) via le lien fourni : https://wandb.ai/marin-community/marin_moe/reports/535B-A23B-18T-Token-Hero-Run-Scaling-Ladder--VmlldzoxNzc2MDM5Ng

Lectures associées

Les dépôts en actifs réels tokenisés (RWA) ont triplé — les finances traditionnelles optent pour la blockchain

Le secteur de la finance décentralisée (DeFi) est en pleine transformation structurelle, les actifs du monde réel tokenisés (RWA) occupant désormais une place centrale. Selon un rapport conjoint de CoinShares et Token Terminal du 6 août 2026, les dépôts en RWA sur les plateformes de prêt et de négociation décentralisées ont atteint 7,4 milliards de dollars au deuxième trimestre 2026, soit plus du triple par rapport aux 2,3 milliards de l’année précédente. Cette croissance spectaculaire contraste avec la stagnation générale des instruments cryptographiques classiques, les dépôts totaux en DeFi ayant baissé de 15% sur la même période. L’intérêt pour ces actifs traditionnels tokenisés se développe indépendamment des cycles du marché des crypto-actifs, signalant un changement fondamental motivé par l’utilité financière réelle de la blockchain. Les principaux moteurs sont les obligations du Trésor américain tokenisées et les fonds multi-stratégies. Les investisseurs utilisent des produits comme le BUIDL de BlackRock ou le sUSDS de Sky comme garanties, leur permettant d’accéder à des liquidités en stablecoins tout en conservant le rendement de l’actif sous-jacent (entre 3,2 % et 5,5 % par an). Ethereum reste le leader incontesté, hébergeant environ 70 % de la valeur garantie par les RWA, notamment via des plateformes comme Aave et Morpho. Outre les obligations d’État, les actions et les produits dérivés de matières premières tokenisés connaissent également un développement significatif. Le marché des actions tokenisées est estimé à environ 2,2 milliards de dollars. Parallèlement, les volumes de contrats à terme perpétuels sur RWA, comme ceux sur le pétrole, les métaux précieux ou l’indice S&P 500, explosent sur des plateformes décentralisées, offrant un accès continu aux marchés. Les perspectives d’expansion du secteur sont prometteuses, avec des prévisions de Standard Chartered tablant sur une capitalisation totale des actifs tokenisés pouvant atteindre 4 000 milliards de dollars d’ici fin 2028. L’intégration entre la finance traditionnelle et les technologies blockchain est désormais dans une phase de mise à l’échelle institutionnelle active, la tokenisation offrant une valeur tangible, une liquidité profonde et un accès ininterrompu au capital mondial, indépendamment des tendances spéculatives.

cryptonews.ruIl y a 10 mins

Les dépôts en actifs réels tokenisés (RWA) ont triplé — les finances traditionnelles optent pour la blockchain

cryptonews.ruIl y a 10 mins

La réserve de Bitcoin reste intacte : Strategy a vendu des actions pour 2 milliards de dollars et lancé un nouveau pool USD Cash

La société Strategy (anciennement MicroStrategy) a annoncé la mise à jour de son cadre de gestion du capital, introduisant un nouveau pool de liquidités en dollars, USD Cash. Cette décision fait suite à la vente, du 17 au 23 août 2026, de 18,3 millions d'actions MSTR, ayant généré une recette nette de 2,006 milliards de dollars. Les fonds ont été alloués ainsi : 136,4 millions de dollars pour le rachat d'actions privilégiées STRC, 300 millions ajoutés à la réserve existante USD Reserve, et le solde utilisé pour constituer le nouveau pool USD Cash. Au 23 août, l'USD Reserve s'élevait à 5,10 milliards de dollars et l'USD Cash à 1,59 milliard. L'USD Reserve reste dédiée au service des dividendes sur actions privilégiées et de la dette. L'USD Cash, quant à lui, est un réservoir de liquidités à usage plus général, pouvant financer l'achat de bitcoins, le rachat d'actions, le remboursement de dettes ou l'alimentation de l'USD Reserve. Fait notable, la réserve de bitcoins de la société est restée intacte durant cette période, à 840 447 BTC, avec un prix d'acquisition moyen de 75 385 dollars par bitcoin. Cette réorganisation des réserves intervient dans un contexte où la prime de marché sur la valeur du portefeuille bitcoin de Strategy (multiplicateur mNAV) est actuellement faible, autour de 1,0x. Elle pourrait être une stratégie pour renforcer la confiance des investisseurs dans la structure du capital de l'entreprise.

cryptonews.ruIl y a 25 mins

La réserve de Bitcoin reste intacte : Strategy a vendu des actions pour 2 milliards de dollars et lancé un nouveau pool USD Cash

cryptonews.ruIl y a 25 mins

Strategy a brutalement suspendu l'achat de bitcoins et accumulé 6,69 milliards de dollars en liquide

La société Strategy, basée en Virginie, a annoncé qu'elle n'a effectué aucune transaction de Bitcoin entre le 17 et le 23 août. Elle détient un portefeuille de 840 447 BTC, achetés pour 63,36 milliards de dollars à un prix moyen de 75 385 dollars par unité, soit environ 4% de l'offre totale de Bitcoin. Durant cette période, Strategy a radicalement ralenti ses achats de Bitcoin et a considérablement accru ses réserves de liquidités. Elle a constitué un fonds distinct « USD Cash » de 1,59 milliard de dollars et a porté sa réserve de dollars américains à 5,10 milliards, pour un trésor de guerre total de 6,69 milliards de dollars. Ces fonds sont destinés à des usages variés : acquisitions de Bitcoin, dividendes, rachats d'actions (notamment 136 millions de dollars en actions STRC), remboursements de dettes ou renforcement des réserves. Le PDG Michael Saylor a souligné que cette manœuvre financière, financée par une émission d'actions, consolide la solidité financière de la société et sa flexibilité stratégique. Rien n'indique un abandon de la stratégie Bitcoin, les achats restant une utilisation prévue des liquidités. L'attention se porte désormais sur l'utilisation des 1,59 milliard de dollars du fonds « USD Cash », qui pourraient être déployés pour saisir des opportunités sur le Bitcoin ou d'autres opérations corporates.

cryptonews.ruIl y a 50 mins

Strategy a brutalement suspendu l'achat de bitcoins et accumulé 6,69 milliards de dollars en liquide

cryptonews.ruIl y a 50 mins

Trading

Spot
活动图片