# 3D Articles associés

Le Centre d'actualités HTX fournit les derniers articles et analyses approfondies sur "3D", couvrant les tendances du marché, les mises à jour des projets, les développements technologiques et les politiques réglementaires dans l'industrie crypto.

Montrez-moi 《Le Seigneur des Anneaux》, Karpathy recommande avec insistance un nouveau benchmark pour l'évaluation des grands modèles

Anthropic, dirigé par Andrej Karpathy, a présenté un nouveau benchmark pour les grands modèles de langage (LLM) appelé "Le Seigneur des Anneaux". Ce test remplace l'ancien benchmark populaire "Pélican à vélo" (qui consistait à générer une image SVG d'un pélican sur un vélo). Le nouveau défi consiste à demander à un modèle comme Claude Opus 5 de générer un monde 3D interactif et animé du "Seigneur des Anneaux" à partir du texte d'ouverture du livre, en utilisant la bibliothèque JavaScript Three.js. Le processus a nécessité 1 million de tokens, 2 heures de calcul et généré environ 5500 lignes de code. Le résultat est un monde 3D brut, de style "polygonal bas", qui représente Hobbiton. Bien que le rendu visuel soit abstrait et présente des défauts (comme des personnages flottants), il démontre une compréhension spatiale et narrative. Karpathy souligne que le modèle peut coder et construire des scènes, mais ne peut pas encore "entrer" dans son monde pour le vérifier ou y jouer, révélant une limite actuelle. La communauté a réagi avec créativité, produisant d'autres mondes 3D comme une simulation de San Francisco, un concert de Kanye West généré, et même des prototypes de jeux interactifs. Cela suggère un potentiel pour abaisser le seuil de création de contenu 3D et de jeux légers. Le débat s'est engagé sur la pertinence de ce nouveau benchmark. Certains estiment qu'il teste mieux la compréhension du monde, la planification de projet et le raisonnement spatial sur de longues séquences que le simple test du pélican. D'autres questionnent son coût en calcul et si cela prouve une véritable compréhension physique ou simplement une maîtrise du code Three.js. Au cœur du débat se trouve la question de savoir si la capacité des LLM à traduire une compréhension du monde en structures exécutables évolue fondamentalement. Cette avancée pose également une question plus large : à mesure que les LLM pourront orchestrer la génération de mondes 3D, de vidéos et d'audio via différentes API, quel sera le rôle futur des outils de génération spécialisés ?

marsbitIl y a 2 jours 09:00

Montrez-moi 《Le Seigneur des Anneaux》, Karpathy recommande avec insistance un nouveau benchmark pour l'évaluation des grands modèles

marsbitIl y a 2 jours 09:00

Claude Opus 5 fuité, voici les premiers tests des internautes

Anthropic aurait accidentellement laissé fuir des aperçus de son prochain modèle d'IA, Claude Opus 5, et les premiers tests des internautes affluent. Les démonstrations partagées sur les réseaux sociaux, notamment par @chetaslua, mettent en avant des capacités graphiques impressionnantes. Elles incluent la génération de scènes 3D détaillées (comme un trébuchet attaquant un château avec des paramètres physiques affichés), des interfaces interactives aux reflets réalistes et des rendus complexes dans des styles variés, du réaliste au pixel art (comme une réplique de Minecraft). Certains utilisateurs estiment que la qualité et la densité des détails surpasseraient même celles de Fable 5, le modèle de génération vidéo actuel d'Anthropic. Les premières traces de cette fuite sont apparues vers le 9 juillet, avec un modèle mystérieux nommé "Honeycomb EAP" brièvement visible dans l'éditeur de code Cursor. Par la suite, des références à "Claude Opus 5" ont été repérées dans Google Vertex AI et dans des messages d'erreur de Cursor, confirmant son développement avancé. Une capture d'écran suggère même qu'Opus 5 serait utilisé en secours lorsque les garde-fous de Fable 5 sont déclenchés. Si les performances visuelles semblent prometteuses, la question du coût reste en suspens. Bien qu'Opus 5 soit facturé moitié moins cher que Fable 5 par million de tokens, certains testeurs rapportent une consommation de tokens beaucoup plus élevée, ce qui pourrait finalement annuler l'avantage tarifaire. La communauté attend désormais une version officielle et des benchmarks complets pour confirmer si Opus 5 peut vraiment remplacer Fable 5.

marsbit07/24 07:57

Claude Opus 5 fuité, voici les premiers tests des internautes

marsbit07/24 07:57

1600 lignes de code ont créé un Manhattan sous-marin, Fable 5 a stupéfié Karpathy

Le modèle Fable 5, nouvellement réactivé, a créé une onde de choc en générant 63 mondes 3D interactifs et complexes, souvent du premier coup. Andrey Karpathy, récemment arrivé chez Anthropic, a qualifié les résultats d'"incroyables" et d'un exemple de "fablemaxxing" – une avancée qualitative majeure. Parmi les créations les plus frappantes figure une "Manhattan sous-marine" détaillée, construite avec seulement 1600 lignes de code. Les autres mondes incluent des villes historiques (Londres, Istanbul), des simulations physiques, des tableaux célèbres (comme *La Nuit étoilée* de Van Gogh) rendus navigables en 3D, et des paysages naturels saisissants où un ours attrape un saumon. L'auteur, Peter Gostev d'Arena.ai, souligne que la prouesse ne réside pas dans la beauté d'une scène isolée, mais dans la capacité du modèle à coordonner une multitude d'éléments de manière cohérente. Alors que les modèles précédents échouaient souvent dans les dernières étapes, Fable 5 produit des résultats complets à partir de spécifications détaillées, démontrant une compréhension et un pouvoir explicatif inédits. Cependant, Gostev note quelques limites : les éléments de jeu manquent de profondeur et le modèle semble parfois retenir son plein potentiel, nécessitant des incitations pour se dépasser. Karpathy s'interroge sur la façon dont le modèle, formé sur des données internet, a acquis et traduit une compréhension aussi nuancée du monde physique en éléments 3D animés. Cette capacité ouvre la porte à des possibilités immenses avec les futures itérations. L'exploration de ce que l'IA peut vraiment créer et comprendre ne fait que commencer.

marsbit07/06 09:52

1600 lignes de code ont créé un Manhattan sous-marin, Fable 5 a stupéfié Karpathy

marsbit07/06 09:52

SemiAnalysis décortique le Kirin 9030 de Huawei : La finesse de gravure stagne, on plie la puce

SemiAnalysis, via son laboratoire STEEL, a publié sa première analyse de démontage publique, ciblant le Kirin 9030 Pro de Huawei (fabriqué par SMIC en procédé N+3). Le rapport révèle que le pas métallique minimum (M0 pitch) du N+3 est de 32,5 nm, plus fin que celui de l'Intel 18A. Cependant, ceci est un indicateur isolé et la densité logique globale (113,4 MTr/mm²) est similaire au N6 de TSMC, mais obtenue à un coût bien supérieur en raison de l'utilisation d'une quadruple modélisation (SAQP) avec des DUV uniquement, sans EUV. Le Kirin 9030, de taille similaire à son prédécesseur, intègre plus de cœurs CPU/GPU/NPU et de cache grâce à la densité améliorée. Ses performances GPU rattrapent environ les flagships de 2022, mais le CPU, basé sur une architecture de type Cortex-X2 (2021), accuse un retard en IPC et en fréquence dû aux limitations du procédé de fabrication. Face à ces contraintes, Huawei mise sur une nouvelle voie : l'échelle Tau et le "LogicFolding" (pliage logique). Cette approche consiste à empiler verticalement des blocs logiques pour raccourcir les interconnexions, visant à atteindre 5 GHz et une densité équivalente élevée d'ici 2031. Bien que le calcul de densité pour la 3D diffère des méthodes traditionnelles, cette direction est stratégique. En conclusion, les contrôles à l'exportation n'ont pas arrêté les progrès sino-sémiconducteurs, mais en ont changé la trajectoire et le coût. SMIC prouve qu'une densité avancée est possible sans EUV, mais à un prix élevé. Pendant ce temps, Huawei innove en conception 3D et diversifie ses chaînes d'approvisionnement (mémoire CXMT), cherchant à rendre les puces nationales "suffisantes" pour des applications clés.

marsbit06/15 06:56

SemiAnalysis décortique le Kirin 9030 de Huawei : La finesse de gravure stagne, on plie la puce

marsbit06/15 06:56

Après avoir attiré l'attention d'IBM, three a multiplié sa valeur par 50

Un message de collaboration avec IBM a propulsé le projet Solana three.ws sur le devant de la scène, faisant bondir son jeton THREE de plus de 50 fois, passant d'une capitalisation d'environ 300 000 $ à plus de 16 millions. Three.ws se présente comme la "couche d'agents 3D pour l'internet", visant à libérer les agents IA des boîtes de discussion en leur donnant un corps, une mémoire, une identité et un portefeuille numérique. Le projet permet aux développeurs de créer des personnages 3D interactifs, de les équiper de modèles de langage et de compétences, et de les intégrer facilement dans des sites web via un composant, un peu comme une vidéo YouTube. L'architecture technique repose sur quatre couches : la couche de visualisation (affichage 3D), la couche Agent (cerveau, mémoire, compétences), une couche d'identité optionnelle (passerelle numérique sur blockchain) et une couche d'intégration pour le déploiement. Les partenariats stratégiques avec AWS Marketplace et IBM sont clés pour son adoption en entreprise. AWS facilite l'achat et la facturation via les comptes existants des clients, tandis qu'IBM fournira ses technologies d'IA d'entreprise (comme les modèles Granite) et ses canaux commerciaux. L'objectif est de transformer ces agents 3D démonstratifs en services gérables et déployables pour les entreprises, au-delà du simple coup médiatique généré par l'annonce IBM.

foresightnews_api06/05 04:30

Après avoir attiré l'attention d'IBM, three a multiplié sa valeur par 50

foresightnews_api06/05 04:30

D'une table de déjeuner à un univers infini : Fei-Fei Li parie sur la prochaine dimension de l'IA

500 000 ans, c’est l’âge du langage humain dans l’histoire de l’évolution. 540 millions d’années, c’est l’origine de l’explosion cambrienne, déclenchée par la perception visuelle et spatiale. Alors que les meilleurs labos de la Silicon Valley se concentraient sur les modèles linguistiques en 2025-2026, Fei-Fei Li, professeure à Stanford et fondatrice de World Labs, a souligné à plusieurs reprises une question cruciale : une IA qui ne sait que parler et regarder des images ne « comprendra » jamais vraiment le monde. Dans trois entretiens clés, elle a systématiquement défendu l’idée que l’intelligence spatiale (Spatial Intelligence) est la nouvelle frontière de l’IA. Le langage, récent à l’échelle de l’évolution, est un encodage du monde avec perte d’information. Les modèles linguistiques actuels, bien que puissants, échouent à des tâches spatiales simples comme compter des chaises dans une vidéo ou déduire des lois physiques à partir de données. Pour matérialiser cette vision, World Labs a développé Marble, son premier modèle générant des mondes 3D navigables et interactifs à partir de texte, d’images ou de vidéos. Contrairement aux générateurs de vidéo comme Sora, Marble produit des environnements avec une structure géométrique cohérente. Bien que son échelle de calcul soit bien inférieure à celle des grands modèles linguistiques comme le GPT-5, Marble a déjà trouvé des applications pratiques : développement de jeux, production cinématographique (réduisant les délais par 40), entraînement de robots, design d’intérieur, et même création d’environnements thérapeutiques personnalisés pour des troubles comme les TOC ou l’acrophobie. Fei-Fei Li évoque le potentiel de cette technologie à créer des « univers infinis » – pour la créativité, la socialisation, le voyage ou la narration – permettant à l’humanité de vivre dans un multivers numérique. Cependant, elle appelle à une vision responsable, rejetant à la fois l’utopisme technologique et les discours apocalyptiques. Pour elle, le succès de l’IA, comme celui de l’électricité en son temps, doit se mesurer à sa capacité à améliorer la civilisation et à préserver la dignité et l’autonomie de chaque individu. Son raisonnement s’appuie sur l’évolution : la perception précède le langage, l’espace précède le symbole. Le développement de l’intelligence spatiale n’est pas une simple itération technologique, mais une reprise accélérée de cette trajectoire évolutive, condensant en quelques années des centaines de millions d’années d’évolution naturelle.

marsbit05/27 00:19

D'une table de déjeuner à un univers infini : Fei-Fei Li parie sur la prochaine dimension de l'IA

marsbit05/27 00:19

活动图片