# LLM Articles associés

Le Centre d'actualités HTX fournit les derniers articles et analyses approfondies sur "LLM", couvrant les tendances du marché, les mises à jour des projets, les développements technologiques et les politiques réglementaires dans l'industrie crypto.

Claude Code supprime 80% des prompts, Opus 5 en remet 72% dans la foulée !

Claude Code a annoncé avoir supprimé plus de 80% des mots de passe système des modèles de dernière génération comme Opus 5, dans le but de remplacer des règles rigides par des principes généraux et de réduire les conflits d'instructions. Cependant, une analyse par un développeur a révélé que si la réduction était flagrante entre Opus 4.7 (15 225 caractères) et Opus 4.8 (4 467 caractères), le prompt d'Opus 5 est en réalité remonté à 7 694 caractères, soit une augmentation d'environ 72% par rapport à son prédécesseur immédiat. Cette apparente contradiction s'explique par la stratégie d'Anthropic : les modèles plus anciens utilisent un prompt détaillé "à l'ancienne", tandis que les nouveaux modèles comme Opus 5 utilisent un prompt globalement allégé. L'augmentation constatée pour Opus 5 correspond principalement à l'ajout de nouvelles règles spécifiques pour encadrer ses comportements plus proactifs. Ces ajouts, regroupés sous les thèmes "Delivering work" et "Corrections" (environ 3 755 caractères), visent à contrôler sa tendance à élargir la portée des tâches, à générer des réponses très longues, à trop faire appel à des sous-agents ou à se corriger excessivement. Ainsi, le grand nettoyage a bien eu lieu, supprimant les directives micromanageantes obsolètes. Opus 5 fonctionne avec un prompt bien plus léger qu'Opus 4.7. Les nouvelles règles ajoutées ne sont pas un retour en arrière, mais une adaptation nécessaire pour guider les capacités émergentes et l'autonomie accrue du modèle le plus avancé.

marsbitIl y a 2 jours 11:41

Claude Code supprime 80% des prompts, Opus 5 en remet 72% dans la foulée !

marsbitIl y a 2 jours 11:41

Un tiers des arXiv contaminé, 65% des articles en informatique jugés « au goût d'IA », contre seulement 0,7% en mathématiques

Selon une étude récente portant sur 12 750 articles de l’arXiv, environ un tiers des articles scientifiques publiés sur la plateforme entre 2023 et 2026 présentent des signes d’écriture générée par IA. Le domaine de l’informatique est le plus touché, avec 65 % des nouveaux articles marqués comme potentiellement écrits par l’IA, contre seulement 0,7 % en mathématiques. Cette différence s’expliquerait par le fait que les outils de détection actuels analysent principalement le texte rédigé en langage naturel, et non les formules ou symboles mathématiques, qui constituent l’essentiel des publications en mathématiques. L’étude montre que l’utilisation de l’IA dans la rédaction académique a fortement augmenté après le lancement de ChatGPT, passant d’un taux de détection de 0,4 % avant 2023 à un pic de près de 39 % début 2026. Les domaines les plus « intensifs » en IA sont également les plus compétitifs, où les chercheurs pourraient utiliser ces outils pour accélérer leur production. Cependant, les auteurs soulignent que ces chiffres doivent être interprétés avec prudence : les détecteurs identifient un « style » assimilé à l’IA, mais ne distinguent pas une simple révision linguistique d’une rédaction entièrement automatisée. De plus, certains textes académiques humains antérieurs à l’IA sont également signalés, ce qui révèle les limites de ces outils et la difficulté croissante à différencier écriture humaine et artificielle.

marsbitIl y a 2 jours 11:39

Un tiers des arXiv contaminé, 65% des articles en informatique jugés « au goût d'IA », contre seulement 0,7% en mathématiques

marsbitIl y a 2 jours 11:39

2 mois pour passer de 8,8 à 68 milliards d'euros d'évaluation ! La plus grande plateforme de transit d'IA, OpenRouter, sur le point d'être rachetée

**Résumé en français :** Stripe, le géant du paiement en ligne, négocierait l'acquisition d'OpenRouter, une place de marché et couche d'IA de type "routeur" ou "agrégateur", pour près de 100 milliards de dollars. Cette valorisation représente une multiplication par près de sept par rapport à l'évaluation d'OpenRouter il y a deux mois (13 milliards de dollars). Fondée en 2023 par Alex Atallah (cofondateur d'OpenSea), OpenRouter agit comme un intermédiaire crucial pour les développeurs d'applications d'IA. Sa plateforme permet d'accéder via une seule API à plus de 400 grands modèles de langage (comme GPT, Claude, et de nombreux modèles open source) et choisit automatiquement le modèle le plus adapté à chaque tâche en fonction du coût, des performances et de la vitesse. Cela permet aux applications en aval de réduire leurs factures de "réflexion" (inference) sans que l'utilisateur final ne voie la différence. Pour Stripe, cette acquisition stratégique s'inscrit dans une volonté de devenir l'infrastructure de paiement et de gestion de la consommation pour l'économie de l'IA. Fin 2025, Stripe avait déjà acquis Metronome, une plateforme de facturation à l'usage pour l'IA. En combinant OpenRouter (choix du modèle) et Metronome (facturation précise), Stripe cherche à offrir une solution intégrée pour le routage, la mesure et le paiement de la consommation d'IA, consolidant ainsi son rôle de "caisse" et de "centre de régulation" de cette nouvelle économie.

链捕手07/24 09:04

2 mois pour passer de 8,8 à 68 milliards d'euros d'évaluation ! La plus grande plateforme de transit d'IA, OpenRouter, sur le point d'être rachetée

链捕手07/24 09:04

Claude Opus 5 fuité, voici les premiers tests des internautes

Anthropic aurait accidentellement laissé fuir des aperçus de son prochain modèle d'IA, Claude Opus 5, et les premiers tests des internautes affluent. Les démonstrations partagées sur les réseaux sociaux, notamment par @chetaslua, mettent en avant des capacités graphiques impressionnantes. Elles incluent la génération de scènes 3D détaillées (comme un trébuchet attaquant un château avec des paramètres physiques affichés), des interfaces interactives aux reflets réalistes et des rendus complexes dans des styles variés, du réaliste au pixel art (comme une réplique de Minecraft). Certains utilisateurs estiment que la qualité et la densité des détails surpasseraient même celles de Fable 5, le modèle de génération vidéo actuel d'Anthropic. Les premières traces de cette fuite sont apparues vers le 9 juillet, avec un modèle mystérieux nommé "Honeycomb EAP" brièvement visible dans l'éditeur de code Cursor. Par la suite, des références à "Claude Opus 5" ont été repérées dans Google Vertex AI et dans des messages d'erreur de Cursor, confirmant son développement avancé. Une capture d'écran suggère même qu'Opus 5 serait utilisé en secours lorsque les garde-fous de Fable 5 sont déclenchés. Si les performances visuelles semblent prometteuses, la question du coût reste en suspens. Bien qu'Opus 5 soit facturé moitié moins cher que Fable 5 par million de tokens, certains testeurs rapportent une consommation de tokens beaucoup plus élevée, ce qui pourrait finalement annuler l'avantage tarifaire. La communauté attend désormais une version officielle et des benchmarks complets pour confirmer si Opus 5 peut vraiment remplacer Fable 5.

marsbit07/24 07:57

Claude Opus 5 fuité, voici les premiers tests des internautes

marsbit07/24 07:57

À mesure que le consensus s'accélère, sur quoi parient les jeunes investisseurs ?

Dans le paysage actuel des investissements technologiques, la rapidité d’évolution des consensus oblige les jeunes investisseurs à s’adapter. L’IA quitte désormais l’écran pour s’intégrer au monde physique, avec un accent croissant sur l’intelligence embarquée, les robots et les systèmes industriels. Le défi n’est plus seulement de démontrer des capacités techniques, mais d’assurer une livraison fiable et scalable dans des environnements réels. Parallèlement, la valeur des grands modèles linguistiques ne se limite pas à leur performance initiale ; elle réside dans leur capacité à s’insérer durablement dans les flux de travail, créant ainsi une « roue de l’intelligence » auto-renforçante grâce aux données et retours utilisateurs. Face aux limites des données humaines, des approches comme l’apprentissage par renforcement et les modèles scientifiques fondamentaux émergent comme des pistes pour dépasser ces contraintes. Enfin, dans les domaines de pointe comme l’aérospatiale commerciale, l’informatique quantique ou l’énergie avancée, le capital doit faire preuve de patience. Ces secteurs requièrent des cycles de validation longs, une maîtrise des chaînes d’approvisionnement et une résilience face à l’incertitude. Les investisseurs doivent donc anticiper les besoins futurs et soutenir des équipes capables de naviguer dans ces écosystèmes complexes, en misant sur le long terme plutôt que sur des rendements immédiats.

marsbit07/22 03:40

À mesure que le consensus s'accélère, sur quoi parient les jeunes investisseurs ?

marsbit07/22 03:40

Reproduire le "moment DeepSeek" ? Wall Street affirme à l'unisson : Kimi K3 renforce plutôt la demande en puissance de calcul

La publication de Kimi K3 par Moonshot AI, un modèle open-source de 2,8 billions de paramètres, a initialement suscité des craintes d’un « moment DeepSeek 2.0 », laissant présager une pression à la baisse sur la demande en infrastructures de calcul. Cependant, les analyses de plusieurs banques d’investissement (UBS, Nomura, Bank of America, Citi) convergent vers une conclusion inverse : K3, avec sa fenêtre de contexte d’1 million de tokens, son architecture MoE et ses capacités multimodales natives, est un catalyseur de la demande en puissance de calcul, et non son adversaire. Le modèle, performant et proposé à un coût inférieur aux leaders fermés comme Claude ou GPT, suit un « paradoxe de Jevons » : son efficacité accrue et son accessibilité devraient stimuler l’adoption et le volume de traitement (tokens), augmentant ainsi la consommation globale de ressources. Il exige des infrastructures robustes : une pression accrue sur la mémoire (HBM, DDR5, stockage) due au cache KV des longs contextes, des clusters GPU massifs (« super-nœuds ») pour son déploiement, et bénéficie aux fondeurs (TSMC), aux fabricants de puces (NVIDIA), aux réseaux (modules optiques) et aux plateformes cloud. En résumé, loin de menacer la chaîne de valeur du matériel IA, Kimi K3, en poussant les laboratoires frontières à innover davantage et en élargissant l’écosystème des applications, devrait amplifier la demande pour les semi-conducteurs avancés, la mémoire, le stockage et les infrastructures réseaux et data centers.

链捕手07/21 06:22

Reproduire le "moment DeepSeek" ? Wall Street affirme à l'unisson : Kimi K3 renforce plutôt la demande en puissance de calcul

链捕手07/21 06:22

L'angoisse mémoire des grands modèles, la solution se trouve sur une clé USB

Les modèles d'IA générative sont confrontés à un défi majeur : la pénurie et le coût élevé de la mémoire HBM, essentielle pour leurs opérations. Une nouvelle approche, surprenante, émerge : utiliser la mémoire flash NAND (la technologie des clés USB) pour soulager cette pression. Baptisée High Bandwidth Flash (HBF), elle est développée par SanDisk et SK Hynix. L'idée centrale est de tirer parti du point fort de la flash NAND : une lecture de données relativement rapide et un coût par gigaoctet bien inférieur à celui de la HBM. En empilant jusqu'à 16 puces NAND dans un seul module 3D, l'HBF vise à atteindre une bande passante de lecture de 1,6 To/s et une capacité de 512 Go par pile. Ce n'est pas un remplacement de la HBM. L'innovation réside dans une architecture mémoire hiérarchisée et spécialisée pour l'**inférence** (l'exécution) des grands modèles. Pendant l'inférence, les poids du modèle, volumineux et largement statiques, sont principalement lus, rarement écrits. L'HBF pourrait servir de "pool de mémoire morte haute capacité" pour ces données, libérant la HBM coûteuse pour les calculs les plus critiques et les données temporaires. Les avantages potentiels sont significatifs : réduire la quantité de HBM requise par serveur, diminuer le nombre de cartes d'accélération nécessaires pour héberger de très grands modèles, et ainsi abaisser les coûts globaux et la consommation énergétique des déploiements d'IA. Bien que la technologie HBF, en cours de standardisation, ne soit pas attendue avant au moins un an, elle signale une évolution importante. Face à l'explosion des modèles, la solution aux problèmes de mémoire pourrait venir non seulement de technologies plus rapides et chères, mais aussi d'une réorganisation intelligente des architectures, en redonnant un rôle clé à une technologie mature réinventée.

marsbit07/20 00:23

L'angoisse mémoire des grands modèles, la solution se trouve sur une clé USB

marsbit07/20 00:23

DeepSeek V4 « version pleine puissance » dévoilé, lancement prévu demain au plus tôt

Après près de trois mois d'attente, la version complète de DeepSeek V4 (General Availability) devrait être publiée prochainement, potentiellement dès demain. Le modèle est actuellement en test restreint. Deux versions sont annoncées : DeepSeek V4 Flash et DeepSeek V4 Pro. Les premières impressions d'un développeur indiquent que les performances globales se rapprochent du niveau d'Opus 4.8, avec des capacités de codage similaires à GPT-5.6 Sol et une nette amélioration des capacités d'agent et de génération 3D/SVG. Cependant, le modèle nécessiterait plus d'itérations qu'un Fable 5 pour accomplir la même tâche. Le principal changement réside dans la tarification de l'API, qui introduit un système de « facturation aux heures de pointe » (peak/off-peak). Les prix restent très compétitifs : par exemple, le million de tokens en sortie pour la version Flash coûterait 0,28 $ (hors pointe) contre 0,56 $ en pointe. Bien que cette approche marque un changement pour DeepSeek, réputé pour ses prix bas, le modèle maintient un rapport performance/prix très attractif, se présentant comme une alternative économique face aux modèles majeurs comme Fable 5 ou GPT-5.6 Sol. Les premières démonstrations techniques, notamment la génération de jeux simples en HTML/JavaScript et d'éléments SVG, commencent à circuler, suscitant des retours partagés sur les performances finales. Les anciens modèles deepseek-chat et deepseek-reasoner seront officiellement retirés le 24 juillet. En résumé, DeepSeek V4 ne vise pas nécessairement la première place absolue en performances pures, mais poursuit sa stratégie de proposer des capacités de haut niveau (type Opus) à un coût significativement inférieur, renforçant ainsi sa réputation de « briseur de prix » sur le marché de l'IA.

marsbit07/19 05:34

DeepSeek V4 « version pleine puissance » dévoilé, lancement prévu demain au plus tôt

marsbit07/19 05:34

Ouvrir le cerveau de Claude ne sert à rien, la vraie clé de la boîte noire de l'IA se trouve dans l'ingénierie ontologique

« L'essence de l'explication ne réside pas dans l'observation de la machine elle-même, mais dans l'examen du monde que la machine observe. » L'article critique la limite des approches d'explicabilité de l'IA comme J-Space d'Anthropic, qui se concentrent sur l'observation des états internes des modèles de langage. Cette perspective « internaliste », analogue à une IRM cérébrale, peut révéler des corrélations neuronales mais échoue à saisir le *sens* des sorties du modèle – leur relation avec le monde, les connaissances et les pratiques humaines. L'argument central est que la clé de l'explicabilité réside non pas dans la « boîte noire » du modèle, mais dans une analyse « ontologique » des informations qu'il traite. L'auteur s'inspire de la philosophie kantienne, suggérant que la compréhension émerge lorsque l'information est structurée selon des cadres catégoriels (comme la substance, la causalité, la modalité). Pour opérationnaliser cela, l'article promeut l'**ingénierie ontologique**. Il s'agit de construire des squelettes sémantiques formels (ontologies) décrivant les concepts, relations et règles d'un domaine. En ancrant les raisonnements des grands modèles de langage à de telles structures de connaissances vérifiables et traçables, l'explication cesse d'être une dissection des poids neuronaux pour devenir une démonstration des fondements informationnels utilisés. Ainsi, le futur de l'explicabilité ne dépendrait pas d'une transparence interne impossible, mais de la capacité à rendre l'impact et les raisonnements des modèles compréhensibles et responsables via leur alignement sur des ontologies exploitables, transformant un défi technique en un objectif de gouvernance réalisable par l'ingénierie.

marsbit07/17 07:45

Ouvrir le cerveau de Claude ne sert à rien, la vraie clé de la boîte noire de l'IA se trouve dans l'ingénierie ontologique

marsbit07/17 07:45

活动图片