# LLM Articles associés

Le Centre d'actualités HTX fournit les derniers articles et analyses approfondies sur "LLM", couvrant les tendances du marché, les mises à jour des projets, les développements technologiques et les politiques réglementaires dans l'industrie crypto.

Gemini 3.5 Pro fuité en secret, rattrapant Fable 5 en développement front-end

**Gemini 3.5 Pro : La fuite révèle une avancée majeure en génération de code front-end** Des informations fuient concernant Gemini 3.5 Pro, la future version « haut de gamme » de Google, dont le lancement est anticipé pour le 17 juillet. La révélation la plus frappante porte sur ses performances exceptionnelles dans la génération de code visuel et d'interfaces utilisateur (UI). Selon les premiers retours de développeurs ayant testé une version divulguée, Gemini 3.5 Pro montre un saut de qualité remarquable dans ce domaine précis. Il génère des interfaces au design plus raffiné, avec une meilleure gestion des couleurs et de l'espace. Sa capacité à produire du code front-end « prêt à l'emploi » et des graphiques SVG complexes de haute fidélité en une seule itération est particulièrement saluée. Certains comparent même ses résultats, en termes d'esthétique et d'atmosphère, favorablement à ceux de Fable 5, un modèle concurrent réputé. Cependant, cette fuite nuance également cet enthousiasme. Dans les tâches de raisonnement complexe, d'ingénierie logicielle à grande échelle ou d'exécution de tâches longues et multi-étapes (comme celles des benchmarks SWE-Bench Pro), Gemini 3.5 Pro serait toujours à la traîne derrière des modèles comme Fable 5 ou GPT-5.6. Sa force semble donc ciblée. La raison du retard de sa sortie serait liée à un processus de ré-entraînement complet (« préformation ») sur une nouvelle architecture de base, plus performante que celle de son homologue léger, Gemini 3.5 Flash. Cette même base servirait également à développer un futur modèle de génération d'images, nommé « Nano Banana Pro », destiné à concurrencer GPT-Image 2 d'OpenAI. Ainsi, Google miserait sur cette refonte pour regagner du terrain sur deux fronts : le code front-end et la génération d'images. Si les affirmations de la fuite se confirment le 17 juillet, Gemini 3.5 Pro pourrait redistribuer les cartes dans un secteur de l'IA en perpétuelle accélération.

marsbit07/06 12:30

Gemini 3.5 Pro fuité en secret, rattrapant Fable 5 en développement front-end

marsbit07/06 12:30

Karpathy monte au créneau : une seule phrase réduit au silence tous les développeurs d'Agent

Andrej Karpathy, chercheur principal chez Anthropic, a récemment critiqué la tendance actuelle à développer rapidement des agents IA sans avoir d'abord maîtrisé les modèles de base sous-jacents. S'appuyant sur son expérience d'un projet avorté chez OpenAI en 2016, il souligne que les technologies de l'époque, comme l'apprentissage par renforcement, n'étaient pas prêtes. Aujourd'hui, il avertit que créer une démo d'agent est simple, mais en faire un produit viable peut prendre une décennie, comme l'ont montré les domaines de la conduite autonome et de la VR. Il conseille aux développeurs de se concentrer d'abord sur le renforcement des modèles de fondation (LLMs), affirmant que des agents robustes émergeront naturellement d'une base solide. Pour progresser, il suggère même de s'inspirer des neurosciences, en étudiant des structures cérébrales comme l'hippocampe ou le thalamus. Cependant, Karpathy offre aussi une lueur d'espoir aux startups et développeurs indépendants. Il estime que dans le domaine des agents, les grandes entreprises comme OpenAI n'ont pas d'avance décisive de plusieurs années. L'innovation la plus percutante viendra donc probablement de ceux qui sont agiles, expérimentent rapidement et sont prêts à s'engager sur le long terme. Son message central est clair : il ne faut pas négliger les fondamentaux pour courir après la mode éphémère des démonstrations.

marsbit07/06 02:36

Karpathy monte au créneau : une seule phrase réduit au silence tous les développeurs d'Agent

marsbit07/06 02:36

Hinton loue, un contributeur clé de Gemini prédit : des milliards d'IA superhumaines de niveau Einstein à venir

Adam Brown, physicien théoricien et contributeur clé de Gemini chez DeepMind, a donné une conférence intitulée "Entraîner le sable à penser : L'IA générale et l'avenir de la physique". Il y décrit l'évolution fulgurante des modèles de langage (LLM), passant d'un niveau "jardin d'enfants" à celui d'un "doctorat" en quelques années, surmontant des tests de référence comme le MATH ou les Olympiades internationales de mathématiques (IMO). Brown explique que les LLM ne sont pas programmés mais "cultivés" via un pré-entraînement sur données massives puis un affinage. Il attribue cette révolution à la "loi d'échelle" (Scaling Law), une relation simple découverte par des physiciens : augmenter les données, la puissance de calcul et la taille des modèles améliore régulièrement leurs performances. Il présente des avancées majeures où l'IA collabore avec des mathématiciens ("mode centaure") et résout seule des conjectures non résolues depuis des décennies, comme la conjecture des distances unitaires d'Erdős. En s'inspirant de l'histoire des IA aux échecs, Brown prédit une trajectoire similaire pour la recherche : une ère de collaboration humain-IA ("centaure"), suivie par l'émergence de "scientifiques IA" autonomes et surhumains, potentiellement reproductibles à des milliards d'exemplaires. Même en cas de stagnation des capacités, les LLM transformeront déjà la physique en tant que tuteurs, assistants de programmation et outils de littérature infatigables. Brown conclut que les prochaines années seront les plus passionnantes pour la discipline, avec de grandes découvertes à venir grâce à cette synergie.

marsbit07/04 06:48

Hinton loue, un contributeur clé de Gemini prédit : des milliards d'IA superhumaines de niveau Einstein à venir

marsbit07/04 06:48

Anthropic vient de lancer Sonnet 5, des performances proches d'Opus 4.8, mais pas nécessairement moins cher

Anthropic a officiellement lancé Claude Sonnet 5, présenté comme le modèle Sonnet le plus agentique à ce jour, capable de planifier, d'utiliser des outils (navigateur, terminal) et de fonctionner de manière autonome à un niveau auparavant réservé à des modèles plus grands et coûteux. Ses performances en raisonnement, utilisation d'outils, programmation et travail intellectuel se sont nettement améliorées par rapport à Sonnet 4.6, se rapprochant de celles d'Opus 4.8, mais à un prix inférieur. Il offre un meilleur rapport coût-efficacité, surtout à un niveau d'effort moyen, et peut égaler Opus 4.8 sur certaines tâches exigeantes. Les évaluations de sécurité montrent que Sonnet 5 est globalement plus sûr que Sonnet 4.6, avec un taux de comportements inappropriés plus bas et une meilleure résistance aux attaques. Cependant, il reste légèrement moins performant qu'Opus 4.8 et Mythos Preview dans ce domaine. Anthropic a activé par défaut des garde-fous de cybersécurité similaires à ceux d'Opus 4.7/4.8. Disponible dès maintenant sur toutes les plateformes, Sonnet 5 bénéficie d'un prix de lancement jusqu'au 31 août 2026 : 2 $ / million de tokens en entrée et 10 $ / million en sortie. Passé cette date, le tarif standard sera de 3 $ / 15 $. Un nouveau tokenizer a été introduit, entraînant une augmentation du nombre de tokens pour un même contenu (facteur 1.0 à 1.35). Les limites de débit (rate limits) ont également été relevées pour s'adapter aux modes à effort élevé. Des retours d'utilisateurs soulignent sa rapidité et ses capacités agentiques, notamment pour l'utilisation sécurisée du navigateur. Cependant, certaines analyses pointent que le coût d'exécution par tâche pourrait être plus élevé que celui de Sonnet 4.6 et même d'Opus 4.8 en raison d'une consommation accrue de tokens.

marsbit07/01 00:41

Anthropic vient de lancer Sonnet 5, des performances proches d'Opus 4.8, mais pas nécessairement moins cher

marsbit07/01 00:41

活动图片