Un article d'ingénierie des prompts accepté à l'ICML 2026, la polémique fait rage en ligne
Le papier intitulé "Verbalized Sampling" (VS), accepté à ICML 2026, suscite un vif débat. Sa proposition centrale est simple : en modifiant simplement l'invite (prompt) pour demander à un LLM de générer des réponses tout en verbalisant leurs probabilités estimées, on peut significativement augmenter la diversité des sorties et atténuer l'effondrement des modes (mode collapse), un problème récurrent où les modèles produisent des réponses trop conventionnelles.
Les auteurs attribuent la racine du problème non pas aux algorithmes d'alignement, mais à un "biais de typicalité" dans les données de préférence humaines utilisées pour l'entraînement, qui favorisent les réponses familières. Leur méthode, testée sur plusieurs modèles et ensembles de données, multiplierait la diversité par 1,6 à 2,1 dans des tâches créatives sans nuire à l'exactitude ou à la sécurité.
Sur Reddit, les réactions sont partagées. Les critiques soulignent que l'idée semble triviale, manque de robustesse théorique par rapport à une nouvelle méthode algorithmique, et pourrait relever de la suroptimisation expérimentale. Les défenseurs rétorquent que la recherche valable ne se juge pas à sa complexité, mais à sa rigueur, sa reproductibilité et l'importance de son insight – ici, identifier la cause profonde du problème. Ils comparent cela à l'émergence du "Chain-of-Thought" (CoT), une simple invite devenue un champ de recherche fondamental. Le débat reflète une évolution potentielle de la discipline, où l'ingénierie des prompts et l'optimisation de l'inférence gagnent en légitimité face aux approches traditionnelles centrées sur l'entraînement des modèles.
marsbit07/15 08:01