GitHub annonce qu'à partir du 24 avril, il utilisera par défaut les données des utilisateurs de Copilot pour entraîner ses modèles d'IA

marsbitPublié le 2026-03-26Dernière mise à jour le 2026-03-26

Résumé

GitHub a annoncé qu'à partir du 24 avril 2026, il mettra à jour sa politique de collecte de données pour utiliser les interactions des utilisateurs de Copilot (Free, Pro et Pro+) afin d’entraîner ses modèles d’IA. Les données collectées incluront les entrées-sorties des modèles, extraits de code, informations contextuelles, structure des dépôts et historiques de discussion. Mario Rodriguez, directeur des produits, a justifié cette décision par l’amélioration de la précision et de la sécurité des suggestions de code. Le mécanisme est activé par défaut : les utilisateurs concernés doivent désactiver manuellement l’option dans les paramètres de confidentialité pour éviter que leurs données ne soient utilisées. Cette approche a suscité des débats concernant la définition des dépôts privés et les droits sur les données. Les utilisateurs professionnels (Business, Enterprise) et éducatifs sont exemptés de cette mesure en raison de contraintes contractuelles. GitHub souligne que cette pratique est courante dans le secteur, suivant l’exemple de sociétés comme Anthropic, JetBrains et Microsoft. Cette évolution reflète une tendance plus large : face à la raréfaction des données publiques de qualité, les acteurs de l’IA se tournent vers les données d’interaction pour améliorer les performances des modèles. Elle marque également le virage de GitHub d’une plateforme de托管 open source vers un écosystème fermé d’entraînement de l’IA, tout en soulevant des questions cruciales sur la conform...

GitHub a récemment annoncé qu'à partir du 24 avril 2026, il mettrait à jour sa politique de gestion des dépôts de code, prévoyant d'utiliser les données d'interaction des utilisateurs pour entraîner ses modèles d'IA. Cette collecte de données couvre les utilisateurs de Copilot Free, Pro et Pro+, incluant spécifiquement les entrées et sorties des modèles, les extraits de code, les informations contextuelles, la structure des dépôts et les historiques de conversations.

Mario Rodriguez, directeur des produits de GitHub, a déclaré que l'introduction des données d'interaction vise à améliorer la précision et la sécurité des suggestions de code du modèle, affirmant que les tests préalables sur les données internes de Microsoft ont déjà significativement augmenté le taux d'acceptation des suggestions. Il est à noter que cette politique adopte un mécanisme « d'adhésion par défaut », les utilisateurs concernés devant désactiver manuellement l'option correspondante dans les paramètres de confidentialité pour se retirer, ce qui a suscité des discussions approfondies dans la communauté des développeurs sur la définition des dépôts privés et la propriété des données.

Actuellement, les utilisateurs de Copilot Business, Enterprise soumis à des clauses contractuelles, ainsi que les utilisateurs de la version éducation, ne sont pas concernés par ce changement. GitHub a souligné dans ses explications que cette mesure est conforme aux pratiques courantes de l'industrie, suivies par des grands noms comme Anthropic, JetBrains et Microsoft. Cependant, l'inclusion de code provenant de dépôts privés dans les ensembles d'entraînement remet en question la notion traditionnelle de « privé », même si GitHub affirme que son objectif est d'optimiser les flux de travail de développement.

D'un point de vue sectoriel, alors que les données de code public de haute qualité s'épuisent, les principaux fournisseurs d'IA se tournent de plus en plus vers l'exploitation de « données profondes » comme les données d'interaction privées pour rechercher des gains de performance des modèles. Ce changement de politique marque non seulement une nouvelle étape dans l'évolution de GitHub, passant d'une plateforme d'hébergement open source à un écosystème fermé d'entraînement d'IA, mais annonce aussi une nouvelle phase dans le domaine des outils d'IA pour développeurs, où la conformité des données et l'avancée des modèles sont en constante négociation.

Questions liées

QQuand GitHub commencera-t-il à utiliser par défaut les données des utilisateurs de Copilot pour former ses modèles d'IA ?

AGitHub commencera à utiliser par défaut les données des utilisateurs de Copilot pour former ses modèles d'IA à partir du 24 avril 2026.

QQuels types de données utilisateur seront collectés par GitHub pour l'entraînement de l'IA ?

ALes données collectées incluent les entrées et sorties des modèles, des extraits de code, des informations contextuelles, la structure des dépôts et les historiques de conversations.

QComment les utilisateurs peuvent-ils se désinscrire de cette collecte de données ?

ALes utilisateurs doivent se rendre manuellement dans leurs paramètres de confidentialité et désactiver l'option correspondante pour se retirer, car la politique utilise un mécanisme d'« inclusion par défaut ».

QQuels utilisateurs de Copilot sont temporairement exemptés de ce changement de politique ?

ALes utilisateurs de Copilot Business, Enterprise et les utilisateurs de la version éducationnelle sont temporairement exemptés en raison de contraintes contractuelles.

QQuelle est la raison principale avancée par GitHub pour justifier cette utilisation des données ?

AGitHub affirme que cela vise à améliorer la précision et la sécurité des suggestions de code du modèle, des tests internes chez Microsoft ayant déjà montré une augmentation significative du taux d'acceptation des suggestions.

Lectures associées

Dialogue avec Ray Dalio : Nous sommes actuellement dans une bulle de l'IA, 1% de mon portefeuille est en Bitcoin

Ray Dalio, fondateur de Bridgewater Associates, met en garde contre la bulle actuelle de l'IA, présentant des signes classiques similaires aux précédents krachs financiers. Il explique qu'une combinaison de spéculation excessive, d'endettement et de changements de taux d'intérêt pourrait provoquer son éclatement, entraînant une récession économique. Dalio décrit également un « grand cycle » mondial d'environ 80 ans, caractérisé par des inégalités croissantes, des déficits publics élevés et des tensions géopolitiques. Nous serions actuellement dans une phase de déclin de ce cycle, avec un ordre mondial en transition. Pour protéger leur patrimoine, il conseille aux investisseurs de diversifier leurs actifs (actions, obligations, or, immobilier) plutôt que de détenir uniquement des liquidités. Il mentionne détenir environ 1% de Bitcoin, mais préfère l'or physique pour sa stabilité. Concernant l'IA, Dalio souligne qu'elle remplacera progressivement le travail intellectuel humain, creusant les inégalités. L'avenir appartiendra à ceux qui sauront allier intelligence humaine et collaboration avec l'IA. Enfin, il évoque un monde de plus en plus régionalisé, avec un affaiblissement de la puissance américaine, visible dans des conflits comme celui avec l'Iran, et la montée en puissance d'autres pôles, notamment la Chine.

marsbitIl y a 22 mins

Dialogue avec Ray Dalio : Nous sommes actuellement dans une bulle de l'IA, 1% de mon portefeuille est en Bitcoin

marsbitIl y a 22 mins

7,2 billions de KRW en une journée, les achats nets des investisseurs étrangers atteignent un record historique ce vendredi ! Wall Street : Les vents contraires sur les flux de capitaux sud-coréens se sont dissipés

Les marchés boursiers sud-coréens montrent des signes tangibles d'amélioration des flux de capitaux. Le 31 juillet, les investisseurs étrangers ont réalisé un achat net record de 7 200 milliards de wons sur une seule journée dans le KOSPI, marquant un renversement de la tendance de sorties massives observée ces derniers mois. En juillet, leurs ventes nettes mensuelles se sont fortement réduites à 9 800 milliards de wons, contre 48 400 et 44 500 milliards en juin et mai respectivement. Parallèlement, les institutions domestiques comme les fonds de pension ont inversé leur tendance, passant à un achat net de 1 000 milliards de wons en juillet. La Commission des services financiers a également resserré l'accès aux ETF à effet de levier sur actions individuelles pour les investisseurs de détail, réduisant ainsi la volatilité du marché. Citigroup Research maintient son objectif pour le KOSPI à 10 000 points, estimant que les vents contraires liés aux flux de capitaux s'atténuent. Des facteurs tels que les fondamentaux solides du secteur des puces mémoire, les faibles valorisations du marché, une économie robuste et un environnement politique favorable devraient soutenir le marché. La possibilité d'interventions des autorités pour stabiliser le marché offre également un filet de sécurité.

marsbitIl y a 23 mins

7,2 billions de KRW en une journée, les achats nets des investisseurs étrangers atteignent un record historique ce vendredi ! Wall Street : Les vents contraires sur les flux de capitaux sud-coréens se sont dissipés

marsbitIl y a 23 mins

Choc ! La prochaine IA d'OpenAI résout 10 problèmes du calibre de la Médaille Fields

**OpenAI provoque un séisme mathématique avec son nouveau modèle Astra** OpenAI a dévoilé des avancées mathématiques majeures réalisées par son modèle interne Astra, présenté par Sam Altman. L'IA aurait résolu ou fait progresser dix problèmes complexes dans des domaines variés comme la géométrie haute dimension, la théorie des groupes et la complexité quantique. Le résultat le plus marquant est la construction du premier groupe "non sofic" infini et finiment présenté, réfutant une conjecture de Mikhail Gromov vieille de 27 ans. Cette seule découverte est qualifiée de niveau "Prix Fields". Astra a également amélioré une borne fondamentale sur le problème de l'empilement des sphères en haute dimension, stagnant depuis 1978, et a réfuté la conjecture de rigidité d'Alain Connes en construisant une infinité de groupes non isomorphes partageant la même algèbre de von Neumann. Ces résultats, compilés dans un document de 249 pages, sont accompagnés de preuves formelles vérifiées par l'assistant Lean 4. OpenAI précise que le coût total de génération de ces démonstrations aurait été inférieur à 2000 dollars. La communauté mathématique réagit avec stupeur, certains experts y voyant un tournant historique où l'IA démontre une intuition et une capacité de raisonnement pouvant surpasser les meilleurs mathématiciens humains.

marsbitIl y a 2 h

Choc ! La prochaine IA d'OpenAI résout 10 problèmes du calibre de la Médaille Fields

marsbitIl y a 2 h

Grâce aux lancers de dés, les clés Bitcoin sont stockées hors ligne, mais tout le monde ne s'y mettra pas

Le titre « Les clés Bitcoin protégées par des dés, mais la méthode reste marginale » introduit un article sur la génération manuelle de graines de portefeuille Bitcoin à l'aide de dés. L'article explique le concept d'entropie, illustré par Claude Shannon, où un dé à six faces génère environ 2,585 bits d'incertitude. Il aborde le scandale récent de Coldcard, où une vulnérabilité du générateur de nombres aléatoires matériel a compromis des fonds. Les utilisateurs ayant généré leur phrase de récupération avec des dés (environ 99 lancers pour une haute sécurité) n'étaient pas affectés pour leur seed principal. Cependant, l'analyse du chercheur Kevin Loaec montre que d'autres fonctions du portefeuille (clés de copie, portefeuilles papier, mots de passe, etc.) utilisaient ce générateur défectueux et restaient vulnérables. L'article souligne les défis pratiques de la méthode des dés : elle est longue, sujette aux erreurs de saisie, et peu adaptée aux nouveaux utilisateurs qui pourraient mal l'exécuter. Il conclut que si cette méthode manuelle est robuste pour les experts, l'objectif à long terme est d'avoir un matériel et des logiciels générant une entropie fiable de manière simple et sécurisée. Il conseille aux propriétaires de Coldcard de vérifier leur firmware et les fonctions utilisées, et rappelle l'intérêt des solutions multi-signatures avec différents fabricants pour limiter les risques.

cryptonews.ruIl y a 5 h

Grâce aux lancers de dés, les clés Bitcoin sont stockées hors ligne, mais tout le monde ne s'y mettra pas

cryptonews.ruIl y a 5 h

Trading

Spot
活动图片