GitHub宣布4月24日起默认使用Copilot用户数据训练AI模型

marsbit发布于2026-03-26更新于2026-03-26

文章摘要

GitHub宣布自2026年4月24日起更新政策,将默认使用Copilot Free、Pro及Pro+用户的交互数据训练AI模型,涵盖代码片段、上下文信息、仓库结构及聊天记录等。用户需手动在隐私设置中关闭该选项才能退出数据收集。GitHub称此举旨在提升模型建议的准确性和安全性,并符合行业惯例。Copilot Business、Enterprise及教育版用户暂不受影响。这一政策引发开发者对私有代码数据边界和确权问题的讨论,反映行业在公域代码枯竭背景下转向挖掘私有数据以优化模型性能的趋势,标志着平台向AI训练生态的进一步转型。

GitHub近日宣布将从2026年4月24日起更新其代码库政策,计划利用用户交互数据训练其AI模型。 此次数据采集范围涵盖Copilot Free、Pro及Pro+用户,具体包含模型输入输出、代码片段、上下文信息、仓库结构及聊天交互记录。

GitHub首席产品官Mario Rodriguez表示,引入交互数据旨在提升模型的代码建议准确率与安全性,并称微软内部数据的预先测试已显著提高了建议接受率。值得注意的是,该政策采取“预设加入”机制,受影响用户需手动进入隐私设置关闭相关选项方可退出,这引发了开发者社区关于私有仓库定义及数据确权的广泛讨论。

目前,受合同条款约束的Copilot Business、Enterprise用户以及教育版用户暂不受此变更影响。GitHub在说明中强调,此举符合Anthropic、JetBrains及微软等大厂通行的行业惯例。然而,将私有仓库代码纳入训练集实质上挑战了传统“私有”概念的边界,即便GitHub声称其目的是优化开发工作流。

从行业视角看,随着高质量公域代码数据趋于枯竭,头部AI厂商正加速转向挖掘私有交互数据等“深层数据”以寻求模型性能红利。这一政策转变不仅标志着GitHub从开源托管平台向闭环AI训练生态的进一步倾斜,也预示着AI开发者工具领域正进入数据合规与模型演进博弈的新阶段。

相关问答

QGitHub将从何时开始默认使用Copilot用户数据训练AI模型?

AGitHub将从2026年4月24日起更新政策,默认使用Copilot用户数据训练AI模型。

Q哪些Copilot用户的数据会被用于训练AI模型?

A数据采集范围涵盖Copilot Free、Pro及Pro+用户,包括他们的模型输入输出、代码片段、上下文信息、仓库结构及聊天交互记录。

Q用户如何退出GitHub的数据采集计划?

A该政策采取“预设加入”机制,受影响用户需要手动进入隐私设置关闭相关选项才能退出数据采集。

Q哪些类型的用户暂时不受此次数据政策变更的影响?

A受合同条款约束的Copilot Business、Enterprise用户以及教育版用户暂不受此变更影响。

QGitHub声称使用用户数据训练AI模型的主要目的是什么?

AGitHub声称引入用户交互数据旨在提升AI模型的代码建议准确率与安全性,并优化开发工作流。

你可能也喜欢

交易

现货
合约
活动图片