节点文献

开源人工智能训练数据的合规治理

  • 推荐 CAJ下载
  • PDF下载
  • 不支持迅雷等下载工具,请取消加速工具后下载。

【作者】 张平

【机构】 北京大学法学院

【摘要】 开源大模型的蓬勃发展,正在重塑全球人工智能竞争格局。产业界对“开源”存在两种误读:或视其为数据无版权保护,或认为算法开源必然要求训练数据同步公开。事实上,开源是基于许可证的有条件授权,算法开源与数据开放是两个相互独立的法律维度。当前,开源人工智能训练数据利用,从获取、处理到输出的全链条,面临授权缺失、个人信息保护失范、版权归责不清等风险,且不同性质数据合规要求各异。推动开源训练数据合规治理,需在完善授权契约、强化数据分类管理、部署技术防线、建设公共合规语料库等方面协同发力,为中国开源人工智能产业的可持续发展筑牢法治根基。

【基金】 中国法学会2025年度部级法学研究重点委托课题“人工智能风险挑战及法律治理”(项目编号:CLS(2025)ZDWT51);最高人民法院2025年度司法研究重点资助课题“开源技术知识产权法律问题研究”(项目编号:GFZDKT2025B18-3)阶段性研究成果
  • 【文献出处】 人民论坛 ,People’s Tribune , 编辑部邮箱 ,2026年06期
  • 【分类号】D922.16;TP18
  • 【下载频次】216
节点文献中: 

本文链接的文献网络图示:

本文的引文网络