节点文献
开源人工智能训练数据的合规治理
【摘要】 开源大模型的蓬勃发展,正在重塑全球人工智能竞争格局。产业界对“开源”存在两种误读:或视其为数据无版权保护,或认为算法开源必然要求训练数据同步公开。事实上,开源是基于许可证的有条件授权,算法开源与数据开放是两个相互独立的法律维度。当前,开源人工智能训练数据利用,从获取、处理到输出的全链条,面临授权缺失、个人信息保护失范、版权归责不清等风险,且不同性质数据合规要求各异。推动开源训练数据合规治理,需在完善授权契约、强化数据分类管理、部署技术防线、建设公共合规语料库等方面协同发力,为中国开源人工智能产业的可持续发展筑牢法治根基。
【基金】 中国法学会2025年度部级法学研究重点委托课题“人工智能风险挑战及法律治理”(项目编号:CLS(2025)ZDWT51);最高人民法院2025年度司法研究重点资助课题“开源技术知识产权法律问题研究”(项目编号:GFZDKT2025B18-3)阶段性研究成果
- 【文献出处】 人民论坛 ,People’s Tribune , 编辑部邮箱 ,2026年06期
- 【分类号】D922.16;TP18
- 【下载频次】216