日本内阁府发布生成式AI指导方针草案,要求披露训练数据
8月18日,日本内阁府公布了一份面向生成式AI开发者的指导方针草案。草案提出,开发者在构建和训练AI模型时,应说明训练数据的来源以及数据收集方式,以此提高数据使用环节的透明度。
这份草案并不具有法律约束力,主要作为开发者行为参考。草案希望建立一个兼顾技术创新与版权保护的框架,既让生成式AI开发者能够合理使用相关知识产权,也能减少对创作者权益的损害。同时,草案明确建议开发者不要从盗版网站收集训练数据。
在版权内容方面,草案鼓励开发者披露训练数据集中是否包含受版权保护的材料,例如漫画、音乐和电影。对于已经使用的训练数据,草案还要求开发者建立内部通知系统,当训练数据集包含与生成内容相似的受版权保护作品时,能够向用户发出提示。











