一、问题的提出
生成式人工智能大模型的开发依赖于海量训练数据,其中包含大量受著作权保护的作品。以DeepSeek V4 Pro为例,其预训练阶段使用了约33万亿Token [1] 。依据现行著作权法,大模型训练对作品的获取和使用(试读)...