微软在与纽约时报的版权诉讼中提交 820 万条 Copilot 对话日志,称其中仅 59,545 条与新闻内容有 16 字以上重合,仅 24 条有 30 字以上重合。微软以此支持"AI 训练属合理使用"主张;纽约时报称证据指向"盗窃"。微软同时申请法院驳回诉讼。
微软在《纽约时报》与出版商针对 AI 版权问题的诉讼中,向法院提交了 820 万条 Copilot 对话日志,作为其申请摘要判决的证据。
这 820 万条日志由新闻出版商聘请的专家提供,并非随机抽样——微软声称,这些日志是专门按"命中新闻原告网站关键词"筛选出来的,是"最有可能包含原告内容"的那部分。
即便如此,分析结果显示:
微软的结论:这些数字表明 Copilot "很少复现完整句子,更不用说可以替代原文的实质性片段"。
微软用这组数字支持一个法律论点:AI 系统使用版权内容进行训练属于"合理使用"(fair use),因为生成的系统被用于与原文根本不同的目的。即使偶尔复现文本片段,也"几乎不影响 LLM 训练的变革性目的"。
《纽约时报》外部诉讼代理律师 Ian Crosby 则持完全相反的立场:"探查期间揭露的文件和证词只导向一个结论:微软和 OpenAI 盗窃了《纽约时报》的内容来构建商业产品,这些产品替代了该报的新闻,威胁了其商业模式,损害了整个行业。"
这场诉讼由《纽约时报》和多家出版商与作者联合发起,指控微软与 OpenAI 将版权内容用于构建 AI 训练数据集,并创建与原告直接竞争的产品。案件中的出版商诉讼和书作者诉讼被合并至同一法官处理。
微软提交本次文件,是在申请法院作出摘要判决(summary judgment)——如果法官同意,案件将在庭审阶段前终止。特朗普政府本周也在纽约时报案中提交了利益声明,支持 OpenAI 方的立场。
法官是否同意摘要判决是最近的关键节点。如果驳回,案件将进入全面庭审阶段,届时将有更多关于 AI 训练数据来源和版权影响的细节被公开。
免费获取企业 AI 成熟度诊断报告,发现转型机会








关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断