资讯2 分钟阅读·
微软以 820 万次对话仅 24 次长段复述主张合理使用,统计出自诉讼一方
微软的低复述统计出自诉讼一方,只衡量输出复述;合理使用成败要等法院对训练、替代、许可市场、损害分别裁定。
微软请求纽约南区联邦法院在审判前判其胜诉,主张用受版权保护的作品训练模型属于合理使用,Copilot 输出具有转换性。动议援引的专家分析显示,820 万次对话里只有 24 个回答与涉案书籍出现至少 30 个连续词的匹配,212 本书中 202 本没有找到这类输出。
这组数字出自诉讼一方对证据的组织。它衡量的是产品是否经常长段复述,不单独回答训练时复制作品是否构成合理使用,也不能当作胜诉概率。新闻出版方看法相反,《纽约时报》律师称取证材料证明产品替代了新闻内容。法院还需分别判断训练用途、输出替代、潜在许可市场和损害。
若法院接受较宽的合理使用标准,模型公司未来训练数据的许可和赔偿压力会下降;若出版方胜诉,数据授权、追溯赔偿和模型治理都会进入成本结构。目前双方只是进入简易判决阶段,后续节点是法院裁定和上诉。