新上线今天0 投票
微软称几乎无人通过其聊天机器人获取《纽约时报》文章
在针对新闻出版商和图书作者提起的版权诉讼中,微软提交了新的法律文件,辩称其AI助手Copilot很少逐句复制新闻文章或书籍内容,更不用说能替代原文的大段文字。微软称,在诉讼发现阶段,其提供了820万条Copilot聊天日志给新闻出版商聘请的专家,这些日志是特意挑选的,因为它们触及了可能涉及新闻网站的关键词,因此最可能包含新闻作品。分析结果显示,其中仅有59,545条日志包含至少16个与用于训练AI模型的新闻内容相同的词。记者非营利组织“调查报道中心”的专家发现,数据集中有51处与CIR作品“实质性重叠”的实例。同样,在作者诉讼中,专家发现820万条与Copilot的对话中,仅有24条回复包含至少30个匹配词,且被评估的212本书中只有10本存在任何匹配。微软认为,这些数据支持其立场:将受版权保护的内容用于AI训练数据集应被视为合理使用。微软表示,尽管Copilot依赖受版权保护的材料,但其生成的系统用途与原始内容有显著不同。然而,《纽约时报》不同意微软的结论,其首席律师Ian Crosby在声明中表示:“发现过程中揭露的文件和证词只导向一个结论:微软和OpenAI窃取了《纽约时报》的内容,制造了替代其新闻产品的商业产品,威胁其业务并破坏其行业。”CIR和作者协会未立即回应置评请求。
