微软称Copilot很少复现《纽约时报》文本——The Verge
微软表示,其聊天机器人Copilot仅偶尔复现《纽约时报》、其他媒体和书籍材料中的完整句子或重要片段。The Verge报道,该公司在出版商和作者针对微软及OpenAI提起的版权侵权诉讼的法庭文件中引用了这些数据。
对820万次对话的分析
作为证据开示的一部分,微软向受新闻出版商聘请的专家提供了820万份Copilot对话日志。微软称,这些记录是根据与使用原告新闻机构网站相关的关键词专门筛选的,因此这一样本最有可能包含他们的作品。
微软的数据显示,59,545份记录包含至少16个与作为该AI模型基础的新闻内容相同的词。这不到全部820万份记录的1%。微软称,调查报道中心的一名专家在样本中发现了51例与该组织材料“实质性匹配”的情况。
更多最新消息请关注 UA.News Telegram 频道 Telegram.
公司在争议中的立场
微软表示,在涉及书籍的诉讼中,受作者一方聘请的专家发现了24条Copilot回复,其中至少有30个词与文本相符。该公司还表示,仅在212本接受评估的书籍中有10本发现了匹配内容。
微软认为,这些结果支持其关于将受版权保护的材料用于训练人工智能系统属于合理使用的论点。该公司认为,Copilot及类似系统使用此类内容的目的与原始出版物有实质性差异。按照微软的立场,偶发性复现片段并不否定训练大型语言模型的转换性特征。
出版商和作者称,微软和OpenAI基于他们的作品创建了产品,如今又与他们直接竞争,包括复现受保护的内容。为简化程序,新闻出版商和图书作者的诉讼被移交给同一名法官审理。微软请求法院作出简易判决,这可能会在早期阶段结束案件。《纽约时报》、调查报道中心和Authors Guild未立即就公司的声明发表评论。