纽约时报起诉 OpenAI 与微软的版权案又披露出一批内部材料。根据周四解封的法庭文件,微软员工曾在内部讨论中质疑,OpenAI 使用新闻文章训练模型,是否构成“人类历史上最大规模的劳动剥夺”之一。
2023年备忘录提出警告
文件显示,微软一份 2023 年内部备忘录写道,公众可能会把大模型“吸走”创作者作品视为“前所未有的惊人盗取”。同一作者还警告,这类模型可能会削弱其依赖的内容生产体系。
微软在法庭文件中表示,这些文字出自应用科学总监 Brent Hecht,并不代表公司正式立场。微软称,他并非决策者,其职责之一就是提出不同观点,供内部讨论参考。
纳德拉谈付费内容授权
微软首席执行官萨提亚·纳德拉在证词中表示,任何设有付费墙的内容,只要有人想用于相关用途,就应先取得授权。他还称,如果自己当时知道 OpenAI 使用了付费内容训练模型,微软本可以要求对方重新训练模型。
不过,微软发言人随后表示,纳德拉谈的是更广义的信息获取原则,并非就个别训练材料作出具体认定。
OpenAI内部讨论替代效应
解封材料还显示,OpenAI 内部曾出现更直接的担忧。一名员工曾向总裁 Greg Brockman 提到,做了一个可绕过《纽约时报》付费墙的“hack”,Brockman 回复称“ah nice”。
另有文件显示,负责 ChatGPT 团队的 Nick Turley 在 2023 年 6 月写道,AI 对出版商构成“生存性威胁”;到 2024 年 2 月,他又表示,随着产品能力提升,AI 产品会越来越像原内容的替代品。还有 OpenAI 工程师在 2023 年 2 月写道,无论链接展示得多醒目,用户都不会点击。
案件仍在审理阶段
这批文件来自《纽约时报》于 2023 年底提起的版权诉讼,之后又有 11 家出版商加入。OpenAI 一直否认相关指控,并主张模型训练属于合理使用,认为训练过程是将文章转化为新作品,而不是直接替代原文。
目前,美国纽约南区联邦地区法院法官 Sidney Stein 正在审理双方的简易判决动议,相关文件也在这一过程中陆续解封。案件此前还已要求 OpenAI 保留 2000 万条 ChatGPT 对话记录。











