据《纽约时报》周四公布的法庭文件显示,微软员工讨论了 OpenAI 对新闻文章的使用是否构成“人类历史上最大的劳动力盗窃”,并可能引发“末日循环”,从而降低他们正在构建的模型的性能。
这些文件来自《纽约时报》于 2023 年底对两家公司提起的诉讼,此后其他 11 家出版商也加入了诉讼。 OpenAI 自始至终对这些说法提出异议,该案件已迫使其保存 2000 万条 ChatGPT 对话日志。纽约南区法官西德尼·斯坦因正在考虑简易判决动议,文件也正在与他一起启封。

微软 2023 年的一份内部文件称:“世界各地数以百万计的人很快就会认为大型模型‘吸走’他们的所有作品是一次规模空前的令人震惊的盗窃行为。”这位作者写道,大型人工智能模型“是一种破坏其供应链的产品”。
微软表示,这些备忘录是由西北大学应用科学总监布伦特·赫克特(Brent Hecht)撰写的,并不代表公司观点。该公司在一份文件中称,他不是决策者,受雇“提出不同和不对称的观点”。
“在地毯上留下一团糟”
微软首席执行官萨蒂亚·纳德拉 (Satya Nadella) 作证说,“任何付费内容都应该由任何想要使用它的人获得许可”,并表示,如果他知道 OpenAI 正在对付费内容进行培训,他就会行使微软要求其重新训练模型的权利。一位发言人表示,他就人们如何查找和消费信息“谈到了广泛的原则”。
在 OpenAI,一名工作人员向总裁格雷格·布罗克曼 (Greg Brockman) 讲述了如何构建“黑客”来绕过《纽约时报》付费墙的事情。布罗克曼回答道:“啊,很好。”
ChatGPT 团队的负责人 Nick Turley 在 2023 年 6 月写道,人工智能对出版商构成了“生存威胁”,而在 2024 年 2 月,人工智能产品“随着它们变得更好,将变得越来越具有替代性”。他在其他地方写道,人工智能“产品在很大程度上是替代性的”。
一位 OpenAI 工程师在 2023 年 2 月写道,“无论我们如何显着地显示链接,用户都不会点击”,这一发现驳斥了聊天机器人将流量发送回出版商的论点。
在 2020 年写给布罗克曼和萨姆·奥尔特曼的备忘录中,时任政策总监杰克·克拉克 (Jack Clark) 警告称,该公司正在“创建能够替代定义社会‘文化’的人们劳动的系统”,并将“成为硅谷轻率地涉足生活其他领域并留下一团糟的象征。”克拉克离职后与人共同创立了 Anthropic,该公司将《纽约时报》的置评请求转给了 OpenAI。
微软和 OpenAI 都认为培训是合理使用,将文章转化为新作品,而不是取代原来的作品。代表《纽约每日新闻》和其他七家报纸的史蒂文·利伯曼 (Steven Lieberman) 表示:“全世界都可以看到 OpenAI 和微软对于自身行为公平性的看法。”
该案的原告《泰晤士报》拒绝对其记者发表评论,并表示 OpenAI 没有回应置评请求。