纽约时报指控微软为OpenAI搭建侵权超级计算机
纽约时报周一向法院提交了一份新的诉讼材料,指控微软专门为OpenAI建造了一台超级计算机集群,用于抓取和使用《纽约时报》的新闻内容。这份指控把科技巨头之间的版权纠纷推向了新的层面,不再只是关于训练数据的使用,而是关于基础设施层面的直接协助。
根据诉讼材料,微软在2023年至2025年间,专门采购了超过十万颗GPU,部署在弗吉尼亚州的专用数据中心。这些服务器的主要用途是为OpenAI的聊天机器人提供推理服务,而聊天机器人的训练数据中包含大量未经授权的《纽约时报》文章全文。
纽约时报的律师在文件中指出,微软的行为违反了联邦最高法院在索尼案中确立的合理使用原则。索尼案的判决保护了游戏公司的训练行为,但该案中的训练数据主要来自公开可用的网络内容,而不是像《纽约时报》这样有明确版权声明的商业出版物。
OpenAI的回应相对克制。公司在一份声明中表示,AI系统的训练数据来源于公开信息,符合公平使用原则。公司同时指出,其聊天机器人生成的内容与原始文章有显著区别,不会直接复制原文内容。
微软的态度更加强硬。公司发言人表示,AI技术的进步依赖于对公开信息的合理使用,如果每个使用公开信息的技术公司都要获得版权方的许可,那么整个行业都无法运转。微软同时暗示,它可能不会在这场诉讼中配合《纽约时报》,而是坚持自己的法律立场。
这场诉讼的特殊之处在于,它涉及的不只是内容使用,还有基础设施提供者的责任。如果法院认定微软需要为其提供的计算资源承担连带责任,那将改变整个AI行业的商业模式。微软每年在AI基础设施上的投入已经超过200亿美元。
诉讼也提出了一个有趣的问题:如果一家公司为特定客户定制了超级计算机,而该客户用这台机器做侵权的事情,定制者是否应该承担责任。这在法律上是一个全新的领域,目前没有明确的判例可以参考。
无论最终判决如何,这场诉讼都会对美国AI行业的版权合规产生深远影响。所有大型AI公司都需要重新审视自己的数据来源和基础设施使用方式。
合理使用原则在美国版权法中已经存在了几十年,但人工智能训练的合理性边界在哪里,至今没有明确的司法认定。联邦最高法院在索尼案中的判决虽然有利于AI公司,但该案的具体事实与新闻作品的版权情况并不完全相同。下级法院需要在具体案件中逐步细化规则。