微软备忘录浮出水面,OpenAI新闻训练争议升级

微软备忘录浮出水面,OpenAI新闻训练争议升级

By: WEEX|2026/09/18 13:53:30

WEEX观察

  1. 下一个关键变量在于,案件将取决于一般性的合理使用论点,还是取决于付费墙内容、数据来源,以及为某一目的获取的内容后来是否被重新用于模型训练等更狭窄的问题。
  2. 市场还应关注,法院披露的信息是否会促使更多出版商转向许可协议或诉讼。新闻内容是最难为训练数据用途辩护的类别之一,因为其具有商业许可市场,并且可能直接替代原始产品。
  3. 任何显示再训练权利、数据集限制或同意边界可能具有可执行性的迹象,都将对本案之外产生影响,尤其会影响依赖第三方数据管线和企业合作伙伴关系的AI公司。

《纽约时报》起诉OpenAI和微软的法庭文件显示,微软内部曾讨论使用新闻文章训练AI模型是否构成对创意劳动的大规模不当挪用;而两家公司继续主张,涉案训练受到合理使用原则保护。

新披露的材料包括微软应用科学总监布伦特·赫克特于2023年撰写的一份备忘录。该备忘录将大型AI模型形容为“摧毁自身供应链的产品”,并警告称,许多人认为这些系统以前所未有的方式挪用了他们的工作。法庭文件还援引他的话称,未经许可复制数百万篇新闻文章是“人类历史上最大规模的劳动盗窃”。

微软表示,这些备忘录反映了赫克特试图提供“不同且不对称的视角”,并不代表公司的官方立场。这一区别很重要,因为案件的核心并非一场由员工公开发起的活动,而是原告用以证明两家公司了解基于出版商内容进行训练所涉法律和商业敏感性的内部通信。

根据法庭文件,微软首席执行官萨提亚·纳德拉作证称,受付费墙保护的内容只能在获得权利持有人授权后使用。他还表示,如果事先知道OpenAI正在使用付费内容进行训练,他会行使微软的权利,要求对模型重新训练。另有法庭材料援引一名OpenAI员工在发给总裁格雷格·布罗克曼的消息中提及绕过《纽约时报》付费墙的“黑客方法”,布罗克曼回复道:“不错。”

OpenAI和微软均坚持认为,相关模型训练符合合理使用条件。这场争议始于《纽约时报》在2023年底提起诉讼,原始报道称此后已有11家出版商加入该案。除法庭披露内容外,可核实的背景资料有限,若干核心细节仍未解决,包括涉案数据集的完整范围,以及法院将如何权衡授权、许可边界和市场损害。

为何重要

此案对两家大型AI公司而言,不仅涉及声誉风险。它触及生成式AI面临的一个核心法律问题:当源材料具有表达性、已获许可且在某些情况下受付费墙保护时,对具有商业价值文本进行训练能否被视为转换性使用。新闻出版是一个尤其敏感的测试领域,因为这类内容存在真实的许可市场,并且AI输出可能与原始产品形成竞争。

这些披露也进一步凸显了更广泛AI基础设施的合规问题。如果法院更重视同意、来源限制,或在不同条款下获取的数据被重新利用,开发者及其合作伙伴可能会面临更严格的训练语料收集、共享和更新控制。

本内容仅供参考,不构成任何金融、投资、法律或税务建议。文中提及的任何活动、奖励、线上活动或相关信息,不应被视为对购买、出售或交易任何加密资产的推荐、招揽或邀请。加密资产具有高波动性,存在价值损失风险。WEEX服务、产品及相关活动的可用性可能因地区而异。用户在参与前有责任确保符合当地适用法律法规。

关于WEEX观察

WEEX观察是WEEX专为加密投资者打造的智能投研资讯板块,深度聚合Web3、AI与全球宏观财经前沿动态,以独特视角输出独立研报与深度洞察,助力用户快人一步捕捉市场趋势与交易先机。

iconiconiconiconiconicon
客户服务:@weikecs
商务合作:@weikecs
量化做市商合作:[email protected]