快速了解本文
微软与OpenAI高管曾私下称AI训练为“盗窃”
内部文件显示Copilot导致纽约时报流量暴跌93%
OpenAI高管承认知晓绕过付费墙的方法
本摘要由 AI 辅助整理,请以正文内容为准。
“人类历史上最大的劳动力盗窃”、“末日循环”。在《纽约时报》诉微软与OpenAI的版权诉讼中,最新解密的内部文件显示,这两家AI巨头的高管曾私下使用此类极端词汇,形容其AI模型训练的数据抓取行为。这些披露揭示了企业内部认知与公开合规叙事之间的强烈反差。
根据《纽约时报》法律简报中未删节的文件,诉讼指控微软和OpenAI在未被发现的情况下抓取付费墙内容,以建立庞大的训练数据集。文件指出,这些内容在输入模型前被故意剥离了版权声明。诉讼文件声称,OpenAI的训练数据集中包含超过91,000份《纽约时报》、《每日新闻》及调查报道中心的材料副本。
关键数据
微软应用科学总监Brent Hecht在内部文件中详细记录了AI训练对传统媒体流量的实质性破坏。他指出,Copilot推出后,《纽约时报》内容的点击流量暴跌高达93%。Hecht将这一现象称为威胁底层内容供应链的“末日循环”,并直言该抓取行为是“人类历史上最大的劳动力盗窃”。这种内部预警与两家公司公开强调的“合理使用”及合规叙事形成了鲜明对比,凸显了AI训练数据获取在商业利益与版权道德间的深层矛盾。不过,这些内部言论的最终法律定性仍需法庭裁决。
人类历史上最大的劳动力盗窃
OpenAI高管的内部沟通同样暴露了对侵权行为的知情。ChatGPT负责人Nick Turley在内部承认,该产品正日益成为出版商内容的替代品;总裁Greg Brockman则承认知晓绕过《纽约时报》付费墙的方法。这些记录直接证明OpenAI高管明知付费墙的存在及绕过途径,削弱了其“无意侵权”的辩护空间。与此同时,微软CEO萨蒂亚·纳德拉在法庭作证时采取了不同的合规姿态。他表示,付费内容在用于训练前必须获得授权,并称若事先知晓涉及付费内容,他会要求OpenAI重新训练模型。这种高层的事后表态与执行层面的“盗窃”认知形成对比,其内部对抓取付费内容的法律风险和供应链反噬的察觉,可能在诉讼中对“合理使用”的抗辩造成实质性打击,尽管法庭的最终判定还取决于转换性使用等其他法律要件。
针对上述解密文件的披露,微软和OpenAI目前均未作出公开回应。

