返回 文章 学习 CMS 文章

OpenAI 与微软内部文件承认:AI 抓取正在为网络开启“末日循环”

解封法庭文件揭示:OpenAI 和微软内部深知 AI 抓取正在制造一个损害网络与自身产品的“末日循环”。

OpenAI微软AI 版权末日循环
成长分 / 100 68 综合收获、行动、留存与影响

OpenAI 与微软内部文件承认:AI 抓取正在为网络开启“末日循环”
为什么值得读首次通过解封法庭文件看到 OpenAI 和微软内部对 AI 抓取行为的自我认知与警告。

理解 AI 摘要如何冲击出版商推荐流量,以及“Google Zero”为何成为现实。

关键洞察
  1. 微软内部文件承认 AI 内容战略已开启“末日循环”,终端产品威胁其关键供应商的经济基础。
  2. 微软高管布伦特·赫克特将数据采集称为“人类历史上最大的劳动盗窃”,并称合理使用辩护是对该理念的嘲弄。
  3. 萨提亚·纳德拉承认聊天机器人已基本取代搜索,消除了直接前往信息源头获取信息的需求。
转成行动

深入阅读

正文与原文对照

原文保真覆盖:全文原文字符:6786

最近,在《纽约时报》起诉 OpenAI 和微软一案解封的法庭文件相当具有杀伤力。这些公司自己的文件警告说,它正在开启一个会损害网络的“末日循环”,将其抓取数据以训练模型的行为描述为“人类历史上最大的劳动盗窃”,并称这“完全是对合理使用理念的嘲弄”。

OpenAI 和微软知道他们正在为网络开启一个“末日循环”

这些公司知道他们正在把我们推向 Google Zero,却还是这么做了。

这些公司知道他们正在把我们推向 Google Zero,却还是这么做了。

STKS534_AI_DOOMSDAY2_B

STKS534_AI_DOOMSDAY2_B

文件中许多最引人注目的引语来自微软应用科学总监布伦特·赫克特。不过,该公司试图与赫克特的断言保持距离。微软发言人亚历克斯·豪雷克告诉 The Verge:“这些评论反映了一名员工的个人观点,不是法律分析,也不代表公司的观点。”

在另一份法庭文件中,微软 AI 数据战略与运营总经理乔丹·乌斯丹将赫克特的角色描述为对立性质。他说,赫克特“对 AI 数据生态系统应如何运作持有分歧性的、学术性的和前瞻性的观点,并受雇于微软以带来不对称的、未来主义的和学术性的观点……他也不是就 AI 对内容创作者潜在影响的理论观点代表微软发言的人。”

但无论微软是否愿意承认这些评论,很明显这一切都成真了Google Zero 是真的! AI 正在吞噬网络!

在*《纽约时报》*的这份文件中,还有大量来自各色人物的惊人言论,包括萨提亚·纳德拉、萨姆·奥尔特曼和其他 OpenAI 员工。以下是这份 92 页文件中的一些亮点。

“一场惊人的盗窃”

引言部分引用了赫克特和 OpenAI 的 ChatGPT 负责人(推测是尼克·特利)的话,似乎表明这些公司知道他们对*《纽约时报》*这样的出版商构成了“生存威胁”。赫克特称 ChatGPT 和 Copilot 的数据采集是“人类历史上最大的劳动盗窃”,并称微软的辩护“完全是对‘合理使用’理念的嘲弄”。

这是一个“末日循环”

萨提亚·纳德拉承认,聊天机器人基本上已经取代了搜索,并消除了直接前往信息源头获取信息的需求。但或许更具杀伤力的是一份微软内部文件,其中写道:“我们的 AI 内容战略已经开启了一个‘末日循环’,它将同时损害我们模型的性能和整个网络:一个终端产品威胁其关键供应商的经济基础,这是极不寻常的,但这正是我们为我们的 LLM 业务在其‘内容供应链’方面所创造的局面。”

那甚至都不是一个真实的数字

不要被 OpenAI 或微软所宣称的无私意图所蒙蔽。OpenAI 联合创始人格雷格·布罗克曼更感兴趣的是他可能通过商业 AI 赚取的“天文数字”般的美元。

付费墙算什么

尽管纳德拉后来被引述说:“任何付费墙内容都应获得许可,”但一位 OpenAI 代表承认,他“不知道”有任何努力去检测或从训练数据中移除付费墙内容。

“极其擅长复述”

在内部,OpenAI 似乎很清楚 ChatGPT 倾向于直接“逐字”复制受版权保护的材料。尽管它承认“防止记忆”对于“最小化版权侵权”很重要,但员工们承认 GPT-4“记忆了大量数据,因此将极其擅长复述。”

该文件接着列举了几个例子,说明 ChatGPT 在回应查询时,直接输出了来自《纽约时报》、《水星报》、《丹佛邮报》、《LifeHacker》和《Eurogamer》文章中大段大段的复制内容。

“‘吸走’他们的所有作品”

微软知道其大规模抓取互联网的行为会被如何看待,并承认“几乎没有人希望他们[原文如此]创作的内容被以这种方式使用,他们也没有因此获得补偿。”

“人类劳动的替代品”

OpenAI 政策主管杰克·克拉克看到了不祥之兆,他说这“正在创造替代定义社会‘文化’的人们的劳动的系统。”内部文件将 ChatGPT 描述为“现代报摊”。OpenAI 的尼克·特利后来被引述说,一旦你从其聊天机器人那里得到答案,就“没有充分理由去点击”指向来源的链接。

摧毁自己的供应链

微软被引述承认,“大语言模型是一种会摧毁自身供应链的产品”,因为在许多情况下,它是自身训练数据的替代品。

OpenAI 知道自己在扼杀推荐流量

OpenAI 自己的媒体和经济专家将《纽约时报》等网站推荐流量的下降直接归因于谷歌 AI 概览等 AI 摘要。他们推测,搜索推荐流量可能下降了多达 60%。

微软发言人豪雷克警告说:“萨提亚的证词和微软在本案中的立场完全一致。他谈的是广泛的原则以及人们查找和消费信息方式正在发生的变化。这些观察不应与法院面前的版权问题结论相混淆,微软在其文件中已对此进行了阐述。”

但根据这份新解封的文件,似乎很清楚的是,微软和 OpenAI 都知道他们将不可挽回地损害出版业、其雇用的“数百万人”,并进而损害自己的产品,但为了追求“天文数字”般的美元,他们还是继续推进——诅咒末日循环也罢。

关注话题和作者,从这篇报道中查看更多类似内容,出现在您的个性化主页信息流中,并接收电子邮件更新。

最受欢迎

  • Apple Watch Series 12 是可穿戴设备新时代的开端
  • 2.5 小时 AI 生成的《奥德赛》电影长了 2.5 小时
  • iPhone 18 Pro 的重大相机更新全在于微小改进
  • OpenAI 和微软知道他们正在为网络开启一个“末日循环”
  • 深入突然火爆的 AI 安全世界