OpenAI与微软被曝预判“末日循环”:内部文件承认AI训练存在“史上最大盗窃”

在人工智能飞速发展的浪潮中,一场关于版权与生态的激烈博弈正在暗流涌动。近期,随着纽约时报(New York Times)诉 OpenAI 和微软(Microsoft)版权案的庭审文件被部分解封,一系列令人震惊的内部备忘录和邮件被公之于众。这些文件不仅揭示了科技巨头在推动 AI 进步时的隐秘心态,更直接指出了他们正在亲手开启一个名为“末日循环”(doom loop)的恶性循环,这一循环可能彻底摧毁互联网的内容生态。

所谓的“末日循环”,其核心逻辑在于人工智能模型对互联网现有内容的过度依赖。OpenAI 和微软在内部文档中描述了一种场景:AI 模型通过抓取互联网上的新闻文章、博客和论坛内容进行训练,生成高质量的内容摘要和答案。然而,当用户转向使用 ChatGPT 等生成式 AI 工具时,他们不再点击原始新闻网站的链接。这导致网站流量枯竭,广告收入锐减,原创内容创作者失去了维持运营的经济基础。最终,优质内容无人产出,AI 模型因为缺乏高质量数据的喂养而逐渐退化,整个互联网的信息价值因此归零。

更具冲击力的是,这些解封的文件中直接使用了“人类历史上最大的盗窃行为”这一极具攻击性的措辞来形容 AI 公司对数据的抓取行为。这一指控直指 AI 行业的核心痛点——未经授权的大规模数据训练。长期以来,科技巨头通过爬虫技术合法地收集数据用于构建搜索引擎,但在生成式 AI 时代,这种抓取行为被赋予了新的法律和道德含义。OpenAI 和微软在明知可能损害内容生态的情况下,依然选择推进模型训练,这一矛盾心态被文件无情地揭露。

这场诉讼和随之暴露的内部认知,对整个科技行业产生了深远的警示意义。它迫使人们重新审视 AI 的发展路径:技术进步是否必须以牺牲内容创作者的利益为代价?对于新闻媒体而言,这更是一场生存危机。如果 AI 能够完美复述新闻内容,读者为何还要付费订阅或点击广告?这种替代效应不仅威胁到了传统媒体的生存,也可能导致互联网上充斥着同质化、低质量的 AI 生成内容,进而削弱人类知识的积累与传播。

面对这一“末日循环”的预言,行业内的解决方案正在探索中。除了法律层面的版权博弈,技术层面也在寻求突破,例如开发专门用于 AI 训练的高质量合成数据,以及建立更完善的付费数据许可机制。然而,如何在利用 AI 提升效率的同时,保障内容生态的可持续性,将是未来很长一段时间内悬在所有科技巨头头上的达摩克利斯之剑。

OpenAI 和微软虽然嘴上承认了“末日循环”的风险,但实际行动却显示出他们仍在试图打破这一循环的边缘试探。随着纽约时报案件的深入,这场关于数据所有权、技术伦理以及互联网未来的讨论将愈演愈烈,最终的裁决或将重塑全球 AI 产业的规则。

信息来源: The Verge
原文链接: https://www.theverge.com/ai-artificial-intelligence/997633/openai-microsoft-chatgpt-ai-new-york-times-doom-loop-theft-google-zero

信息来源:The Verge,原文链接:https://www.theverge.com/ai-artificial-intelligence/997633/openai-microsoft-chatgpt-ai-new-york-times-doom-loop-theft-google-zero

oaido_ai

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注