AI 训练数据的终极拷问:微软高管直言大规模抓取堪称“历史最大规模劳动盗窃”

分类:AI动态 标签:人工智能、大模型、版权保护、微软 在人工智能狂飙突进的今天,海量数据的获取一直是各大科技巨头核心竞争力的基石。然而,关于数据抓取的合法性与道德边界,行业内部的争议从未停止。近日,根据曝光的内部文件显示,微软应用科学总监 Brent Hecht 发出惊人警示:抓取新闻内容来训练 AI 模型,可能是人类历史上最大规模的劳动成果盗窃。 这一言论不仅揭开了科技巨头在 AI 数据收集上的内部矛盾,也再次将整个大模型产业推上了舆论的风口浪尖。 内部文件曝光:对“合理使用”理念的嘲弄 长期以来,AI 厂商多以“合理使用”(Fair Use)原则为护城河,大肆抓取互联网上的公开文本、新闻报道和多媒体内容来训练模型。然而,Brent Hecht 在内部文件中直言不讳地指出,这种做法根本算不上真正的合理使用,而是对该理念赤裸裸的嘲弄。 微软的另一份内部文件则进一步警告,这种无节制的数据抓取模式正在形成一条“恶性循环”,最终会双向伤害: 伤害创作者:剥夺了新闻机构和内容创作者应有的经济回报。 伤害模型自身:当优质内容生态遭到破坏、网络信源枯竭后,AI 模型未来的训练质量也将面临无米之炊的困境。 流量断崖式下跌:AI 正在摧毁新闻出版商的经济基础 OpenAI 与微软自身的数据均显示,大模型的崛起对传统网络生态造成了巨大的冲击。以 OpenAI 的 ChatGPT 为代表的生成式 AI 产品,通过直接总结或展示信息,大幅减少了用户点击原新闻网站的需求。 微软内部数据指出: 部分核心新闻出版商网站的点击率遭遇了 83% - 93% 的断崖式下跌。 其他主流新闻机构的流量跌幅也普遍在 51% - 94% 之间。 Hecht 坦言,事实非常残酷:“几乎没有人希望自己创作的心血被这样使用,更没有人因此获得过一分钱的报酬。” 高管表态与内部矛盾:知法犯法还是默许纵容? 在这场关于版权与利益的博弈中,微软高层的态度耐人寻味。 一方面,微软 CEO 萨提亚·纳德拉(Satya Nadella)在公开作证时强调,AI 公司绝对不应该通过绕过付费墙或者违反新闻网站的使用条款来获取数据。 另一方面,与之形成鲜明对比的是 OpenAI 的内部信息。当某位员工兴奋地向总裁格雷格·布罗克曼(Greg Brockman)汇报,称 OpenAI 的爬虫成功找到了绕过《纽约时报》付费墙的技术漏洞时,布罗克曼的回复竟然是:“好极了(Awesome)”。这种对技术漏洞的默许与纵容,彻底撕下了 AI 行业温情脉脉的面纱。 科技新防线:版权、商业化与未来的抉择 从最初的“野蛮生长”到如今的“版权诉讼频发”,AI 行业正行至十字路口。 信任危机:当新闻机构的经济根基被 AI 蚕食,优质内容的产出将难以为继。 合规转型:未来,AI 厂商若想持续获得高质量训练数据,必须逐步转向正规授权合作(如付费订阅、内容共建生态),而非依赖灰色抓取。 如何平衡技术创新的速度与创作者的合法权益,将是整个人工智能产业在下一阶段必须直面的终极拷问。

September 19, 2026

微软内部文件曝光:高管直言 AI 抓取训练数据是人类史上最大规模劳动盗窃

分类:AI动态 标签:人工智能、大模型、科技伦理、版权保护 在人工智能狂飙突进的今天,关于数据抓取与版权保护的争议从未停歇。近日,一份曝光的微软内部文件将这一矛盾推向了风口浪尖。微软应用科学总监 Brent Hecht 在文件中直言不讳地警告称,未经授权抓取新闻内容来训练 AI 模型,是一次规模空前的盗窃行为,堪称人类历史上最大规模的劳动成果盗窃。 内部文件揭露:AI 训练与版权保护的不可调和 长期以来,科技巨头们一直援引“合理使用(Fair Use)”原则,为其大规模抓取互联网公开数据训练大模型的行为进行辩护。然而,Brent Hecht 并不认同这一观点。他认为,这种做法完全是对“合理使用”理念的公开嘲弄。 除了对数据来源的道德性质疑,微软的另一份内部文件还指出了这种模式引发的“恶性循环”: 伤害网络生态:AI 直接抓取并总结内容,导致用户无需访问原始网站。 打击新闻出版商:微软自身的数据显示,部分新闻出版商网站的点击率大幅下降 83% 到 93%,其他多数机构的点击率也暴跌 51% 到 94%。 反噬模型本身:优质内容生产者失去经济支撑后,整个 Web 的内容生态将走向枯竭,最终无高质量数据可供模型学习。 Hecht 坦言,现实情况是“几乎没有人希望自己创作的内容被以这种方式使用,也没有人因此获得合理的报酬”。 巨头内部的分歧与矛盾 这场关于数据的争夺战,不仅存在于科技公司与媒体之间,在企业内部甚至行业领袖之间也暴露出微妙的分歧。 微软 CEO 萨蒂亚·纳德拉(Satya Nadella)此前在作证时曾表示,AI 公司不应该通过绕过付费墙或违反新闻网站的使用条款来获取数据。然而,与此形成鲜明对比的是,OpenAI 的内部沟通记录显示出截然不同的态度。当曾有员工向 OpenAI 总裁格雷格·布洛克曼(Greg Brockman)汇报,称公司的网络爬虫发现了绕过《纽约时报》付费墙的漏洞时,布洛克曼的反应竟然是“好极了”。 这种言行背后的反差,无疑加剧了外界对 AI 头部企业合规底线的担忧。随着 ChatGPT 等生成式 AI 产品持续对新闻出版商的经济基础造成实质性威胁,如何平衡技术创新与知识产权保护,已经成为摆在整个科技行业面前一道无法回避的必答题。

September 19, 2026

内部文件曝光:微软高管直言 AI 训练数据抓取是“史上最大规模劳动盗窃”

分类:AI动态 标签:人工智能、大模型、OpenAI、微软 在人工智能狂飙突进的今天,关于训练数据版权与合法性的争议从未停歇。近日,外媒曝光的一批微软内部文件将这一矛盾彻底撕开。微软应用科学总监 Brent Hecht 在内部直言不讳地警告称,大模型厂商无限制地抓取新闻内容来训练 AI,本质上是一次“规模空前的盗窃”,堪称人类历史上最大规模的劳动成果盗窃。 内部文件揭露:AI 正在摧毁网络生态 长期以来,科技巨头们多以“合理使用(Fair Use)”作为大规模抓取公开数据的法律护城河。然而,Brent Hecht 明确表示,这种做法完全是对合理使用理念的公开嘲弄。 除了对创作者权益的侵害,微软的另一份内部文件还指出了更深层的危机——这将形成一个不可逆的“恶性循环”,最终既伤害了依赖高质量内容的 AI 模型本身,也摧毁了整个 Web 互联网生态: 流量断崖式下跌:微软的内部数据显示,部分新闻出版商网站的搜索与外链点击率暴跌了 83% 到 93%,其他多数新闻机构的点击率也大幅下滑 51% 到 94%。 经济基础崩塌:以 ChatGPT 为代表的 AI 产品正在通过直接提供信息摘要,夺走用户的访问意愿,进而危及新闻出版商赖以生存的广告和订阅经济。 Hecht 坦言,残酷的现实是:“几乎没有人希望自己创作的内容被以这种方式使用,也没有人因此获得合理的报酬。” 高层表态与现实操作的分裂 面对舆论压力,科技巨头在公开场合与私下决策中展现出了微妙的反差。 微软 CEO 萨蒂亚·纳德拉(Satya Nadella)此前在作证时曾公开表态,AI 公司绝对不应该通过绕过付费墙的方式来违反新闻网站的使用条款。 然而,讽刺的是,OpenAI 的内部聊天记录却暴露了截然不同的态度。当某位员工兴奋地通知 OpenAI 总裁格雷格·布罗克曼(Greg Brockman),称其爬虫程序成功找到了绕过《纽约时报》付费墙的技术漏洞时,布罗克曼并没有制止,反而直接回复:“好极了”。这种技术上的“攻防战”无疑让外界对 AI 厂商的合规承诺打上了巨大的问号。 博客编辑点评 AI 技术的繁荣建立在海量人类智慧结晶的基础之上,但“免费白嫖”一切公开内容的野蛮生长时代正在走向终结。 从点击率的暴跌到媒体的集体反弹,版权方与科技巨头的博弈已经进入深水区。如果无法建立可持续的内容反哺机制或公平的授权分成体系,当新闻机构和创作者被彻底榨干并失去生计时,AI 模型的“粮仓”也将面临无米之炊的窘境。如何平衡技术创新与知识产权保护,将是未来数年整个人工智能行业必须解答的生死命题。

September 19, 2026

内部文件曝光:微软高管直言 AI 训练数据是“人类历史上最大规模的劳动成果盗窃”

分类:AI动态 标签:人工智能、微软、OpenAI、大模型 在人工智能狂飙突进的今天,关于数据抓取与版权的争议从未停息。近日,外媒曝光的一系列微软内部文件将这一矛盾推向了风口浪尖。微软应用科学总监 Brent Hecht 在内部警告称,无节制地抓取新闻内容来训练 AI 模型,本质上是一次规模空前的盗窃行为,堪称人类历史上最大规模的劳动成果盗窃。 内部文件揭露:AI 训练与版权的尖锐矛盾 长期以来,科技巨头们普遍以“合理使用”为借口,大规模抓取互联网上的公开内容用于大模型训练。然而,Brent Hecht 明确表示,这种做法根本算不上合理使用,简直是对“合理使用”理念的公开嘲弄。 除了对版权的侵犯,微软的另一份内部文件还指出了这种模式引发的“恶性循环”: 伤害创作者:AI 直接回答用户问题,导致新闻出版商的网站流量断崖式下跌。 反噬模型自身:当优质内容创作者因失去经济来源而停止生产内容时,AI 模型的训练也将失去高质量的数据源,最终同时伤害模型本身与整个 Web 生态。 触目惊心的数据:新闻机构流量暴跌 OpenAI 的旗舰产品 ChatGPT 等工具正在深刻威胁着传统新闻出版商的经济基础。而微软与 OpenAI 内部的数据分析恰好证实了这一残酷预测: 部分新闻出版商网站的点击率遭遇了高达 83% 至 93% 的灾难性下降;而其他大多数新闻机构的点击率也普遍下跌了 51% 至 94%。正如 Hecht 所坦言的那样:“几乎没有人希望自己创作的内容被以这种方式使用,更没有人因此获得应有的报酬。” 巨头高管表态不一:从公开反对到暗中默许 面对日益严峻的版权压力,科技巨头的态度显得十分微妙。 微软 CEO 纳德拉此前在作证时公开表示,AI 公司绝对不应该通过绕过付费墙的方式来违反新闻网站的使用条款。然而,戏剧性的是,OpenAI 的内部聊天记录却暴露了截然不同的态度:当某位员工兴奋地通知总裁 Greg Brockman,称 OpenAI 的网络爬虫成功找到了绕过《纽约时报》付费墙的技术漏洞时,Brockman 的回复竟是“好极了”。 科技与人文的博弈 AI 的发展离不开海量数据的滋养,但当这种滋养演变为对创作者劳动成果的无偿掠夺时,行业的长远健康便无从谈起。如何在推动技术创新的同时,建立公平合理的版权收益分配机制,保障内容创作者的生存权益,已经成为摆在所有科技巨头面前一道无法回避的必答题。

September 19, 2026

科技巨头的内部觉醒:微软高管直言 AI 训练数据是“人类史上最大劳动盗窃”

分类:AI动态 标签:人工智能、大模型、版权保护、OpenAI 在人工智能狂飙突进的今天,关于训练数据来源的伦理争议从未停止。然而,这一次,发出严厉警告的不是局外的版权方,而是身处风暴中心的科技巨头内部高管。 近期曝光的一系列内部文件显示,微软应用科学总监 Brent Hecht 直言不讳地指出:大规模抓取网络内容来训练 AI 模型,是一次规模空前的盗窃,堪称人类历史上最大规模的劳动盗窃。 这一言论不仅揭示了 AI 产业繁荣背后的隐痛,也将微软与合作伙伴 OpenAI 之间微妙且复杂的立场推向了公众视野。 一、 内部警告:合理使用理念遭到“嘲弄” 长期以来,科技公司一直以“合理使用”(Fair Use)原则作为大规模抓取公开网络数据的法律与道德挡箭牌。但 Brent Hecht 在内部文件中明确表示,这种做法完全是对“合理使用”理念的公开嘲弄。 他承认了一个残酷的现实:“几乎没有人希望自己创作的内容被以这种方式使用,也没有人因此获得报酬。” 另一份微软内部文件则进一步警告,这种无节制的数据抓取行为正在形成一个“恶性循环”,它将同时对 AI 模型本身和整个互联网生态造成伤害。以 OpenAI 的 ChatGPT 为代表的生成式 AI 产品,正在直接或间接危及传统新闻出版商的经济基础。 二、 触目惊心的数据:新闻网站流量断崖式下跌 现实的数据印证了微软内部的悲观预测。 微软自身的统计数据显示,在 AI 搜索与总结功能的冲击下,部分新闻出版商网站的点击率暴跌了 83% 到 93% 之间;而其他各类新闻机构的点击率也普遍下滑了 51% 到 94%。 对于依赖广告与订阅生存的媒体行业而言,流量的枯竭意味着生存根基的动摇。当 AI 总结直接喂饱了用户,原创内容的生产者却在失去回报后难以为继,整个数字内容生态正面临塌房的风险。 三、 巨头的高层分歧:公开表态与实际操作的鸿沟 在这场版权与利益的博弈中,微软高层的态度呈现出耐人寻味的矛盾。 一方面,微软 CEO 纳德拉在公开作证时曾明确表示,AI 公司不应该通过绕过付费墙来违反新闻网站的使用条款。这展现了科技巨头对于合规与行业关系的官方姿态。 另一方面,其核心合作伙伴 OpenAI 的内部信息却暴露了截然不同的态度。文件显示,当某位 OpenAI 员工兴奋地向总裁 Greg Brockman 汇报“公司的网络爬虫找到了绕过《纽约时报》付费墙的漏洞”时,Brockman 的直接回应是:“好极了(Awesome)。” 这种公开规范与私下纵容的落差,无疑让外界对 AI 行业的合规自律打上了巨大的问号。 科技与人文的博弈思考 AI 大模型的训练犹如一场对人类数十年数字文明成果的“洪荒收割”。当微软高管将其定性为“最大规模的劳动盗窃”时,不仅是为新闻出版商鸣不平,更是对整个人工智能产业可持续发展的一次深刻警示。 技术的发展不能以摧毁底层内容生态为代价。如何在尊重知识产权、保障创作者收益与推动技术创新之间找到平衡点,将是接下来摆在所有科技巨头面前一道无法回避的必答题。

September 19, 2026

微软内部文件曝光:AI 训练数据被指人类历史上最大规模劳动盗窃

分类:AI动态 标签:人工智能、大模型、版权保护、OpenAI 在人工智能狂飙突进的今天,关于数据抓取与版权的争议从未停止。然而,近期曝光的一系列微软内部文件却将这一矛盾推向了风口浪尖——微软应用科学总监 Brent Hecht 直言不讳地警告称,抓取新闻内容来训练 AI 是一次规模空前的盗窃,可能是人类历史上最大规模的劳动盗窃。 这一言论不仅揭示了科技巨头内部对当前 AI 训练模式的反思,也再次将 OpenAI 与微软等头部厂商推向了舆论的审判台。 内部警告:合理使用理念的嘲弄 长期以来,科技公司普遍以版权法中的“合理使用”作为大规模抓取网络公开数据(包括新闻、博客、艺术作品等)的法律护城河。但 Brent Hecht 在内部文件中明确表示,这种做法完全是对合理使用理念的嘲弄。 他坦言:“几乎没有人希望自己创作的内容被以这种方式使用,也没有人因此获得报酬。” 另一份微软内部文件则进一步指出了这种行为引发的“恶性循环”:AI 厂商无节制地抓取内容,最终会同时伤害到大模型本身以及整个开放网络生态。 数据触目惊心:新闻出版商流量断崖式下跌 OpenAI 的产品(如 ChatGPT 等)在改变用户获取信息方式的同时,也正在侵蚀新闻出版商的经济基础。微软与 OpenAI 的内部数据均证实了这一悲观预测: 部分主流新闻出版商网站的点击率大幅下降 83% - 93%。 其他各类新闻机构的点击率也普遍遭遇 51% - 94% 的严重缩水。 当 AI 直接为用户提供总结好的答案时,用户访问原新闻网站的动力荡然无存。这种“抽水机”式的运作模式,正在让高质量新闻内容的生产者面临生存危机。 高层表态与现实操作的分裂 在这场版权与利益的博弈中,微软高层的公开表态与实际业务操作之间似乎存在着微妙的温差。 微软 CEO 纳德拉(Satya Nadella)此前在作证时曾公开表示,AI 公司不应该通过绕过付费墙来违反新闻网站的使用条款。然而,与之形成鲜明对比的是,OpenAI 的内部沟通记录显示:当某位员工向总裁 Greg Brockman 汇报“OpenAI 爬虫意外找到了绕过《纽约时报》付费墙的漏洞”时,Brockman 的直接反应却是“好极了(Awesome)”。 这种技术崇拜与利益驱使下的“擦边球”行为,无疑暴露出行业在面对版权红线时的侥幸心理。 科技与创作者的平衡何在? AI 的进化依赖于海量的高质量人类数据(Human Data),但如果作为源头的内容创作者被榨干甚至消灭,AI 产业最终也将成为无源之水、无本之木。 如何构建可持续的生态,让大模型的发展反哺内容创作者,已经成为摆在所有科技巨头面前一道无法回避的必答题。如果任由这种“最大规模的劳动盗窃”继续,未来的数字世界或将面临严重的文化荒漠化危机。

September 18, 2026

微软内部文件曝光:AI 训练数据被指是人类史上最大规模劳动盗窃

分类:AI动态 标签:人工智能、大模型、版权保护、OpenAI 在人工智能狂飙突进的今天,关于数据抓取与版权争议的暗流终于被摆上了台面。近日,一份曝光的微软内部文件显示,该公司应用科学总监 Brent Hecht 直言不讳地警告称,大规模抓取新闻内容来训练 AI 模型的行为,堪称“人类历史上最大规模的劳动盗窃”。 这一内部声音不仅揭示了科技巨头在 AI 军备竞赛中的道德焦虑,也再次将整个行业推向了舆论的风口浪尖。 争议的核心:从“合理使用”到“对理念的嘲弄” 长期以来,各大 AI 厂商普遍援引版权法中的“合理使用”原则,作为其无偿抓取公开网络数据进行模型训练的法律依据。然而,Brent Hecht 在文件中明确表示,这种做法根本不能算作合理使用,而是对该理念赤裸裸的嘲弄。 他坦言一个残酷的现状:几乎没有任何内容创作者希望自己的心血被这样无偿使用,更没有人因此获得过一分钱的报酬。 除了道德层面的拷问,微软的另一份内部文件还指出了更为致命的“恶性循环”: 伤害生态:AI 抓取和总结内容的行为,直接导致新闻出版商的流量和经济基础遭到毁灭性打击。 反噬模型:当优质内容的源头(媒体和创作者)因无法获利而难以为继时,AI 未来能够汲取的训练高质量数据也将枯竭,最终伤害模型自身乃至整个 Web 生态。 触目惊心的数字:新闻网站流量骤降 担忧并非空穴来风,内部数据与现实表现高度吻合。 微软自身的监测数据显示,在 AI 搜索与总结功能的冲击下,部分新闻出版商网站的点击率暴跌了 83% 到 93% 之间;而对于其他大多数新闻机构而言,流量降幅也达到了 51% 到 94%。ChatGPT 等生成式 AI 产品的崛起,正在以惊人的速度蚕食传统内容创作者的生存空间。 尽管微软 CEO 纳德拉在公开作证时曾表示,AI 公司绝不应该通过绕过付费墙来违反新闻网站的使用条款,但同行的实际操作却暴露了截然不同的态度。 曝光文件显示,当一名员工向 OpenAI 总裁 Greg Brockman 汇报名为 OpenAI 的爬虫成功找到了绕过纽约时报付费墙的漏洞时,Brockman 的直接反应却是:“好极了”。这种高层默许甚至暗喜的态度,无疑撕开了科技巨头在版权问题上的双重标准。 科技与版权的十字路口 随着生成式 AI 对全网数据的贪婪吞噬,内容创作者与 AI 厂商之间的矛盾已经不可调和。当“创新”的步伐建立在侵蚀人类劳动成果的基础之上,行业亟需建立一套更公平、可持续的价值分配机制。 AI 的未来不能建立在枯竭的内容荒漠之上。如何在技术狂奔与创作者权益之间找到平衡点,将是接下来几年整个数码科技界必须回答的终极命题。

September 18, 2026

微软内部文件曝光:AI 训练数据被指人类史上最大规模劳动盗窃

分类:AI动态 标签:人工智能、大模型、版权保护、OpenAI 在人工智能狂飙突进的时代,关于训练数据版权与合规性的争议从未停止。近日,根据曝光的微软内部文件显示,微软高管直言不讳地指出,大规模抓取互联网内容来训练 AI 模型的行为,本质上是一场规模空前的劳动盗窃。 这一内部声音不仅揭示了科技巨头在 AI 发展浪潮中的矛盾心态,也将整个行业长期回避的版权痛点彻底摆在了公众面前。 内部警告:对“合理使用”理念的嘲弄 根据曝光的文件内容,微软应用科学总监 Brent Hecht 曾发出严厉警告。他明确表示,网络内容抓取行为不属于法律意义上的“合理使用”,而是对这一理念的彻底嘲弄。Hecht 坦言,在现实中“几乎没有人希望自己创作的内容被以这种方式使用,也没有人因此获得合理的报酬。” 除了道德和劳动层面的质疑,微软的另一份内部文件还指出了更深远的生态危机:这种无限制的抓取正在形成一个“恶性循环”,最终会同时伤害到 AI 模型本身以及赖以生存的整个 Web 生态。 触目惊心的数字:新闻出版商流量暴跌 随着 ChatGPT 等生成式 AI 产品的普及,传统新闻出版商的经济基础正遭受前所未有的冲击。而微软自身的数据也证实了这一预测的残酷现实: 部分新闻出版商网站的点击率大幅下降了 83% - 93%。 其他各类新闻机构的点击率也普遍下滑了 51% - 94%。 当 AI 直接为用户提供总结和答案时,用户访问原新闻网站的意愿断崖式下跌,直接抽干了内容创作者的收入来源。 高管表态与实际行动的鸿沟 在公开层面,微软 CEO 纳德拉(Satya Nadella)曾在作证时表示,AI 公司不应该通过绕过付费墙或违反新闻网站的使用条款来获取数据。 然而,其合作伙伴 OpenAI 的内部沟通却展现了截然不同的态度。曝光信息显示,当曾有员工向 OpenAI 总裁 Greg Brockman 汇报“AI 爬虫发现了绕过《纽约时报》付费墙的漏洞”时,Brockman 的直接反应却是“好极了(Awesome)”。这种言行不一的现象,无疑让外界对科技公司在版权问题上的自律产生了更深的怀疑。 科技新视点 AI 的技术演进往往伴随着生产关系的重构。从目前的趋势来看,数据抓取 -> 模型训练 -> 流量反噬 -> 生态枯竭,已经成为阻碍内容产业健康发展的死结。 如果科技巨头无法建立可持续的版权补偿机制或内容付费分润模式,当全网的高质量人类创作者因失去收益而选择沉默时,AI 的“营养源”也将被彻底切断。如何在技术创新与知识产权保护之间找到平衡点,将是接下来整个科技行业必须正视的核心命题。

September 18, 2026

AI 时代的“最大劳动盗窃”?微软内部文件揭露大模型背后的版权危机

分类:AI动态 标签:人工智能、大模型、版权保护、微软 在生成式人工智能狂飙突进的今天,海量训练数据的合法性与道德边界正受到前所未有的审视。近期曝光的一系列微软内部文件显示,科技巨头内部对于大模型抓取新闻内容训练的做法,其实并非铁板一块,甚至发出了极其严厉的警告。 内部警告:历史上最大规模的劳动盗窃? 根据曝光的内部文件,微软应用科学总监 Brent Hecht 曾直言不讳地警告称,未经授权抓取新闻内容来训练 AI 模型,是一次规模空前的盗窃行为,堪称“人类历史上最大规模的劳动盗窃”。 他明确表示,这种行为根本不能被归类为“合理使用(Fair Use)”,反而完全是对合理使用理念的公开嘲弄。在这些内部讨论中,微软的另一份文件也指出,这种无节制的抓取正在形成一个“恶性循环”,最终将同时伤害 AI 模型本身以及整个互联网生态。 触目惊心的数据:新闻网站流量断崖式下跌 OpenAI 的核心产品(如 ChatGPT 等)在改变用户获取信息方式的同时,也正在一步步瓦解传统新闻出版商的经济基础。而微软与 OpenAI 内部的数据恰恰印证了这一残酷的预测: 流量暴跌:微软的数据显示,部分新闻出版商网站的点击率大幅下降了 83% 到 93% 不等;而其他大多数新闻机构的点击率也遭遇了 51% 到 94% 的严重下滑。 创作者权益归零:Hecht 坦言,“几乎没有人希望自己创作的内容被以这种方式使用,也没有人因此获得过任何报酬。” 高层的公开表态与暗地里的默许 面对外界对版权和付费墙的质疑,科技巨头们在公开场合与私下里往往呈现出截然不同的态度。 一方面,微软 CEO 萨蒂亚·纳德拉(Satya Nadella)在相关证词中曾明确表示,AI 公司绝对不应该通过绕过付费墙的方式来违反新闻网站的使用条款。 然而,鲜明对比的是 OpenAI 的内部沟通记录。当有员工向总裁格雷格·布罗克曼(Greg Brockman)汇报称,OpenAI 的网络爬虫意外找到了绕过《纽约时报》付费墙的技术漏洞时,布罗克曼的反应竟然是“好极了(Awesome)”。这种态度无疑将 AI 产业在合规边缘试探的野心暴露无遗。 极客视点 从数据的疯狂收割到流量的断崖式下跌,AI 的繁荣正建立在传统内容创作者的血汗之上。当“合理使用”的法律边界被无限拉伸,当爬虫技术公然践踏付费墙时,整个数字内容生态正在走向一个危险的十字路口。 如何在推动技术创新的同时,建立一套可持续的版权回报与利益分配机制,已经成为摆在所有 AI 巨头和监管机构面前一道无法回避的必答题。否则,当优质内容的源头被彻底干涸,AI 的进化之路也必将迎来终结。

September 18, 2026

内部文件曝光:微软高管直言 AI 训练数据是“人类史上最大规模劳动盗窃”

分类:AI动态 标签:人工智能、大模型、版权保护、微软 在人工智能狂飙突进的今天,关于数据抓取与版权归属的争议从未停息。近日,一组曝光的微软内部文件将这一矛盾推向了风口浪尖。微软应用科学总监 Brent Hecht 在内部直言不讳地指出,大规模抓取网络内容来训练 AI 模型的行为,本质上是一次规模空前的盗窃,堪称人类历史上最大规模的劳动盗窃。 撕开“合理使用”的面具 长期以来,各大科技公司一直以“合理使用”(Fair Use)原则来为无偿抓取公开网络数据的行为辩护。然而,Brent Hecht 在内部文件中公开表示,这种做法完全是对合理使用理念的嘲弄。 他坦言:“几乎没有人希望自己创作的内容被以这种方式使用,也没有人因此获得合理的报酬。”这种未经授权的大规模数据采集,正在透支整个数字内容生态的根基。 难以打破的“恶性循环”与流量崩塌 除了对创作者不公,微软的另一份内部文件还指出了这种模式带来的“恶性循环”:这种掠夺式的数据获取方式,最终会同时伤害 AI 模型本身和整个 Web 生态。 随着 ChatGPT 等 AI 工具能够直接总结或提供新闻内容,用户访问新闻源的必要性大大降低。微软的数据显示,部分新闻出版商网站的点击率遭遇了毁灭性打击,降幅高达 83% 到 93% 不等,而其他大多数新闻机构的点击率也下跌了 51% 到 94%。这种趋势正在迅速摧毁新闻出版商赖以生存的经济基础。 高层表态与现实操作的撕裂 面对日益严峻的版权与道德拷问,科技巨头的公开表态与实际行动往往存在微妙的温差。 微软 CEO 纳德拉此前在作证时曾明确表示,AI 公司不应该通过绕过付费墙来违反新闻网站的使用条款。然而,合作伙伴 OpenAI 的内部信息却暴露出截然不同的态度。当有员工向 OpenAI 总裁 Greg Brockman 汇报公司的网络爬虫发现了绕过《纽约时报》付费墙的漏洞时,Brockman 的反应却是“好极了”,这无疑讽刺意味十足。 科技与内容的十字路口 AI 的发展依赖于海量的高质量人类文本,但如果源头的内容创作者无法获得体面的回报,甚至面临生存危机,未来的 AI 又将靠什么来喂养?这场关于版权、劳动价值与技术边界的博弈,才刚刚拉开序幕。

September 18, 2026