分类:AI动态 标签:人工智能、大模型、版权保护、OpenAI
在人工智能狂飙突进的今天,关于训练数据来源的伦理争议从未停止。然而,这一次,发出严厉警告的不是局外的版权方,而是身处风暴中心的科技巨头内部高管。
近期曝光的一系列内部文件显示,微软应用科学总监 Brent Hecht 直言不讳地指出:大规模抓取网络内容来训练 AI 模型,是一次规模空前的盗窃,堪称人类历史上最大规模的劳动盗窃。
这一言论不仅揭示了 AI 产业繁荣背后的隐痛,也将微软与合作伙伴 OpenAI 之间微妙且复杂的立场推向了公众视野。
一、 内部警告:合理使用理念遭到“嘲弄”
长期以来,科技公司一直以“合理使用”(Fair Use)原则作为大规模抓取公开网络数据的法律与道德挡箭牌。但 Brent Hecht 在内部文件中明确表示,这种做法完全是对“合理使用”理念的公开嘲弄。
他承认了一个残酷的现实:“几乎没有人希望自己创作的内容被以这种方式使用,也没有人因此获得报酬。”
另一份微软内部文件则进一步警告,这种无节制的数据抓取行为正在形成一个“恶性循环”,它将同时对 AI 模型本身和整个互联网生态造成伤害。以 OpenAI 的 ChatGPT 为代表的生成式 AI 产品,正在直接或间接危及传统新闻出版商的经济基础。
二、 触目惊心的数据:新闻网站流量断崖式下跌
现实的数据印证了微软内部的悲观预测。
微软自身的统计数据显示,在 AI 搜索与总结功能的冲击下,部分新闻出版商网站的点击率暴跌了 83% 到 93% 之间;而其他各类新闻机构的点击率也普遍下滑了 51% 到 94%。
对于依赖广告与订阅生存的媒体行业而言,流量的枯竭意味着生存根基的动摇。当 AI 总结直接喂饱了用户,原创内容的生产者却在失去回报后难以为继,整个数字内容生态正面临塌房的风险。
三、 巨头的高层分歧:公开表态与实际操作的鸿沟
在这场版权与利益的博弈中,微软高层的态度呈现出耐人寻味的矛盾。
一方面,微软 CEO 纳德拉在公开作证时曾明确表示,AI 公司不应该通过绕过付费墙来违反新闻网站的使用条款。这展现了科技巨头对于合规与行业关系的官方姿态。
另一方面,其核心合作伙伴 OpenAI 的内部信息却暴露了截然不同的态度。文件显示,当某位 OpenAI 员工兴奋地向总裁 Greg Brockman 汇报“公司的网络爬虫找到了绕过《纽约时报》付费墙的漏洞”时,Brockman 的直接回应是:“好极了(Awesome)。”
这种公开规范与私下纵容的落差,无疑让外界对 AI 行业的合规自律打上了巨大的问号。
科技与人文的博弈思考
AI 大模型的训练犹如一场对人类数十年数字文明成果的“洪荒收割”。当微软高管将其定性为“最大规模的劳动盗窃”时,不仅是为新闻出版商鸣不平,更是对整个人工智能产业可持续发展的一次深刻警示。
技术的发展不能以摧毁底层内容生态为代价。如何在尊重知识产权、保障创作者收益与推动技术创新之间找到平衡点,将是接下来摆在所有科技巨头面前一道无法回避的必答题。