分类:AI动态 标签:人工智能、网络安全、大模型、Claude


在人工智能大模型飞速发展的今天,AI 的角色早已不仅限于写代码和日常对话。最近,安全界发生了一起极具讽刺意味又震撼人心的事件:安全研究人员竟然利用 OpenAI 最大的竞争对手 Anthropic 的 Claude AI 工具,成功入侵了 OpenAI 员工的账户。

这场“AI 辅助攻击”不仅成本极低,还彻底颠覆了传统的漏洞挖掘模式。

攻击复盘:AI 是如何协助破防的?

来自 Hacktron 的安全研究团队并没有盲目发起攻击,而是精心策划了一套利用链:

  1. 寻找突破口:研究人员组合利用了 OpenAI 的 SSO(单点登录)配置错误,以及其社区论坛所使用的 Discourse 软件中 libheif 软件包的堆缓冲区溢出漏洞。
  2. AI 全程辅助:在这个过程中,他们让 Anthropic 的 Claude AI 担当“首席黑客顾问”。从最初的漏洞发现,到最终实现远程代码执行(RCE),Claude 发挥了至关重要的作用。
  3. 模型迭代:研究人员在攻击的不同阶段使用了不同的模型版本,从较旧的 Opus 4.8 一直到新发布的 Opus 5.5。

通过这套组合拳,研究人员成功控制了多名 OpenAI 员工的 ChatGPT 账户,进而得以访问 OpenAI 的内部代码库及其他关联服务。

颠覆认知:极低的攻击成本与时间

这起事件中最令人瞩目的,不是漏洞本身有多高明,而是攻击的经济账

  • 时间成本:人类研究人员投入的人工时间仅仅只有数小时,而大部分复杂的渗透与代码编写工作,是由 AI 智能体花费数天时间自主完成的。
  • 金钱成本:整个 AI 辅助发现漏洞和攻击的过程,消耗的 token 支出竟然不到 3000 美元。

事后,研究人员将这些漏洞负责任地报告给了 OpenAI 和 Discourse,并因此获得了 OpenAI 颁发的 6500 美元安全赏金。

极客视点与行业思考

这起事件给整个科技与安全行业敲响了警钟:

  • 攻击门槛的大幅降低:AI 时代黑客攻击的边际成本正在断崖式下跌。过去需要顶级安全专家团队耗费数周甚至数月才能完成的高级渗透,现在可以通过大模型以极低的成本自动化完成。
  • AI 安全的双面性:当竞争对手的 AI 被用来攻破行业领头羊的防线时,我们不得不重新审视大模型在网络安全攻防战中的真正威力。

AI 正在成为网络安全领域的最强变量。未来,如何利用 AI 构筑更坚固的防御工事,将是摆在所有科技巨头面前最紧迫的课题。