分类:AI动态 标签:人工智能、网络安全、大模型、Claude


在人工智能技术狂飙突进的今天,AI 不仅改变了我们编写代码和创作内容的方式,也正在成为网络攻防战中的一把双刃剑。

近日,安全研究团队 Hacktron 上演了一出颇具戏剧性的戏码——他们利用 OpenAI 的主要竞争对手 Anthropic 推出的 Claude AI 工具,成功发现了漏洞并入侵了 OpenAI 员工的 ChatGPT 账户。这场跨越 AI 阵营的“借刀杀人”,再次将大模型在网络安全领域的双重属性推向了风口浪尖。

攻击复盘:AI 如何协助完成漏洞挖掘?

据 Hacktron 团队透露,整个攻击并非依靠单一漏洞,而是组合拳式的立体打击:

  1. 初始突破口:团队首先锁定了 OpenAI 的 SSO(单点登录)配置错误,以及其社区论坛所使用的 Discourse 软件中存在的 libheif 软件包堆缓冲区溢出漏洞。
  2. AI 深度介入:在漏洞挖掘与远程代码执行(RCE)的实现阶段,研究人员并未完全依靠人工,而是引入了 Anthropic 的 Claude AI 工具作为“首席黑客助手”。
  3. 模型迭代升级:攻击过程中,团队起初使用了较旧的 Opus 4.8 模型,随后无缝切换到了新发布的 Opus 5.5 模型来辅助编写和优化攻击代码。

通过这一套组合拳,研究人员成功控制了多名 OpenAI 员工的 ChatGPT 账户,进而得以访问 OpenAI 的内部代码库及其他关联服务。

颠覆性的攻击经济学:低成本与高效率

这起事件中最令人震撼的,并非攻击手段本身有多么前所未有,而是其极低的经济与时间成本

  • 时间成本:AI 智能体在后台不间断工作了数天时间,而人类研究人员实际投入的人工干预时间仅有短短数小时。
  • 资金成本:整个 AI 辅助 bug 发现与攻击链条构建过程中,消耗的 token 支出竟然不到 3000 美元。

在成功渗透后,Hacktron 团队遵循负责任披露原则,向 OpenAI 及其社区论坛使用的 Discourse 官方报告了相关漏洞,并最终从 OpenAI 获得了 6500 美元的安全悬赏。除去 token 成本,这甚至是一笔“盈利”的买卖。

科技新视角与反思

这场安全测试以一种极具讽刺意味的方式落下帷幕:用竞争对手的 AI 工具,攻破了全球最顶尖 AI 公司的内部防线。

它不仅暴露出企业在 SSO 配置和第三方软件供应链管理上的常见疏漏,更向整个科技行业敲响了警钟:在 AI 时代,黑客攻击的门槛和成本正在被无限拉低,而攻击的自动化与智能化水平却在呈指数级上升。面对未来,企业安全防御体系必须从“人防为主”快速转向“AI 对抗 AI”的智能化主动防御阶段。