分类:AI动态 标签:人工智能、网络安全、大模型、Claude


在人工智能技术狂飙突进的今天,大语言模型不仅在日常办公和编程中大显身手,也正在成为网络安全攻防战中的双刃剑。

近日,Hacktron 安全团队上演了一出戏剧性的一幕:他们利用 OpenAI 竞争对手 Anthropic 推出的 Claude AI 工具作为辅助,成功发现了漏洞并实现远程代码执行,最终控制了多名 OpenAI 员工的 ChatGPT 账户。这场“AI 辅助攻防战”的细节与成本曝光后,引发了科技界与安全圈的高度关注。

攻击复盘:漏洞的组合拳

在这起安全事件中,研究人员并未直接向 OpenAI 的核心大模型发起正面攻击,而是通过寻找供应链与周边系统的薄弱环节来实现突破。

整个攻击路径主要包含以下几个关键步骤:

  1. 寻找切入点:研究人员将目标锁定在 OpenAI 的外围基础设施上。
  2. 组合利用漏洞:他们成功组合利用了 OpenAI 的 SSO(单点登录)配置错误,以及其官方社区论坛所使用的 Discourse 软件中存在的 libheif 软件包堆缓冲区溢出漏洞。
  3. 实现账户控制:通过上述漏洞,研究人员成功绕过安全限制,控制了多名 OpenAI 员工的 ChatGPT 账户。
  4. 横向移动:获取员工账户权限后,研究人员进一步访问了 OpenAI 的内部代码库及其他关联服务。

事后,该团队已按规范向 OpenAI 官方及 Discourse 报告了相关漏洞,并因此获得了 OpenAI 颁发的 6500 美元安全奖励。

AI 辅助黑客:低成本与高效率的颠覆

这场攻击中最令人瞩目的,并非漏洞本身有多么精妙,而是人工智能在其中扮演的角色

传统漏洞挖掘往往需要安全专家投入大量的人工时间去阅读源码、分析崩溃日志以及编写测试脚本。而在本次事件中,研究人员全程借助了 Anthropic 的 Claude AI 工具来辅助发现 bug 并实现远程代码执行(RCE):

  • 模型迭代演进:研究人员在初期使用了较旧的 Opus 4.8 模型,而在攻击后期则换用了新发布的 Opus 5.5 模型来处理更复杂的逻辑。
  • 极低的投入产出比:整个 AI 辅助漏洞挖掘与攻击过程,消耗的 Token 支出不到 3000 美元。
  • 颠覆式的时间成本:AI 智能体在后台连续运行了数天,而人类研究人员实际投入的人工时间仅仅只有数小时。

科技与数码博客视点

这起事件通过一个极其讽刺的现实——“用竞争对手的 AI 攻破 OpenAI”——再次向整个科技行业敲响了警钟。

过去,高水平的网络攻击往往需要庞大的资金支持、高级别的黑客团队以及数月甚至数年的技术沉淀。但正如本次研究所展现的那样,AI 时代的黑客攻击成本正在被无限压缩:AI 负责高强度的机械化分析与代码编写,人类则退居幕后进行策略指导。

当 AI 辅助渗透的门槛降低到几千美元的 Token 消耗和短短数小时的人工投入时,未来的网络安全防御将面临前所未有的压力。如何防范利用 AI 进行的高效、自动化新型攻击,将成为摆在所有科技巨头与安全厂商面前的当务之急。