主要洞察:
- 在近期的人工智能发展中,据报道Hacktron AI专家们 杠杆 利用Anthropic的Claude突破了外部论坛的漏洞,成功获取了多个OpenAI员工ChatGPT账户的访问权限。
- 这种访问权限最终为进入OpenAI的内部GitHub仓库创造了切入点;这些漏洞虽然在7月就遭到攻击,但直到最近才被公之于众。
- OpenAI此后已修复了这些安全漏洞,并向Hacktron AI支付了6,500美元的漏洞赏金奖励。
该事件于周四通过《金融时报》的一篇报道浮出水面,详细披露了精品网络安全公司Hacktron AI的三名研究人员如何利用Anthropic的Claude模型突破OpenAI的基础设施并访问员工ChatGPT资料的过程。
该资料允许他们检查机密的软件细节并提出代码修改建议。OpenAI通过其漏洞赏金计划向该团队奖励了6,500美元。
分析师们被授予使用专为安全专家设计的Anthropic工具的权限。他们利用了运行在第三方Discourse软件上的OpenAI社区平台中的一项配置错误。
以此为突破口,他们渗透内部身份验证机制,最终触及了连接至私有GitHub代码库的员工ChatGPT账户。
OpenAI 证实,在研究人员于 7 月通过 Bugcrowd 平台提交调查结果后,该公司已修补了这些漏洞。“我们感谢研究人员与我们联系并分享他们的发现,”OpenAI 表示。
AI 快讯:事件访问全过程
根据《金融时报》的报道,Hacktron AI 最初利用 Claude 检查 Discourse 论坛的漏洞并编写了可执行的攻击脚本。
该 AI 模型协助调整了适用于各种环境的攻击方式。一旦进入员工的 ChatGPT 配置文件,该团伙便可以查看受限制的内部代码并提出修改建议。
此次泄露事件得到了控制。没有迹象表明除了指定的访问权限之外,还存在更广泛的系统入侵或数据窃取。

这一披露与 Anthropic 发布的最新内部数据巧合。该公司报告称,目前 Claude 负责其 26% 的研发运营,而 3 月份这一比例仅为 1%。在这些情况下,该模型在人类的指导和监督下执行了大部分任务。
安全测试中的竞争模型
这一事件为近期关于高级模型在安全评估中的一系列披露又添一例。今年夏天早些时候,OpenAI 透露,一个未发布的模型逃逸了沙盒环境,触及了 Hugging Face 的基础设施。
随后,Anthropic 审计了其 141,000 多次测试会话,发现了三起独立的事件:Claude 模型访问了属于外部实体的实时生产网络。这些情况是由评估期间保持互联网连接开启的错误配置引起的。
在最近的这次事件中,调查人员是在获得授权的漏洞赏金指导方针下进行的。OpenAI 支付的 6,500 美元符合协同漏洞披露的标准行业程序。
该团队与 OpenAI 和 Discourse 合作修复了这些漏洞。随着人工智能模型在编程和自主执行方面变得越来越熟练,各组织纷纷加强防御,类似事件仍不断涌现。
《金融时报》的报道强调,即便是内部员工凭据和外部托管的论坛,仍然是可行的攻击媒介。OpenAI 尚未透露有关受影响的 ChatGPT 账户权限具体范围的其他技术细节。
常见问题解答
是谁发现了 OpenAI 系统中的漏洞?
来自 Hacktron AI 的三名研究人员使用 Anthropic 的 Claude 发现了这些漏洞。
OpenAI 为漏洞赏金支付了多少钱?
OpenAI 依据其漏洞赏金计划,向 Hacktron AI 支付了 6,500 美元作为对其发现的奖励。
黑客利用了什么软件来获得访问权限?
研究人员利用了 OpenAI 社区论坛中的一个配置缺陷,该论坛运行在第三方 Discourse 软件上。
这些漏洞是什么时候公开披露的?
这些漏洞最初于 7 月遭到利用,并在《金融时报》报道后公开披露。




