安全研究员用Anthropic的Claude攻破OpenAI系统
独立安全研究团队Hacktron AI使用Anthropic的Claude模型,在OpenAI的漏洞赏金计划中成功入侵其内部系统,获取了员工账户和代码仓库访问权限。团队通过Discourse论坛的图片处理链漏洞,利用Opus 5模型在数小时内构建出有效攻击程序。OpenAI已修复相关问题并向研究团队支付6500美元奖金。
据《华尔街日报》报道,独立安全研究团队Hacktron AI使用Anthropic的Claude模型成功入侵OpenAI系统,暴露了这家ChatGPT制造商防御中的漏洞。此次攻击是OpenAI漏洞赏金计划的一部分,团队在发现漏洞后向OpenAI报告,获得了6500美元奖励。
研究人员通过组合两个关键漏洞,获取了多名OpenAI员工的ChatGPT账户访问权限,进而进入公司内部软件系统。攻击路径始于7月25日,漏洞源头是Discourse——为OpenAI社区论坛提供支持的第三方软件。入口是一个看似普通的图片上传功能:当用户上传HEIF或HEIC格式图片时,Discourse会通过ImageMagick和libheif等工具链将其转换为标准JPEG。libheif库中的一个内存错误成为攻击切入点,允许攻击者注入恶意指令。值得注意的是,该漏洞早在数月前就已被libheif开发者修复,但从未被正式标记为CVE漏洞。
研究团队最初使用的Claude特殊版本Opus 4.8多次尝试都未能构建有效攻击程序,但Anthropic发布Opus 5后情况发生转变。团队在博客中写道:"Opus 4.8在多次会话中都无法生成有效攻击程序。Opus 5发布数小时内,我们提出相同问题,它成功了。"进入Discourse服务器后,研究人员发现了另一个漏洞,可以接管用户的ChatGPT和Codex账户,包括OpenAI员工的账户。他们随后接管了一名员工的账户,其Codex已连接至OpenAI的GitHub组织。
OpenAI表示已解决Hacktron发现的问题。这一事件发生之际,顶级AI公司正面临越来越大的安全压力。AI安全公司Gray Swan首席执行官Matt Fredrikson表示:"每月200美元,任何人都可以用这些工具入侵像OpenAI这样的公司。如果这能发生在他们身上——我不认为他们最近的网络安全卫生做得不好——那就可能发生在任何人身上。"
本文由程序自动抓取公开报道,经 AI 筛选与改写生成,未经人工逐条核实,事实以原文为准。