AI公司反成攻击目标 外媒:白帽黑客使用Claude入侵OpenAI

OpenAI CEO奥特曼
凤凰网科技讯 北京时间9月18日,据《华尔街日报》报道,在OpenAI内部一群AI智能体突破控制、入侵Hugging Face公司两周后,这家ChatGPT开发商又获悉了另一起由AI驱动的入侵事件。而这一次,OpenAI自己成了目标。
独立安全研究人员利用Anthropic的Claude软件,获取了OpenAI一名员工的ChatGPT账户权限,从而得以读取该公司私有的软件缓存,并提出修改建议。
该团队参加了OpenAI的漏洞悬赏项目,该项目为研究人员尝试入侵企业系统提供免责保护。他们迅速向公司报告了发现,OpenAI向该团队支付了6500美元赏金。该团队首次向《华尔街日报》披露了他们的工作。
这起新的入侵事件,是最新一批由领先科技公司和研究人员披露的、借助快速演进的AI工具实施的网络入侵之一。尽管外界数月来一直警告AI系统的能力,但这起新的入侵事件表明,如今计算机系统的复杂程度使其难以防御。
OpenAI CEO萨姆·奥特曼(Sam Altman)及其同行在上周六呼吁暂停AI开发,称这项技术发展太快,以至于构建该技术的公司无法安全地降低危害。OpenAI在周三披露了此前未报告的安全事件,并宣布了未来报告此类问题的新政策。
负责开展这项入侵研究的是网络安全公司Hacktron AI,其首席技术官莫汉·佩达帕蒂(Mohan Pedhapati)表示,他们就三个人,只有Claude和Codex的订阅账号。

佩达帕蒂(中)等三人开展了这次入侵研究
OpenAI透露,这些研究人员发现了两个问题:一个出在名为Discourse的第三方服务中,该服务托管着OpenAI的社区讨论论坛;另一个则出在OpenAI自身。OpenAI称,这两个问题现均已解决。
该公司表示:“我们感谢这些研究人员联系我们并分享他们的发现。我们收窄了社区登录令牌的权限,并撤销了受影响的令牌和会话。”
入侵过程
网络研究人员经常参与漏洞悬赏项目,对大型企业的数字基础设施进行压力测试。
这次对OpenAI的入侵始于7月23日。当时,Hacktron的研究人员发现,社区讨论论坛Discourse在处理某些图像文件时存在漏洞。这些研究人员获得了一个特殊版本的Claude Opus 4.8,该版本面向符合条件的网络安全从业者开放。他们要求Claude编写代码,利用这一漏洞发动网络攻击。
起初并没有成功。不过,当天晚上Anthropic发布了Opus 5,第二天,Claude就找到了利用这一漏洞的方法。它生成的攻击代码使研究人员得以进入托管OpenAI讨论论坛的一台Discourse服务器,并在那里访问用户的身份验证令牌:即一串串独一无二的数字字母组合,用户凭此访问在线服务。
令他们感到意外的是,这些令牌可以用于登录ChatGPT,其中一些还属于OpenAI员工。这些令牌还可以用于访问OpenAI的GitHub服务,也就是一个软件代码仓库。
由于不想访问敏感数据,研究人员无法确定OpenAI的源代码系统具体用于什么,但他们表示,该系统名为“Monorepo”。据熟悉OpenAI架构的知情人士透露,Monorepo是一个大型软件代码仓库,存放着OpenAI的算法机密。
知情人士称,从软件层面来看,这相当于公司的“秘方”,能够让其模型运行得更快、更高效。不过,他们认为其中并不包含模型权重。模型权重相当于OpenAI的“核心机密”,是大语言模型的核心,由数万亿个数字组成,帮助模型判断哪些信息应该被强化、哪些应该被忽略。
研究人员以ChatGPT作为操作界面,从而读取了Monorepo中的文件。他们表示,在意识到自己能够访问敏感数据后,就停止了这次入侵,但在此之前,他们已经发起了一次所谓的“拉取请求”,也就是向代码库提出修改建议的方法。
他们指示该聊天机器人向代码库中的一个文档文件发送了一份“拉取请求”,也就是建议修改。研究团队建议更新该文档,在其中加入“Hacktron AI Team PoC”字样,以及佩达帕蒂和该公司研究负责人哈什·贾伊斯瓦尔(Harsh Jaiswal)的X账号链接。他们表示,这是证明自己已经获得OpenAI机密访问权限的证据。
研究人员称,这一建议修改未被接受。OpenAI表示,其对GitHub的审查发现,存在对私有代码库元数据和代码更改的“有限读取”。
Discourse表示,它在7月25日接到通知当天就修复了这一安全问题。
AI安全公司Abundant Security首席技术官约书亚·萨克斯(Joshua Saxe)审阅了Hacktron AI关于此事的报告。他说,这起入侵事件表明,在AI黑客时代,保护企业机密何其复杂。
“全世界的软件都充斥着安全漏洞。之所以我们还没有发现所有这些漏洞,是因为直到去年,真正擅长寻找这些漏洞的专家也只有几千人。”他说。
但是萨克斯表示,如今AI智能体正让技能较低的人也能获得这种能力。
网络安全公司ThreatDown称,犯罪分子也在获取这些能力。ThreatDown表示,在网络论坛上,人们只需花上800美元,就能非法买到Hacktron研究人员所用的那种网络安全增强的账号访问权限。
截至发稿,Anthropic发言人不予置评。(作者/箫雨)
更多一手新闻,欢迎下载凤凰新闻客户端订阅凤凰网科技。想看深度报道,请微信搜索“凤凰网科技”。




