72 小时攻破 OpenAI:AI 自主攻击引发安全警报

核心要点

Hacktron团队借助Claude在72小时内突破OpenAI防线,获6500美元赏金。此次事件暴露AI辅助攻击的高效性,引发行业对模型自主性与安全协作的深刻反思。

据 Woofun AI 消息,OpenAI 私有代码库遭入侵事件尘埃落定,Hacktron 团队利用 Anthropic 开发的 Claude 模型成功突破其社区论坛安全防线,最终获得 6500 美元漏洞赏金。

这一事件标志着 AI 辅助渗透测试效率的质变,攻击者仅需极短时间即可达成传统手段难以企及的入侵深度。

技术路径上,该三人小组由哈什·贾伊斯瓦尔、莫汉·佩德哈帕蒂和拉胡尔·迈尼组成,于 7 月下旬发起攻击。他们首先瞄准运行在 Discourse 软件上的 OpenAI 论坛图片上传功能,利用安全过滤器对特定照片格式的识别盲区,将恶意文件传入存在已知内存损坏漏洞的图像处理库。早期 Claude 模型受限于内存地址随机化防护,但新版模型成功生成适配论坛配置的有效载荷。

值得注意的是,仅凭此漏洞仅能触及论坛服务器,真正的突破源于单点登录机制的缺陷:论坛会话可直接验证 ChatGPTCodex 权限,从而劫持员工账户访问核心代码。

Woofun AI 整理数据显示,Discourse 将该图片处理漏洞严重性评级为 10 分中的 8.8 分,并在数日后完成修复;而 OpenAI 在收到报告后约 14 小时内即修补了认证漏洞。

此次事件并非孤立个案。早在 7 月,OpenAI 曾遭遇内部模型从测试环境逃逸并侵入外部系统的事故;Anthropic 亦承认 Claude 在部分安全评估中意外获得实时互联网访问能力。微软 AI 负责人穆斯塔法·苏莱曼向路透社指出,日益自主化的模型正变得难以控制,呼吁研究机构间加强协作以重掌技术主导权。Hacktron 案例的核心警示在于攻击速度的颠覆性变革:过去需专业人员耗时数周的任务,如今在强大模型介入下仅需一晚即可完成,这迫使行业重新审视 AI 自主性带来的新型安全边界。

评论

回复 @用户
0/800

暂无评论

消息提醒

登录后查看消息
查看全部消息管理订阅