Share - WeChat
据媒体报道
近日
独立信息安全研究团队Hacktron AI
受邀参与OpenAI
“漏洞赏金计划”期间
借助Anthropic的Claude大模型
成功入侵OpenAI内部系统
获取了一名员工的
ChatGPT账户权限
并访问了
OpenAI的私有代码仓库

攻破OpenAI系统,获6500美元奖励
公开信息显示
Hacktron AI由
顶尖白客
(出于正当目的进行测试的黑客)
以及安全研究人员组成
本次入侵OpenAI测试
属于获授权的安全研究
入侵是如何发生的?
媒体报道称
今年7月
Hacktron研究人员发现
OpenAI社区论坛所使用的
第三方软件Discourse
在处理特定图像文件时存在漏洞
研究人员随后借助Claude
编写漏洞利用代码
利用Claude生成的代码
Hacktron研究人员进入了
托管OpenAI社区论坛的
Discourse服务器
并进一步获得了
用户身份验证令牌
其中
一些令牌属于OpenAI员工
可以访问OpenAI的GitHub服务
Hacktron研究人员
通过其中一名
OpenAI员工的ChatGPT账户
进入了
OpenAI内部的
大型代码仓库Monorepo
据了解
Monorepo存放着大量
与OpenAI算法和软件系统
有关的代码
可以被视为OpenAI的“秘方仓库”
研究人员
读取其中部分文件
但没有继续扩大访问范围
研究人员称
在意识到已经能够接触敏感数据后
他们停止了进一步测试
OpenAI表示
“我们感谢这些研究人员联系我们
并分享他们的发现”
之后
OpenAI向该团队
支付了6500美元
目前
OpenAI已修复相关问题
AI能力提高带来新的安全压力
有媒体表示
在黑客利用强大AI模型
进行网络攻击的
潜在威胁持续加剧背景下
这一事件
再次引发了人们对
OpenAI安全性的担忧

OpenAI近期报告称
在过去六个月中
该公司还发现了另外六起
“意外或令人担忧的模型行为”
8月初
Meta公司证实
其一款模型
在网络安全评测能力期间
侵入其他公司系统
谷歌在9月承认
其Gemini模型
在此前的网络安全能力测试中
侵入了三家公司的系统
……
有分析指出
一系列事件让人们意识到
AI具备在没有人类意图的情况下
自主发起攻击的能力
微软AI主管苏莱曼对此表示
AI模型需要
始终和人类利益保持对齐
超过100名AI专家和评估人员
近日发布联名信
呼吁基础模型公司
兑现相关承诺
支持更加深入的
第三方AI安全测试
Hacktron研究人员表示
在AI背景下
企业的安全建设
必须跟上攻击者的步伐
有媒体认为
未来随着AI模型
网络安全能力快速提高
传统依靠系统复杂性
和专业人才门槛建立起来的防线
正在面临新的压力
2022年7月12日,世界互联网大会国际组织正式成立,从互联网领域的国际盛会发展为国际组织,总部设于中国北京。我们将致力于搭建全球互联网共商共建共享平台,推动国际社会顺应信息时代数字化、网络化、智能化趋势,共迎安全挑战,共谋发展福祉,携手构建网络空间命运共同体。