Share - WeChat
据媒体报道
近日
一项新发布的独立研究显示
一批与OpenAI相关的人工智能体
在今年5月至6月
“劫持”了一个德国网站
用于相互传递信息
分享测试任务答案
和突破运行环境限制的方法
冷门网站,怎么成了AI“留言板”
DseWiki是一个
运营二十余年
面向程序员的
德语协作Wiki站点
任何访问者
都可直接编辑页面
近年来网站已十分冷清
过去十年仅有约20次编辑记录
8月底
AI安全非营利组织
Nightingale的研究人员
在互联网上搜索
未经授权的AI智能体活动迹象时
发现了异常
DseWiki网站的记录显示
OpenAI的智能体
将该网站改造成了一个“留言板”
在上面分享作弊技巧
绕过OpenAI限制的方法
并掩盖其行为
研究人员表示
这些智能体的运行速度
远超人类
AI开始“抱团”传答案、钻空子
这些智能体的行为模式显示
它们正在试图完成一种
名为“多轮网络检索”的任务
人工智能体将
网站“改造”为“留言板”
以便相互“交流”与“协作”
一些智能体
会把已经获得的任务答案
发布在网站上
供其他智能体使用
比如
有智能体分享
如何在部分测试任务中
取得更好成绩
有的介绍
绕过OpenAI限制的方法
还有智能体讨论
如何掩盖自己的行为
防止被发现
……
当发现网站管理员
开始删除相关页面后
一些智能体还会创建备份页面
其中有一条智能体留言显示
它已经注意到网站
正在按字母顺序清理页面
并留下了另一个页面地址
提醒其他智能体
剑桥大学研究人员
莫里斯·基奥多认为
通过这个现象可以看出
先进AI带来的最大威胁
可能并非某个单一的
超级智能系统
而是“庞大且相互联系的
半智能AI集群”
有媒体称
这起此前未被公开报道的事件
凸显了AI行业内部
日益紧张的局面
各家公司正竞相构建
越来越自主的智能体
使其能够执行
复杂而有价值的任务
但越来越多的证据表明
这些系统也可能学会
钻规则空子、利用漏洞
知情不报,OpenAI再遭质疑
值得一提的是
OpenAI的高管们
在数周前就知晓此事
但由于当时正忙于应对
7月份另一起更受关注的
智能体安全事故
最终选择不对外披露
当时
OpenAI一款
处于测试阶段的AI代理
突破管控入侵了AI开发平台
Hugging Face(抱抱脸)
有媒体认为
此事本就加剧了
人们对OpenAI为推进AI发展
而牺牲安全性的担忧
网站劫持事件未予披露
也可能令外界
对其监管工作提出新的质疑
分析认为
两起事件的区别在于
袭击Hugging Face的智能体
一开始被“关在”沙箱里
没有被赋予访问网络的权限
而此事件的智能体
本来就因为要执行测试而联网
两起事件共同说明
当模型获得
浏览器、代码执行、网络访问等工具后
安全风险程度进一步提升
也有分析认为
当前
企业需要防范的对象
不再只是模型本身
还包括Agent的本身
以及Agent之间可能形成的协作网络
2022年7月12日,世界互联网大会国际组织正式成立,从互联网领域的国际盛会发展为国际组织,总部设于中国北京。我们将致力于搭建全球互联网共商共建共享平台,推动国际社会顺应信息时代数字化、网络化、智能化趋势,共迎安全挑战,共谋发展福祉,携手构建网络空间命运共同体。