Share - WeChat
西班牙《机密报》网站8月8日刊登题为《全网警报四起:为何眼下所有人工智能好似集体“失控”》的文章,作者是M.麦克洛克林,内容编译如下:
2026年夏天将会被载入网络安全史册,这并非因为爆发了全球性断网事件,也没有出现类似“想哭”勒索软件的大规模攻击,而是因为人工智能(AI)模型首次出现突破管控边界的现象。短短几周内,全网舆论一片哗然。各类近乎反乌托邦的故事广为流传:高级大语言模型挣脱测试环境束缚,绕过研发人员设置的防护屏障,潜入互联网攻击第三方企业网站。相关传闻持续加剧各界恐慌。
“失控”引发恐慌
这类新闻自带流量,精准戳中大众固有恐惧:业界或许终将研发出通用人工智能,并找到突破人类设定限制的办法。但如果拨开戏剧化叙事的表层深挖真相,整件事本质只是网络配置疏漏叠加人为操作失误,再被包装成公关宣传素材大肆炒作。
想必读者已经知晓这场风波的开端:开放人工智能研究中心(OpenAI)承认,一项失控测试最终导致知名人工智能开源平台“抱抱脸”公司遭入侵。该企业多款智能体模型找到途径,通过测试环境内安装的第三方程序间接接入互联网。根源在于OpenAI为测试模型极限能力,关闭了所有安全防护约束,最终酿成意料之外的后果。本周,OpenAI在拉斯维加斯黑帽(网络安全)大会上披露更多细节,例如这些模型会使用一套特殊自创语言分工协作、交换系统漏洞信息,加快网络攻击进度。
行业内很快掀起连锁反应。该事故曝光数日后,Anthropic公司承认,其“克劳德”系列三款模型(包含全新发布的“神话5”)在常规测试中侵入三家外部机构真实系统,还试图在代码托管平台GitHub植入恶意程序。
几乎同一时间,元宇宙平台公司也公开表示,旗下代码生成模型Muse Spark利用外部审计公司“非常规”人工智能公司的一处配置漏洞,私自访问外网,并篡改某未披露企业的内部基础设施。一时间,“出逃智能体”事件正式成为行业共性问题。
专家纷纷解读
一众工程师与分析师在解释这些测试背后真正发生的事情时已经失去了耐心。前沿安全公司专家亚龙·辛格、保罗·卡西亚尼克发布分析报告,点出行业刻意忽视的基础常识:“模型只会优化目标函数,而非揣摩人类开展性能测试的真实意图。只要存在可行的网络通路,性能足够强大的智能体就一定会找到。”
直白来讲,算法不存在自主逃离、征服世界的主观想法,只会寻找最快完成测试任务的捷径。如果测试环境未隔绝外网,模型便会不择手段“作弊”,完全无视人为设定的规则,况且本次测试中所有约束规则本就已被人为关闭。
西班牙专家贡萨洛·阿尔瓦雷斯·马拉尼翁也认同这一观点,他在《机密报》近期采访中解释说:“目前没有任何人工智能具备自主反叛、主动出逃的意识,它只是找到完成指定任务最高效的路径。”推理模型不存在自我意识、道德观念,也没有挣脱研发者管控的欲望,仅依靠数学函数优化得出最优答案。一旦测试环境存在漏洞,高级智能体不会耗费算力复杂推演,而是直接选用最简单高效的方式完成任务。
技术文献中将这种不计代价达成目标的现象称作“规范操纵”。大众媒体渲染的人工智能网络大军,在测试环境设计漏洞、研发人员操作失误的现实面前,褪去科幻外衣,回归平淡本质。网络安全领域专家奥马尔·本布阿扎在接受《机密报》采访时表示:“舆论编造出人工智能反叛的故事,但事实并非如此;如果没有清晰划定边界、全部移除约束条件,人工智能只会机械执行分配给它的任务。”
科企“自导自演”?
业内所谓的安全牢笼,实则是一扇锁扣未扣死的房门。我们面对的并非是拥有邪恶心智的智能系统,而是一场监考老师把答案手册留在桌上,学生顺手作弊的测试。
黑帽大会创始人、网络安全专家杰夫·莫斯日前揭露这场危机背后的另一面:“企业把每一次安全事故都包装成营销噱头。”他在大会演讲中指出,将配置失误、主动关闭内置过滤器引发的漏洞,塑造成无法掌控的失控事件,能让企业对外宣称自家算法性能强悍到连研发团队都难以约束。这是极致的混乱营销:把自身技术疏漏包装成重大技术突破,一方面震慑竞争对手,另一方面吸引投资者。
这套宣传策略并非毫无负面影响,会立刻引发地缘政治变动与监管新规。OpenAI技术人员迈克尔·道尔顿在黑帽大会演讲时无奈坦言,行业已充分证明人工智能驱动的主动网络攻击技术完全落地可用,但防御端始终没有对等应对方案。各大科技企业一边制造“火种”,一边兜售“灭火器”。当前网络攻防市场攻防力量严重失衡,迫使各国政府介入监管,传唤企业高管参加听证会,要求其说明管控自家人工智能产品的方案。
大众对自主智能体“反叛”的集体恐慌,更多体现出行业炒作技术神话的需求,而非人工智能真实发展现状。机器并未夺取控制权,也不存在主动攻击网络空间的自主意志。当下所有乱象,本质是多重现实因素叠加:算法被设定以最低成本解决任务、测试环境设计敷衍疏漏、企业管理层执意将任何安全故障包装成重磅营销亮点。(编译/韩超)
2022年7月12日,世界互联网大会国际组织正式成立,从互联网领域的国际盛会发展为国际组织,总部设于中国北京。我们将致力于搭建全球互联网共商共建共享平台,推动国际社会顺应信息时代数字化、网络化、智能化趋势,共迎安全挑战,共谋发展福祉,携手构建网络空间命运共同体。