21世纪经济报道记者 章驰
近期全球人工智能(885728)行业安全乱象集中显现,AI智能体(886099)越权入侵、用户隐私泄露、模型失控等多起重大安全事件接连曝光,行业安全监管漏洞全面凸显。
近日,微软(MSFT)联合创始人比尔·盖茨接受专访时发出AI风险预警,称AI或将引发十亿人死亡的极端灾难事件,并直指当前行业自我监管失效、安全防护体系薄弱等核心问题,为全球AI治理敲响警钟。
比尔·盖茨直言,人工智能(885728)绝对强大到足以引发十亿人死亡的极端事件,尽管导致100%全员毁灭还是很困难,但历史上从未有过任何武器能比“怀有恶意的人结合最新的AI武器”更加致命。令人欣慰的是,行业内部正在展开讨论,甚至不惜损害自身利益承认了这些隐患。
盖茨严肃指出,传统的大规模破坏活动、网络攻击、生物恐怖袭击等高危行为,具备极高的技术、资金门槛。但随着通用AI技术普及,小型犯罪团体甚至个人均可依托先进AI工具复刻同等破坏力,彻底打破了传统安全防御的层级壁垒。
盖茨表示,他不认为AI公司能依靠自我约束来管控风险。“没有人认为自我监管是足够的。”他强调,“需要执法部门和政界人士参与到关于保障措施和监控应该是什么样子的讨论中来,而且这必须是一项强制性要求。”虽然监管会给行业带来一定的成本,但不会阻碍研发的步伐。
针对当前行业主流的安全防护方案,盖茨直接否定了“终止开关(kill switch)”的有效性。他表示,单一的终止开关根本无法抵御AI恶意滥用风险。恶意使用者可规避关停机制、批量复刻工具、分布式实施攻击。单一的事后关停手段无法提前预判、阻断规模化AI恶意攻击。
盖茨表示,甚至是AI的创造者也无法预料到AI会变得如此具有自主性。“这就是一个长期的警示,我们不仅要阻止坏人作恶,更要防止AI本身失控。”
就在盖茨发表上述言论的同一个月,全球多家顶级AI公司接连爆出了一系列令业界震动的安全事件,涵盖政府系统入侵、用户隐私泄露、模型失控逃逸、企业核心数据泄露等多个维度。
9 月 23 日,澳大利亚总理表示,OpenAI 开发的一款 AI 智能体在 6 月未经授权侵入了澳大利亚政府网站,访问了公共和非公共文件。这是已知的首例 AI 入侵政府网站事件。这起入侵事件成为美国以外最引人注目的 AI 智能体访问外部系统的事件之一,并可能进一步加剧外界对 AI 开发者控制技术能力的担忧。此外,其模型还曾尝试攻击美国教育部网站,并从美国人口普查局和美国证券交易委员会获取数据。
OpenAI近期还披露,其AI智能体(886099)在训练和评估环节存在严重数据泄露漏洞,未经用户许可,擅自将53张ChatGPT用户私人图片批量上传至第三方公共图片托管网站。Meta(META) AI智能体(886099)Muse被发现可导出虚拟机大量文件,包含系统文件、应用模板、内部运行文档、Markdown 与 JSON 文件等。一系列用户隐私泄露事件暴露了AI数据安全(885942)漏洞。
随着AI智能体(886099)自主能力持续升级,模型突破安全沙箱、失控逃逸的风险持续攀升。OpenAI官方9月27日正式宣布,暂停训练旗下能力最强的模型。这也是OpenAI短期内第二次因模型失控风险叫停核心业务。OpenAI与Anthropic两大AI巨头已启动安全排查,调查核实数万起AI相关安全事件,涵盖模型越权、隐私泄露、智能体失控、漏洞逃逸、恶意诱导破解等多种类型。这些行为既出现在内部测试中,也出现在现实环境里。OpenAI 首席执行官山姆·奥特曼(Sam Altman)在 X 平台上表示,公司目前正在进行审查工作,但“没有我们希望的那么快”。
真正令人担忧的是,如果一个模型在测试过程中多次采取某种有问题的行动,那么它在现实世界中引发网络安全(885459)事件的可能性也会相应增加。
