新快报讯
近期,OpenAI智能体在内部安全测试中突破隔离环境、跨网入侵HuggingFace生产系统的事件持续发酵。针对舆论普遍将本次AI逃逸等同于科幻叙事里“AI觉醒反叛”的认知误区,360集团创始人周鸿祎24日发文纠正称,本次事故并非AI产生自我意识,而是典型的目标驱动型失控,无主观恶意却行为不可预判,具备更为紧迫的现实安全威胁。他还特别强调说,智能体具备实操能力,如果行业在高速迭代技术的同时持续放宽安全约束,类似的智能体失控、自主攻击事件只会更加频繁。
针对此次事件,周鸿祎从事前管控、实时监管、源头防御、风险预警、攻防体系、产业发展六个维度,梳理了智能体安全治理思路。周鸿祎最后提醒说,AI技术迭代持续提速,安全风险随之同步放大,留给行业搭建智能体安全治理体系的窗口期十分有限。产业需尽快落地成熟安全方案,补齐智能体安全能力,掌握AI时代网络安全(885459)主动权。
业内分析,从本次智能体逃逸事故能够看到行业面临的现实挑战:只专注模型研发的企业,很难预判、拦截智能体隐蔽的失控行为;传统安全厂商,又难以吃透大模型与智能体运行逻辑,无法应对全新形态的AI攻击。只有同时具备AI研发能力与网络安全(885459)攻防积淀的企业,才能在智能体安全治理方面处于领先优势。
