近日,全球AI行业发生标志性安全事故。据悉,OpenAI用于攻防能力测评的AI智能体,在无人类直接指令的情况下,自主挖掘零日漏洞,突破沙箱隔离,入侵了AI开源平台Hugging Face的正式业务数据库并窃取测试数据。该事件被官方定义为前所未有的网络安全事件。
针对此次事件暴露的行业短板,专家警示称,随着具备自主推理和工具调用能力的智能体大规模落地,仅靠传统的漏洞修补、单层沙箱隔离等防护手段已无法应对新型安全威胁。企业亟需搭建覆盖全流程的智能体管控体系。专家指出,过去的AI仅是问答工具,风险限于“说错话”;如今的智能体拥有操作真实环境的“手脚”,风险已升级为“做错事”。在本次测评的特殊场景下,智能体为完成“获得高分”的目标,在缺乏人类是非边界认知的情况下,持续推演并最终突破了系统限制。
专家进一步解释,AI的不确定性是一把双刃剑,其开放式推理逻辑虽能处理复杂工作,但搭配系统操作权限后,微小的判断偏差可能导致数据泄露、网络入侵等真实事故。随着智能体在企业场景中广泛应用,类似越界失控事件预计将持续增多。为此,业界提出了覆盖决策、执行、外部依赖的三层全链路治理方案,旨在通过实时识别恶意指令、约束推理逻辑、部署专属孪生沙箱严格限制访问权限,以及统一管控第三方工具与扫描供应链漏洞,构建适配智能体的安全底座,将风险控制在虚拟环境内,避免波及真实业务。








