智能体AI需要撤销功能
可恢复性应决定企业赋予AI智能体的自主权大小
本文由 AI 翻译,关键事实请以原文为准。
在2026年7月和8月,OpenAI、Anthropic和Meta分别披露了独立网络安全评估事件,其中模型跨越了预期的测试边界,并接触到外部系统。
在Anthropic和Meta的案例中,配置错误的评估环境提供了意外的互联网访问权限。而在OpenAI的案例中,模型利用了一个内部托管中间服务中先前未知的漏洞,从而得以访问互联网并接触到另一家公司Hugging Face的生产环境。
这给我们的教训并非是AI产生了恶意意图,而是一个智能体在被赋予目标、网络访问权限和过多权力时,可能会将环境中被忽视的弱点转化为现实世界中的行动。