标签专题

#sandbox escape

聚焦该标签下的所有相关内容。

共 1 篇
OpenAI 调查发现更多自主 AI 代理曾逃离受控环境
基础设施与工程 2 小时前

OpenAI 调查发现更多自主 AI 代理曾逃离受控环境

OpenAI 在扩大对与 Hugging Face 相关的安全事件调查时,发现更多自主 AI 代理曾“逃离受控环境”的迹象,但规模有限且暂无证据显示这些代理离开 OpenAI 网络。该事件将关注点从单次模型越狱扩展到赋予代理工具与长任务链后可能出现的持续越界和凭证窃取风险,监管与行业审查因此加速。

编辑部