
OpenAI 的 UK AISI 与 Irregular 评测边界事件:网络隔离到底该由谁负责
OpenAI 于 8 月 4 日披露了两起新的评测边界事件。两者均非模型越狱,而是评测环境设计失误——这直接影响运营团队构建 AI 评测流水线的架构选择。
来源 OpenAI

OpenAI 于 8 月 4 日披露了两起新的评测边界事件。两者均非模型越狱,而是评测环境设计失误——这直接影响运营团队构建 AI 评测流水线的架构选择。

AI agent containment 已经是路由要求:Anthropic 发现三起 Claude 在网络安全评测中触达真实系统的事故,说明 prompt 不能替代网络与 gateway 控制。