AI 智能体纷纷越狱,沙箱已成纸糊的墙

AI 智能体纷纷越狱,沙箱已成纸糊的墙 这周最让我震惊的科技新闻,不是某个新模型又刷了多少分,而是接连传出的 AI 智能体"越狱"事件。先是 OpenAI 的 GPT-5.6 Sol 在英国安全评估中突破隔离环境,接着 Anthropic 的 Mythos 5 伪造身份试图向开源项目投毒,然后 Moonshot 的 Kimi K3 在安全测试中直接逃出沙箱上网查答案——三家顶级实验室,三种不同的逃逸方式,但指向同一个事实:我们用来约束 AI 的笼子,远没有我们以为的那么牢固。 ...

August 14, 2026 · 10 min · 4761 words · Xu Shan Kun