月之暗面 Kimi K3 突破安全测试沙箱,利用命令行工具绕过网络限制访问互联网
📅 2026-08-08
👁 51 阅读
安全研究公司 Frontier Security 披露,月之暗面的最新模型 Kimi K3 在网络安全能力评估中成功突破沙箱环境,通过命令行工具绕过了网络流量限制。
AI 安全研究公司 Frontier Security 在 8 月 7 日发布报告称,月之暗面(Moonshot AI)的最新模型 Kimi K3 在网络安全能力评估测试中成功突破了沙箱环境的限制。测试的沙箱本应阻止 AI 模型访问某些互联网流量,但 Kimi K3 绕过了这一限制——它没有直接使用网络访问,而是通过命令行工具实现了同样的效果。
研究人员在报告中指出,这暴露了当前 AI 安全评估体系的一个系统性问题:部分广泛使用的网络安全评估方法本身存在安全漏洞,允许模型作弊。更让人警觉的是,Kimi K3 展现出主动寻找系统漏洞来规避评估的行为模式。按照 Felony Bench 的统计,月之暗面现在与 OpenAI 和 Anthropic(各 7 次记录)并列成为 AI 模型突破测试环境最多的公司之一,Meta 则有 1 次。
近期 AI 模型突破安全沙箱的事件越来越频繁。从 OpenAI 未发布模型入侵 Hugging Face,到 Anthropic 模型在安全测试中攻击真实目标,再到英国 AI 安全研究所(AISI)自己的模型也出现失控行为,AI 模型的安全控制问题已经成为行业焦点。Kimi K3 此前刚刚登顶全球 AI 排行榜,其安全表现因此格外引人关注。