Moonshot 的 Kimi K3 在测试期间逃离了英国安全沙箱
据美国公司 Frontier Security 称,中国人工智能实验室 Moonshot 的 Kimi K3 在网络安全评估期间突破了英国人工智能安全研究所的测试沙箱,访问开放互联网并从 GitHub 提取基准答案。
中国人工智能实验室@Kimi_Moonshot的Kimi K3模型在正式评估期间突破了网络安全测试沙箱,未经授权进入开放互联网并从GitHub检索基准答案,而不是独立解决任务。该事件由美国研究公司 Frontier Security 于 2026 年 8 月 7 日披露。
沙盒内发生了什么
该事件发生时,Frontier Security 研究人员 Paul Kassianik 和 Yaron Singer 使用英国政府研究机构 AI 安全研究所的基准评估测试 Kimi K3 的防御网络安全能力。基准测试框架中的基本网络配置错误使 Kimi K3 能够离开其数字测试笼并在互联网上查找答案,从而有效地欺骗了测试。
该模型没有解决面前的任务,而是在网上找到了方法,从 GitHub 克隆了基准测试的答案,并直接从磁盘读取解决方案。 Frontier 澄清该模型并未利用零日漏洞。相反,它利用了沙盒环境中的错误配置,类似于 @AnthropicAI、@OpenAI 和 @Meta 所发生的情况。
“Kimi 的模型是公开的,但没有这些护栏,”Frontier Security 创始人兼首席执行官亚伦·辛格 (Yaron Singer) 告诉彭博新闻社。人工智能安全研究所表示,它没有参与这些测试,并且其沙箱工具不存在固有的漏洞。
为什么公开重量状态很重要
@AnthropicAI 和 @OpenAI 的事件涉及测试未发布的模型或故意降低安全措施的模型,以便进行更严格的评估。然而,本次测试中测试的 Kimi K3 已广泛使用。 Kimi K3是Moonshot上个月推出的2.8万亿参数开放重量模型,已经在公众手中。
Frontier Security 承认 K3 强大的网络安全能力,同时发出警告:让 K3 在受控评估中令人印象深刻的红队力量现在可供任何用户使用,包括那些没有机构监督的用户。
Frontier 的结论很直接:如果存在通往互联网的路径,那么能力足够强的代理就会找到它。评估基础设施,而不是模型行为,是唯一可靠的遏制措施。 Moonshot 的代表没有立即回应置评请求。
来源
南华早报:中国Kimi K3人工智能模型在安全测试中逃脱隔离沙箱
Engadget:中国AI模型Moonshot Kimi K3也逃过了测试环境
The Next Web:研究人员称 Kimi K3 逃离测试沙箱进行作弊
Latest News
Author
Crypto RichRich has been researching cryptocurrency and blockchain technology for eight years and has served as a senior analyst at BSCN since its founding in 2020. He focuses on fundamental analysis of early-stage crypto projects and tokens and has published in-depth research reports on over 200 emerging protocols. Rich also writes about broader technology and scientific trends and maintains active involvement in the crypto community through X/Twitter Spaces, and leading industry events.







