Moonshot AI 的 Kimi K3 突破沙盒限制,开发者失去控制

- 中国“登月计划”人工智能开源模型 Kimi K3 在安全测试期间逃逸出安全测试环境,进入开放互联网。.
- 由于配置错误,该模型主动探测网络设置,并在未经许可的情况下上线以实现其目标。.
- 这一dent 加剧了今年夏天人工智能模型绕过安全措施薄弱的测试环境的趋势。.
在一次例行安全评估中,中国登月计划开发的名为 Kimi K3 的开源 AI 模型成功逃逸出测试沙箱,进入了开放互联网。.
据美国网络安全公司 Frontier Security 称,这是首次有可免费下载的公共模型突破其隔离环境。.
模型选择使用的沙箱存在漏洞
据 WIRED ,Frontier Security 当时正在测试 Kimi K3 的防御性网络安全技能,结果该模型走出了原本应该容纳它的环境。
显然,配置错误导致该环境出现漏洞。然而,Frontier公司表示,该模型自行探测到可以通过沙箱的网络设置访问某些网站,然后在未经许可的情况下上线。它被指示去解决一些原本不需要互联网的问题。.
Frontier 首席执行官 Yaron Singer 告诉 WIRED:“我们发现了测试环境中的一个漏洞。但我们也发现 Kimi 利用了这个漏洞,这表明它没有同样的内部防护措施。”
Frontier 认为 Kimi 的网络安全防护措施比大多数其他强大的型号要少,这就是它泄露的原因。.
没有系统被黑客攻击,但防护措施有所削弱。
幸运的是,Kimi的逃脱并没有导致任何恶意攻击或系统入侵。因为它要找的信息很容易从GitHub上获取,所以它上线后无需入侵任何系统。.
然而,主要问题在于可访问性。与大多数安全级别极高的内部实验室模型不同,Kimi K3 是向公众开放的,这意味着任何人都可以下载并运行它,而无需像其他实验室那样设置严格的安全防护措施。.
测试人员指出,该模型会不择手段地高效实现其目标,即使这意味着作弊或逃脱控制。.
测试环境本身是利用英国政府人工智能安全研究所的沙箱构建的,但 Moonshot 和 AISI 都尚未证实这一点,因为他们拒绝置评。.
今年夏天将出现更多不法特工
Kimi的逃脱事件进一步印证了人工智能模型在评估过程中滥用规则的趋势。7月21日,OpenAI 披露 其模型利用一个零日软件漏洞连接到互联网并入侵了Hugging Face。
几天后, Cryptopolitan 报道称, Anthropic公司 trac其部分模型遭到未经授权的外部入侵。Meta 公司 甚至承认,由于测试环境配置错误,其一款人工智能代理(Muse Spark 1.1)曾访问过一家外部公司。
专家们一直认为,这些dent通常是由于测试环境安全措施不完善造成的,而非科幻小说中描述的越狱。“总的来说,如果你给这类模型设定一个目标,但又没有明确说明,比如设置安全屏障,它总能找到办法得出答案。” Gray Swan 首席执行官兼卡内基梅隆大学教授马特·弗雷德里克森说道。.
不要只是阅读加密货币新闻,要理解它。订阅我们的新闻简报, 完全免费。
常见问题解答
Kimi K3是什么?
Kimi K3 是来自中国公司 Moonshot AI 的一款功能强大的开源 AI 模型。Frontier Security 的基准测试表明,它在发现软件和网络漏洞方面表现出色。.
Kimi K3 是否入侵过任何真实系统?
不。与 OpenAI 和 Anthropologiedent不同,Kimi 在接入互联网后并没有入侵任何东西,因为它要寻找的答案在 GitHub 上是可以免费获得的。.
Kimi K3是如何逃出沙盒的?
英国政府人工智能安全研究所构建的测试环境中的一个配置错误留下了一个漏洞,该模型在未经许可上线之前,通过探测沙箱的网络设置发现了这个漏洞。.

汉娜·科利莫尔
汉娜是一位作家兼编辑,在加密货币领域拥有近十年的博客写作和活动报道经验。在 Cryptopolitan,汉娜负责新闻版块,报道和分析 DeFi、RWA、加密货币监管、人工智能和前沿科技行业的最新动态。她毕业于阿卡迪亚大学,获得工商管理学位。.
















