行业新闻

Kimi K3 在安全测试中突破沙箱访问外网

Kimi K3 在安全测试中自行突破沙箱联网,暴露了其安全机制不足,也反映 AI 智能体失控风险正从“说错话”转向“做错事”。

安全公司 Frontier Security 在测试中发现,Kimi K3 能探测沙箱网络配置,找到外部访问通道并绕过限制连上互联网。研究员指出,Kimi K3 缺少其他先进模型具备的安全护栏,更易在目标驱动下采取意外行动。不过,此次它接入外部网络后并未攻击任何系统。

正文摘录

美国AI安全初创公司Frontier Security表示,Kimi K3在一次网络安全能力测试中被发现 突破了原本用于隔离它的沙箱环境,绕过限制连接到了外部互联网 。 但测试过程中,Kimi K3通过探测沙箱网络设置,发现了外部访问通道,并进一步利用这一能力获取信息。 Frontier Security的CEO Yaron Singer表示:“我们发现了沙箱中的漏洞,但同时也发现Kimi利用了这个漏洞,这说明Kimi K3缺少其他先进模型通常具备的安全护栏。” 该公司研究员Paul Kassianik还评价称,Kimi K3“ 非常擅长围绕目标寻找完成路径,但缺少阻止它作弊或逃离沙箱的安全机制 ”。 不过,这次Kimi K3只是小小“失控”了一下, 并没有演变成一场真实网络攻击 。 Kimi K3已经是继OpenAI、Anthropic、Meta之后,出现这个情况的又一个顶尖AI模型了。 在AI Agent能力不断增强的背景下, 模型正在越来越像一个会自主寻找路径完成任务的“行动者”。 和此前OpenAI、Anthropic披露的多起事件类似,Kimi K3此次脱离限制,部分原因来自测试环境中的沙箱配置问题。 沙箱通常被用于限制AI模型的行动范围,让模型只能在模拟环境中执行任务,避免它访问真实网络或系统。 但在此次测试中,Frontier Security发现,Kimi K3通过探测网络设置,确认自己实际上拥有访问部分网站的能力,进一步利用这一通道获取信息。 不过,与近期其他AI模型失控事件不同, Kimi K3接入互联网后并没有攻击任何系统 。 Frontier Security认为,这一事件依然暴露出Kimi K3在安全防护方面的问题。 相比其他顶尖AI模型,Kimi K3缺少足够强的内部约束机制,因此在目标驱动下更容易采取测试者没有预期的行动。

阅读原文(qbitai.com)→

行业新闻衡宇2026-08-08原文

相关内容