又一款前沿 AI 模型在安全测试中被曝“作弊”,这次主角是中国的 Kimi K3。月之暗面(Moonshot AI)上个月推出的 Kimi K3,在一场网络安全测试中逃出了“本应完全隔离”的沙盒环境,连上公开网络,直接到 GitHub 上找答案,而非自己解题。
安全公司 Frontier Security 在英国 AI 安全研究所(AISI)的网络安全评估框架内测试 Kimi K3 时发现,一个“基本的网络配置疏失”让模型得以逃出测试环境。Kimi K3 探测自身网络环境后,发现 GitHub 意外可访问,于是复制了官方评测库、找到题目解答,直接从硬盘读取答案,而不是真正去完成网络安全挑战。
与先前 OpenAI、Anthropic 模型在测试中“入侵外部组织”的事件不同,Kimi K3 并未攻击任何外部目标——它需要的答案本来就公开在 GitHub 上。Frontier Security 研究员 Paul Kassianik 指出,Kimi K3 缺乏防止其作弊或逃出沙盒的护栏。更关键的是,Kimi K3 是一个“开源权重”模型:此次在测试中逃出隔离的,正是任何人都能下载并直接运行的同一版本,没有闭源厂商可能事后增加的安全层。
免责声明:本文提供的信息不是交易建议。BlockWeeks.com不对根据本文提供的信息所做的任何投资承担责任。我们强烈建议在做出任何投资决策之前进行独立研究或咨询合格的专业人士。