本周三,白宫高级技术官员公开指责中国初创公司 Moonshot AI 秘密复制 Anthropic 的 Fable 模型,用于构建其新的 Kimi K3 AI 模型。就在 Moonshot 准备公开发布该模型之际,此举加剧了中美在 AI 领域的整体冲突。
白宫科技政策办公室主任 Michael Kratsios 在 X 平台发帖称,其办公室掌握的信息显示,Moonshot 通过一个专门构建的内部系统执行复制操作,并反复切换访问路径以隐藏痕迹,从美国模型中提取数据。Kratsios 还指出,该操作依赖部署在泰国的 NVIDIA GB300 服务器,这些芯片属于英伟达最强大的产品之一,而美国的出口规则禁止其流入中国。
Kratsios 写道:“大规模、隐蔽的工业蒸馏,旨在窃取美国专有技术并损害美国研究,这是不可接受的。”
Moonshot 被指控使用的技术称为“蒸馏”(distillation),即通过将强模型的输出输入到弱模型,训练弱模型模仿强模型。如果公开且小规模进行,这种做法在法律上是被允许的,且行业常见。但 Kratsios 指责的是 Moonshot 进行了隐蔽的、工业规模的蒸馏,这被广泛反对,他认为这本质上是盗窃,而非常规工程。
此次指控基于 Anthropic 今年早些时候发布的调查结果。在 2 月的一份报告中,Anthropic 称追踪到超过 340 万次 Claude 对话来源自 Moonshot,这些对话通过数百个虚假账户路由。Anthropic 表示,部分账户记录与 Moonshot 自家高级职员的公开资料吻合。据该公司称,这场行动针对的是 Claude 在推理、编码和视觉方面的优势。
Moonshot 于 7 月 16 日发布了 Kimi K3。该模型拥有 2.8 万亿参数,是迄今发布的最大开源权重模型。由于热度极高,公司仅在两天内就暂停了新用户注册。完整模型权重预计于 7 月 27 日公开,Anthropic 认为这存在风险,指出通过复制构建的模型会缺失原模型的安全护栏,一旦权重公开,将脱离任何人的控制。
2025 年 1 月,AI 专员 David Sacks 曾称 DeepSeek 复制了 OpenAI 的模型,但遭到 DeepSeek 的坚决否认。北京方面也驳斥了 Anthropic 2 月的调查结果,称其毫无根据。Moonshot 尚未公开发表评论,Kratsios 也未提及任何可能的处罚。此次争端发生之际,中美两国政府正准备于 9 月举行 AI 会谈。尽管美国在 AI 领域的投入几乎是中国的 23 倍,但中国实验室仍在不断缩小中美 AI 模型之间的差距。
免责声明:本文提供的信息不是交易建议。BlockWeeks.com不对根据本文提供的信息所做的任何投资承担责任。我们强烈建议在做出任何投资决策之前进行独立研究或咨询合格的专业人士。