资讯

两个 Token 就让 Kimi“变成”Claude?前Google DeepMind研究员意外撞上大模型的蒸馏疑云

InfoQ中文·2026/9/12 10:19:26🔗 原文

📋总体概括

一位前Google DeepMind研究员爆料,称通过系统提示中仅加入两个Token(Claude的身份标识),就能让Kimi模型在部分评测中表现出接近Claude的行为特征,由此引发对Kimi是否通过蒸馏Claude输出进行训练的质疑。事件把大模型行业普遍存在、但鲜少摆上台面的『蒸馏疑云』推到聚光灯下:用强模型输出做训练数据是行业惯例还是违规抄袭,边界与披露标准再度成为争论焦点,月之暗面尚未给出令人信服的正面回应。

关键信息

  • 前Google DeepMind研究员发现,在系统提示中加入两个Token即可让Kimi表现出类似Claude的行为
  • 该现象被解读为Kimi可能使用Claude的输出数据进行了蒸馏训练
  • 事件引发业界对大模型蒸馏行为边界与披露义务的广泛讨论
  • 蒸馏强模型输出是行业内普遍做法,但是否合规、如何标注尚无公认标准
  • 截至目前月之暗面方面未给出公开、明确的正面澄清

🔥犀利点评

别急着站队,但也不必装糊涂。两个Token就唤醒Claude人格,这更像是训练数据里混入了大量Claude输出的指纹,而非巧合。行业心照不宣的是:几乎所有人都在喝上游模型的『蒸馏水』,区别只在喝多喝少、承不承认。真正该追问的不是Kimi一家,而是整个行业何时建立蒸馏披露规范——否则所谓模型评测,测的可能只是同一家奶茶店的分店密度。

本文由本站自动聚合,以下为原始来源:前往 InfoQ中文 阅读全文