返回博客
技术观察

谁有权训练谁?

📅 2026.09 ⏱️ 8 min 👤 Eric Pan

Kimi–Claude 争议里,最该追问的不只是模型有没有越界,还有用户的提问最后去了哪里。

Anthropic 在 2026 年 9 月的一份威胁情报报告中指控,Moonshot 将部分 Kimi 客户请求转发给 Claude,并保存部分交互用于提取推理轨迹和训练模型。报告同时明确表示,它不知道 Moonshot 是否告知了相关用户。

这件事很容易被说成“Kimi 有没有偷 Claude”,也很容易变成“大模型本来就会互相学习”的站队题。但两句话都省略了关键细节:模型服务是怎么被调用的,输出能拿来做什么,用户的内容又被送到了哪里。

资料核验截至 2026 年 9 月 17 日。本文讨论技术、合同与数据治理问题,不构成针对具体当事人的法律意见。

先看报告到底说了什么

报告里有两组数字,最容易被混在一起。一个十天窗口内,约 30 万条客户请求被转发;2026 年 5 至 7 月,另有超过 2300 万次蒸馏交互被归因于 Moonshot。后一个数字不是用户数,也不能证明有 2300 万名用户的数据被转交。

还要记住,这是一份由 Anthropic 发布的技术归因报告,不是法院判决。它提供了值得核查的证据,但访问方式、账户关系、用户是否知情、训练数据如何形成,仍然要各自举证。把报告直接当结论,或者因为报告来自竞争对手就一概不信,都太省事。

蒸馏不稀奇,数据怎么来才是关键

知识蒸馏并不神秘:一个模型通过另一个模型给出的答案、解释或其他信号来学习。公司内部会用,获得授权的合作也会用。方法本身很常见,真正需要追问的是训练样本从哪里来,又被允许拿来做什么。

推理轨迹比最终答案更值钱,因为它留下了拆题、验证和修正的过程。不过,拿到一段 reasoning 不等于拿到模型权重,更不等于复制了整个模型。能观察到的输出和受保护的内部信息之间,仍然隔着很长一段距离。

所以,“Claude 可以学习互联网,Kimi 为什么不能学习 Claude”确实值得问,但它不能直接替任何一方免责。Claude 的训练数据需要说明来源,Kimi 的蒸馏数据同样需要说明怎么取得。把前者一律叫学习、后者一律叫偷窃,或者反过来,都只是先选立场再找理由。

买到输出,不等于买到所有用法

Anthropic 的商业条款说,客户在法律允许的范围内拥有输出;同一份条款又限制客户利用服务开发或训练竞争模型。两句话看起来拧巴,其实谈的是不同事情:输出归谁是一回事,签约后答应怎么用又是另一回事。

AI 输出也并非天然都受完整版权保护。人类创作部分、输出中已有作品的表达、纯机器生成部分可能处于不同状态。即使某段输出缺乏版权,也不能自动抹去有效合同;而一家公司的服务条款,也不能不经分析就变成约束所有市场参与者的普遍法律。

比起抽象争论“回答到底属于谁”,更有用的问题是:谁接受了哪一版合同,输出通过什么账户和渠道取得,限制条款是否真的生效,相关行为又能不能归到具体主体头上。

模型公司能谈妥,用户的数据却未必

即使源模型提供者明确允许蒸馏,真实用户的任务仍可能沿着另一条链路流动:

用户内容 → 前端 AI 产品 → 第三方模型 → 保存与整理 → 学生模型

这条链路里的提示词,可能是个人信息、公司内部代码,也可能包含第三方作品。用户能把内容粘贴进输入框,不代表他有权替所有相关人作出无限授权;同意让产品完成眼前的任务,也不等于同意数据被长期保存并用于训练。

因此,产品至少要说清楚:内容实际发给了谁,为什么要发,保存多久,会不会进入训练,用户又能不能查询、限制或删除。源模型和蒸馏方即使彼此授权,也替代不了用户对自己数据流向的知情和选择。

真要判断有没有越界,就看这四件事

这类争议很难靠一句“正常学习”或“技术盗窃”说清楚。我更愿意顺着实际过程问四件事:

对做产品的人来说,改进也不复杂:明确告诉用户是否会调用第三方模型;允许企业管理员限制供应商;把完成当前任务和后续训练分开征求同意;记录数据来源和允许用途。路由审计只需记下接收方、用途和授权状态,没有必要再复制一份完整对话。

别把用户从故事里删掉

模型当然需要学习,市场也需要竞争,否则能力会被少数服务商永久锁住。但“允许学习”不能顺手变成一张万能通行证,把访问方式、合同承诺和用户数据全部盖过去。

想学习别人的模型,就说明自己守住了哪些边界;想阻止别人学习,也要说明依据的是合同、版权,还是技术访问控制。无论双方怎么争,最初提交问题的用户都不该消失。

模型公司可以继续争论谁能学谁,至少先让用户知道:自己的内容去了哪里,又会被拿来做什么。

主要资料:Anthropic 2026 年 9 月威胁情报报告、Anthropic 商业条款、美国版权局 AI 输出说明、《中华人民共和国个人信息保护法》及 FTC 关于 AI 隐私与保密承诺的说明。