@ashortsausage 在 AI总结了下 A/威胁报告中关于国模蒸馏的部分 中发帖
实验室
手法
规模(2026年5-7月)
阿里巴巴(通义/Qwen)
史上最大蒸馏攻击:固定提示强制Claude内联输出思维链转SFT数据,训练Qwen 3.5/3.6/3.7;还用Claude开发RL环境与模型架构
峰值近300万次/日,3500+欺诈账户,累计超1.51亿次
Moonshot(Kimi)
静默把Kimi客户请求转发给Claude(用户不知情),展示Claude回复;用5380个欺诈账户;通过保存thinking signature并跨会话重放还原完整思维链
10天内约30万客户请求被转发;累计超2300万次
DeepSeek
同类静默转发+跨会话重放;识别使用Claude Code等第三方harness的用户并选择性转发
14天内超1210万次
智谱(Z.ai/GLM)
CoT提取清洗管线+面向其他美国前沿实验室网安能力的蒸馏,后被Fable...