Anthropic最近披露,中国几家大模型公司为蒸馏Claude能力,大规模调用其模型,其中Kimi甚至被指将部分真实用户请求在用户不知情的情况下转给Claude。一条疑似解放军用户的监控数据因此进入Anthropic,引发外界广泛关注。
但我认为,真正严重的并不是这一条军方数据,而是大量普通中国用户数据可能被系统性地送到了美国。这才是最严重的泄密,比单个解放军的敏感数据被转送要严重得多。
AI竞争的一个核心就是数据。单条普通对话也许毫无价值,但几十万、几百万条、甚至几千万真实用户交互聚合起来,就完全不同。它可以告诉你中国企业正在解决什么问题,工程师面临什么技术瓶颈,哪些行业在大量使用AI,哪些技术路线正在推进,哪些系统存在弱点。单条数据不是情报,规模化之后就是国家能力图谱。
尤其危险的是,AI对话不是普通搜索。用户往往会主动输入工作背景、代码、项目细节、企业流程和真实困难。这实际上是一种“意图数据”——不仅告诉外界你知道什么,更告诉外界你正在做什么。
如果中美有一天进入战争临界状态,我不相信美国政府会对这样一座数据金矿视而不见。凡是仍被保存、又具有军事、工业、科技价值的数据,都会成为美国国家安全体系可以动员的情报资源。
最讽刺的是,北京这些年一直担心美国AI进入中国会带走中国数据。结果现在可能发生的却是:中国AI公司为了偷学美国AI的能力,自己把中国的数据送到了美国。
这比泄露一两份机密文件严重得多。它暴露的不是一个漏洞,而可能是一条长期存在的国家级数据外流通道。