塔斯娱乐资讯网

这一回,美国是真有点输急眼了。 最近,美国三家权威机构联手发布公告,把深度求索

这一回,美国是真有点输急眼了。

最近,美国三家权威机构联手发布公告,把深度求索、智谱、阿里等六家中国 AI 企业挨个点名,帽子扣得不小:指控中方靠"大规模知识蒸馏",把美国前沿模型的能力弄到手。中方回应得毫不含糊:指控既无事实支撑,也无法律依据,是把技术问题政治化的老把戏;华盛顿若执意打压,北京的反制绝不会缺席。可这场风波的要害,压根不在"蒸馏"两个字上。

知识蒸馏本就是全球 AI 研发通用的正当手段,是模型迭代、技术往来的常规操作,算哪门子偷窃?更讽刺的是,这套技术的合规性美国自己都认,轮到中国企业,就成了"工业规模窃取",双重标准摆得连遮都不遮。
 
先看这顶帽子是怎么扣下来的。美东时间9月8日,国家安全局、网络安全与基础设施安全局、联邦调查局三家联手,发了一份编号AA26-251A的网络安全公告。情报机构、网络机构、执法机构,三块招牌一起亮阵,阵势摆得不小。可翻开内容,说来说去,就是"蒸馏"这两个字。
 
被点名的六家,都是中国AI圈响当当的名字:深度求索、月之暗面、阿里巴巴、稀宇科技、阶跃星辰、智谱。公告还点了美国这边的模型:Anthropic的Claude、OpenAI的ChatGPT、谷歌的Gemini、xAI的Grok。意思是,这六家把这四款美国模型的能力,批量弄到手了。
 
数字说得有鼻子有眼。公告称,自2024年末以来,这些企业通过数百万次请求,从美国前沿模型里弄出了数十亿个token的输出,用来训练和改进自家模型。听着挺唬人。可token是模型对话的基本单位,数十亿这个量级,放在全球开发者日常调用里,真不算夸张。
 
中国商务部9号就回了话,八个字:于事无凭,于法无据。意思是,你说我偷,可你拿不出站得住的证据,也找不出哪条法律管这事。还撂下一句,华盛顿要是执意打压,北京的反制不会缺席。这回应不绕弯子,把球踢了回去。
 
往前捋,这场闹剧不是9月才开头。今年2月23日,Anthropic先发制人,指控深度求索、月之暗面、稀宇科技三家,用了超过2.4万个账户,进行了1600万次"被判定为有蒸馏意图"的交互。一家企业,越过法庭,直接跑到监管机构和舆论场去告状,这本身就透着急。
 
到了6月,Anthropic又把矛头对准阿里,说对方用2.5万个虚假账号,跑了2880万次API调用。数字越报越大,可性质还是那一套:拿对手的接口做测试、做训练样本。问题是,用接口做交互,到底算正常使用还是算偷窃,界限本就模糊。
 
最讽刺的一笔,在7月20日。那天旧金山联邦法院正式批准了一项创纪录的和解协议:Anthropic为了用盗版书籍训练自家的Claude,向近50万作家赔了15亿美元。一边告别人蒸馏自己,一边刚因用盗版书训练自家模型挨了重罚。这账,怎么算都滑稽。
 
说句实在话,知识蒸馏这技术,学界早就用烂了。说白了,就是拿一个已经训好的大模型当老师,让新模型去模仿它的输出,学得又快又省。哪家AI公司不在干这事?美国公司蒸馏中国开源模型的,也大有人在。轮到中国企业,就成了"工业规模窃取",标准随人定。
 
这桩闹剧其实早有铺垫。去年1月,OpenAI就放话,说中国公司"一直在试图蒸馏"美国模型。今年2月,又跑到美国国会众议院去告状。一家商业公司,反复跑到立法机构去诉苦,背后到底是受了多大委屈,还是想借政府的手收拾对手,明眼人一看就懂。
 
还有个细节值得嚼。这次被点名的模型,全是闭源的美国模型;而中国这六家,不少是靠开源起家的。你把模型藏在墙里卖接口,别人调多了几次,就说人家偷。可要是真有本事,何必怕人调?开源和闭源,本就是两条路线,谁也没规定闭源就高人一等。
 
我总觉得,美国这边真正的焦虑,不是被蒸馏了多少token,是中国模型的进步速度超出了预期。深度求索那套低成本训练思路,让不少人吓出一身冷汗。技术上的优势一旦被追上,心里就发慌。慌了,就容易把技术问题往政治上扯,往安全上扯。
 
这就带出一个绕不开的问题:接口调用,到底算不算窃?开发者注册账号、按次付费调用,这是平台自己定的规矩。人家花了钱,走的是公开通道,用得勤了些,怎么就成了"系统性窃取"?真要不让人调,关了接口不就完了。又想赚调用费,又想不让人学得快,天下没这两头占便宜的事。
 
我反倒觉得,这场风波的真正要害,不在技术,在政治。美国这两年在AI上被中国追得紧,深度求索一出,业界都惊了。技术上追不上,就把对手扣上"偷窃"的帽子,从商业竞争包装成国家安全。这样一来,禁售、打压、卡芯片,全都顺理成章。
 
更耐人寻味的是,这次是情报机构和执法机构出面,不是商务部,也不是法院。三份公告往那一摆,味道就变了:这不是在打官司,是在定调。把企业间的技术竞争,说成国家安全威胁,后续的制裁清单、出口管制,才有了由头。