美国驻华使领馆今晚(7月23日晚)写道:“美国财政部部长斯科特·贝森特:我们支持开源人工智能及其激发的创新。但开源并不意味着可以任意侵犯美国的知识产权。当中华人民共和国的公司开展隐蔽、大规模的蒸馏攻击,并且已经构成知识财产盗窃时,对这些公司实施制裁和将其列入实体清单都是我们可以采取的措施。”
7月23日晚上,美国驻华使领馆的社交账号突然更新了一条措辞强硬的声明,财长贝森特直接点名中国企业,用到了“隐蔽、大规模的蒸馏攻击”和“知识财产盗窃”这几个字眼,还撂下话,说要搞制裁、列实体清单。
很多老伙计看到这条消息,心里先是一紧,紧接着就是一头雾水:到底什么是“蒸馏攻击”?这词听着像化学课上的操作,怎么就成了大国较量的新战场了?我仔细读完那份声明,又去翻了一圈技术圈和法律界的资料,发现这事儿远不止放狠话那么简单,背后藏的是一把重新定义规则的软刀子。
蒸馏,在人工智能领域本来是个干干净净的术语。我打个比方您就明白,就像炖了一锅老火靓汤,这是大型语言模型,参数几千亿,成本高得离谱。
蒸馏技术相当于把汤里的精华倒进小锅收汁,得到一个小巧、跑得快还不贵的小模型,能力却能逼近原汤的七八成。这门手艺在技术圈就像炒菜会翻锅一样基本,甚至有不少开源的论文和代码公开教你怎么做。
真正刺到美方神经的,不是蒸馏本身,而是你拿谁的汤来收汁。这次美方罕见地用“盗窃”这个词,把技术路径直接定性成了刑事级别的指控,警告意味已经远远超出往日的贸易摩擦范畴。
关键矛盾在于“开源”这两个字的模糊地带。美国这些年大力推动开源模型,像Meta的Llama系列,看起来谁都能下载、修改。很多企业以为,我下载了就能随便用。
我专门去查了那份被很多人忽略的Llama 2社区许可协议,里头有一行字写得明明白白:只要你用了这个模型去开发任何产品,并且月活用户超过7个亿,就必须单独向Meta申请授权。此外,协议还严格禁止用它去训练、改进别的大语言模型。
现在你再看美方的指控逻辑就通了——他们所谓“隐蔽的蒸馏攻击”,翻译成大白话就是:你利用开源接口做大规模数据提取,训出了自己性能强悍的模型,还绕开了我的授权栅栏,冲击了我的技术护城河。
这让人不由得联想起几年前那场震动全球芯片业的风波。当年也是从技术授权、专利壁垒开始,一步步升级到实体清单和全面断供。
拿历史案例做锚点来看,这次路径简直如出一辙。先是把“蒸馏技术”这种中性工具打上“偷窃”的标签完成舆论铺垫,再引用长臂管辖的法律依据,让制裁看起来“师出有名”。
我的看法很直接,这根本不是临时起意的口水仗,而是一场早已起草好剧本的规则战。他们害怕的不是开源被偷,而是对手真的在开源这条跑道上跑赢了。
不少老朋友可能会问,那咱们的企业到底有没有越界?这让我想起一个细节,某国产大模型团队曾公开过一项技术报告,显示他们在训练早期阶段,用到了大量合成数据来提升小模型的推理能力。
这种合成数据的产生方式之一,就是通过大模型进行数据蒸馏。你看,当技术成为大国对弈的棋子时,是非对错就不再是简单的黑白色,而是一块谁都想捏住的长短板。
我今天可以很肯定地说,这件事带来的最紧迫的变化,不是那几家公司上了清单,而是所有依靠开源生态成长起来的国产AI,都将面临一次残酷的合规性大考。
我注意到,贝森特的声明里还有一句容易被忽略的话:“我们支持开源及其激发的创新。”这看似矛盾的姿态,其实暴露了他们在科技竞争中的深层焦虑。
他们在开源和闭源之间划了一条极细的红线:你可以拿开源技术去写诗、画画、做客服,但绝不能拿它来做出另一个能和我平起平坐的底座模型。
一旦触碰这条线,就会被立刻归入“知识财产盗窃”的范畴。这种策略,本质上就是在用国内法的长臂,把全球化协作的开源花园,强行分割成带铁丝网的私家苗圃。
落地到咱们普通人能感受到的影响上,这次的事件大概率不会止步于某个码农圈子里的震动。过去几年,凡是上了实体清单的领域,从基础研究到产品落地几乎都会迎来一次阵痛式的洗牌。
往近了说,那些重度依赖海外开源架构做二次创新的科技公司,可能要立刻启动技术路径的备份方案,否则随时面临底层技术的釜底抽薪。
往远了看,国产操作系统的突围故事,很有可能在AI大模型身上再来一遍。我甚至觉得,这反而捅破了一层窗户纸——从“可用”到“自主”,这道坎早晚得过。
回过头来看,今晚的这份声明像是一声发令枪,但它开启的未必是制裁本身,而是一场抢夺技术道德制高点的攻防战。他们是在用这种方式告诉全世界:规则由我来定,界限由我来画。
我的看法很明确,任何时候,核心技术的命门都不能捏在别人手里,这不是一句空话,而是眼前正在发生的残酷现实。这件事您怎么看,这些技术博弈最后会不会影响到咱们日常使用的智能工具?欢迎在评论区聊聊您的见解。
