开源模型这东西,一旦放出来,就很难再被真正"封杀",美国政府自己的一个网站,恰恰用最戏剧化的方式印证了这一点。美国联邦公报网站悄悄地把核心搜索功能之一,建立在了一款中国制造的人工智能模型之上。
联邦公报是美国政府发布规章、通知与总统文件的官方日报,由国家档案与记录管理局负责运营。在其面向公众的高级文档搜索页面,用户想要检索超过百万份政府文件时,会看到五种"搜索模式"可供选择。
除了默认的语义搜索与纯关键词搜索之外,另外三个选项都与具体模型挂钩,其中一个基于msmarco-distilbert-base构建,另外两个则都是阿里巴巴开源模型通义千问Qwen3:0.6B的不同版本,界面上还标注着"512维、递归切分、蒸馏、前缀式"等技术细节。
换句话说,在美国联邦政府网站的搜索设置深处,藏着一个可以用中国阿里巴巴通义千问团队所开发模型来处理查询的选项。
这只是一个参数量不到十亿的小型蒸馏版本,远不及阿里巴巴旗舰级的Qwen3.8-Max那种曾被用来正面对标OpenAI与Anthropic顶尖模型的产品,但它终究还是不折不扣的通义千问,如今就嵌在美国联邦基础设施内部,作为检索行政规章、总统公告与监管文件的备选引擎之一。
讽刺意味拉满

过去几年,华盛顿对待中国人工智能模型的态度,与其说是对待软件,不如说是对待需要被隔绝的安全威胁。DeepSeek曾被禁止出现在商务部设备上,海军与NASA也将其封锁,国会两党议员更是联手推动了一项名为"政府设备禁用DeepSeek法案"的立法。
多个州政府随后跟进出台了各自的禁令,国会方面的整体立场是,这类被认为"服务于威权利益"的人工智能,根本不应该出现在美国政府系统中。可现实是,一个帮助公众查阅联邦法规的政府搜索工具,如今却把一款中国模型列为检索选项之一。
这似乎并不是境外厂商偷偷夹带私货的结果,Qwen3:0.6B是在Apache 2.0协议下开源、权重公开的模型,任何开发者,包括联邦承包商或政府内部技术团队,都可以直接下载并集成进项目,根本无需与阿里巴巴有任何接触。
据推测,事情的经过很可能就是,负责维护联邦公报搜索系统的技术人员,出于模型体积小、能力强、完全免费的考量,选中了这款模型来驱动其中一种基于向量嵌入的搜索模式,就像从Hugging Face上挑选任何其他开源模型一样自然。
这也正是问题真正显得尴尬的地方。这并非某个员工手机上偷偷安装的"流氓应用",也不是DeepSeek禁令最初针对的那类场景,而是一小段开源机器学习基础设施,恰恰因为好用、免费、易于集成,才最终悄然出现在政府系统内部。
开源几乎不可能被真正封住
这才是标题背后更棘手的问题。政府可以禁止某款应用,可以封锁某个域名,也可以要求员工不得下载某个聊天机器人,但一旦一套模型权重被公开发布,就几乎无法阻止它被复制、嵌入、微调,并悄悄流入成千上万个毫不相关的产品之中。
通义千问团队一旦开源某个模型,它就会同时出现在Hugging Face、魔搭社区乃至无数镜像站点上,任何人都能下载后塞进搜索框、聊天机器人或文档分类器,完全不必经历采购受限厂商网络设备时才会遇到的那种审查。
这一难题因为小型开源模型本身越来越强而更加突出。

阿里巴巴几乎覆盖了所有参数规模,从面向边缘设备与本地推理的0.8B到9B系列,一路做到能对标顶尖模型的旗舰产品,即便是最小号的版本,性能也往往足够优秀,工程师们默认就会优先选用。
Qwen3:0.6B以现在的标准来看体积极小、运行成本低廉,却在语义搜索上足够胜任,以至于悄然进入了一个政府采购的搜索页面,参与其中的人恐怕从未把这当作一次"采用中国人工智能"的决策,在他们眼里,这不过是一款恰好出自阿里巴巴通义千问实验室、而非美国实验室的轻量级嵌入模型。
同样的开源策略,也支撑着阿里巴巴在消费端更大规模的布局,从把通义千问作为服务超过一亿用户的夸克浏览器的"基础系统引擎",到直接以开放权重而非封闭API的方式发布前沿级模型,这是一套刻意为之、并且行之有效的分发策略,其效果甚至可能让那些希望在中美人工智能之间划出清晰界线的政策制定者感到棘手。
需要指出的是,联邦公报使用Qwen3:0.6B做搜索嵌入本身并不构成真正的安全风险,它是在本地运行、权重公开的小模型,只用于给搜索结果排序,而不是一个会把数据传回中国服务器的托管聊天机器人。
但这件事仍然提醒人们,华盛顿一直试图在"中国人工智能"周围划出的那条界线,在现实中远比政治话语中显得模糊得多。禁令针对的是应用与厂商,而开源权重根本不理会这两种分类,它总有办法出现在人们最意想不到的地方,包括政府自己用来管理政府文件的目录系统里。
成为付费用户可以阅读 阿里巴巴 所有资料
了解更多 →