^__^ • 9 / 18
美国联邦公报咋还偷偷用上 Qwen 了?又看到一个有趣的事儿。上周,FBI 刚刚指控阿里巴巴“恶意”抄袭 Anthropic 的模型来构建自己的 AI 工具,说中国 AI 公司正以“工业化规模”的方式复制美国技术。几天后,有路透社记者发现,美国政府自己的网站——联邦公报(Federal Register)的官网,一直在提供一个由阿里 Qwen 模型驱动的 AI 搜索,供公众浏览法规草案下的公共评论。到周三相关截图开始在 x.com 等社交媒体上传播,同一天,页面上的 Qwen 被悄悄撤下。有人说,这就尴尬了吧,但是,只要你不觉得尴尬,尴尬的就是别人。查了下资料,发现这个联邦公报是由国家档案馆运营,用来发布法规、公告和总统文件的网站。之前的高级搜索页面有五个模式,其中两个跑在 Qwen3:0.6B 上——一个 6 亿参数的蒸馏小模型,页面标注着“512 维向量、递归切分、蒸馏”这类技术字样。现在看都没了,就剩下关键词和语义两个默认选项。要我说啊,其实真没必要,我们又不介意 之前不是说国家安全部门啊,机构啊,就不能用中国 AI 模型吗?咔这边就用上了。我觉得,这在米国的各种机构和企业里,可能是个常见的现象。好用开源免费为什么不用呢?乔治城大学法学教授 Anupam Chander 对路透社说,这个用法看起来没有直接的网络安全风险,因为联邦公报的内容本身就是公开的,模型并不接触敏感的政府信息。我想,这正是开放权重模型的特点。Qwen 和 Kimi 等开源权重公开可下载,许可协议大都是 Apache 2.0 这样的自由协议,完全可以跑在使用者自己的服务器上,跑在内网里,数据不需要交给任何供应商。这意味着开源模型的提供商根本不需要“进入”那个联邦系统——更可能的剧情是,某个承包商或工程师从 Hugging Face 上把模型拉了下来,就像拉取任何一个免费模型一样,选型逻辑也简单:便宜、本地运行、性能够好,就完了。我记得今年四月还有个新闻,国会质询 Airbnb 为什么用 Qwen,可见商业世界早就用脚投过票了。无论是在 Windows/Mac/Linux 时代,还是 Android/iOS 时代,开源和闭源商业模式永远是并存的,互相制约,互相发展。互联网时代,西方贡献的优质开源项目众多,几乎支撑了整个互联网的发展,到了 AI 时代,中国对开源模型的贡献更多些,这不是好事吗?历史发展充满戏剧性。当年中国互联网是站在西方开源软件的肩膀上长大的,大家都说这叫生态。如今风向调转,最好的开源模型从中国长出来,我觉得吧,这是个新的肩膀,挺好。