Kimi K3 这次是真的强,早上看到报道,阿里助力他们 2 万颗 GPU,这下可以敞开蹬了。最近我一直挺关注 K3 的,墨问 CatReader 上也很多相关文章和评论。先看一组数字:K3 发布后一周,Kimi 应用全球下载量超过 93 万,美国约 8.6 万,较前一周增长 387%,Mozilla CTO 也把不少日常工作切到了 K3。K3 是一个 2.8 万亿参数的混合专家模型,每个 Token 激活约 1040 亿参数,支持原生多模态和 100 万 Token 上下文。整体评估下来,其综合能力仍落后于 Claude Fable 5 和 GPT-5.6 Sol,但在 Coding、Agent 和知识工作上已经进入全球头部区间,价格也低于同档闭源模型。 arena.ai 的 Coding 榜单上,claude-opus-5-max 第一,kimi-k3-max 第二,非常了不起。 K3 权重发布后,Hugging Face 模型页近月下载量约 56 万,并出现 29 个微调和 27 个量化版本。开发者真的下载、复测和改造一个 1.56TB 左右的模型,这个显然更说明问题。不过,Kimi K3 发布后的第一个周末,月之暗面就暂停了新增订阅。因为请求远超预期,算力不够啊。咋整呢?今天看到 Reuters 转述彭博社的报道,月之暗面通过与阿里的算力合作,获得了一个约包含 2 万颗 Nvidia GPU 的集群,K3 建立在这套基础设施之上,估计预约订阅的同学很快会收到许可。 > 具体芯片构成、合同价格以及训练和推理资源如何分配,目前并未完整公开。应该是个爆料的消息。那么,阿里为什么要帮助一个可能与 Qwen 竞争的模型?我这么理解的,它既是月之暗面的投资人,也是云计算服务商,还拥有自己的旗舰模型。Kimi 做得好,阿里可以获得投资回报和云收入;Qwen 做得好,阿里得到模型价值,这是个自然组合,挺好,关键是,K3 排名第二,这可能是我们最接近 SOTA 的一次。月之暗面以及中国模型依赖 Nvidia,也不是啥坏事,替换从来不是一蹴而就。数万卡集群需要显存、高速互联、集合通信、编译器、算子和故障恢复一起工作,Nvidia 这方面当然有优势了,但国内芯片厂商正在追赶,就像梁文锋所言,只是时间问题。短期看,月之暗面需要阿里的卡;长期看,阿里也需要 Kimi 这样的热门模型持续制造算力需求,把昂贵的集群变成有人付费的服务。逼近,能够大规模运行开放权重模型并提供服务的能力仍集中在少数云厂商手里。 Kimi K3 拿到阿里的 2 万颗 GPU 提醒我们,模型竞争的下半场还要看谁能长期获得算力、谁能稳定服务全球用户。对于普通用户来说,我觉得 K3 可以预约起来了,算力也许马上就到:)

MacTalk 2026-08-02 13:00
推荐阅读