
Kimi K3 开源,AI 大模型的游戏规则正在被改写
上周 AI 圈出了一件大事——月之暗面(Moonshot AI)发布了 Kimi K3 模型。2.8万亿参数的 MoE,关键是还开源,7月27日放权重。这个体量的模型开源,说实话在业界引起了不小的震动。
跑分这块我就不详细列了,简单说一下它的位置:Vals AI 综合排第二,Artificial Analysis 排第三(仅次于 Claude Fable 和 GPT-5.6 Sol Max),Frontend Code Arena 排第一。对于一家中国创业公司来说,这个成绩有点吓人。毕竟 Anthropic 和 OpenAI 烧了多少钱,大家心里都有数。
为什么说这事儿影响很大
以前大家总觉得中国 AI 公司是"跟跑",靠蒸馏、模仿、快速迭代来追。但 Kimi K3 的发布改变了这个叙事。它的架构设计——Kimi Delta Attention 和 Attention Residuals,加上 896 个专家只激活 16 个的 MoE 方案——这些都是实打实的原创工作。
更重要的是,它开源了。这意味着全球的开发者、研究者、中小企业,都能拿到一个和顶级模型只差一点的免费方案。这对 OpenAI 和 Anthropic 的商业模式来说,是个实实在在的冲击。有分析人士说"开源模型天然是减速主义",因为会压低闭源模型的利润空间,进而影响整个行业的投入节奏。
华盛顿也坐不住了
有意思的是,Kimi K3 还引发了华盛顿的一场内斗。Axios 报道说,白宫内部对怎么应对中国开源模型分歧很大。有人认为应该直接封禁,有人觉得封了反而会促使中国建自己的生态。两边谁都说服不了谁。
与此同时,国内的态度倒是很明确。上周 WAIC 上高层直接表态支持开源生态。阿里巴巴也跟进了,宣布 Qwen 3.8 即将开源,这又是一个 2.4 万亿参数的大模型。开源阵营的弹药越来越足了。
对普通开发者意味着什么
如果你不是搞大模型训练的人,这事的直接影响可能没那么大。但换个角度想——未来你调用的 API 可能会更便宜,你能本地跑的模型可能会更强。国内几个大厂已经开始打价格战了,API 调用成本跌到了地板价。开发者这波,是真的能吃到红利。
接下来几个月会很有看头。DeepSeek V4 据说也要出正式版了,GLM-5.2 已经跑了不错的数据,阿里还在路上。2026年的AI格局,还远没定下来。
评论 (0)
暂无评论,来写第一条吧 ✍️