Kimi K3 全面开源:2.8万亿参数的全球最大开源模型,与500亿美元估值狂奔

7月28日凌晨,月之暗面正式开放 Kimi K3 权重。总参数 2.8 万亿、激活 1042 亿,这个数字直接把全球开源模型的天花板顶到了新的高度——在此之前,没有任何开源模型摸到过万亿参数的零头。上线 30 分钟登顶 Hugging Face 趋势榜,以 1679 分登顶 Frontend Code Arena 前端编程榜单,为中国大模型首次拿下该项第一。

这不仅仅是一次开源发布。K3 背后,是月之暗面一年六轮融资、估值从百亿冲到 500 亿美元的资本狂奔,也是中国 AI 模型在全球开源格局中一次标志性的换位。

2.8 万亿参数意味着什么

K3 的规模让开源社区集体”破防”:总参数 2.8 万亿,是此前开源旗舰的数十倍;原生多模态视觉理解能力,100 万 token 上下文窗口。综合能力据称仅次于 Anthropic Claude Fable 5 和 OpenAI GPT-5.6,马斯克公开评论”Impressive”。

规模之外,真正的杀手锏是成本。官方给出的数据:运行成本仅为 Fable/Sol 的 1/2 到 1/3,特定查询缓存后低至 1/10。也就是说,K3 用接近开源的价格,跑出了接近闭源旗舰的能力——这直接击穿了”开源模型 = 便宜但平庸”的旧等式。

生态适配的速度同样惊人:

  • 华为昇腾:开源即 0day 适配,Atlas 800 A3 / 900 A3 SuperPoD 训练复现,昇腾 950 超节点支持 mxFP4 量化权重
  • 阿里云:真武 M890 超节点 Day0 适配,首 Token 时延降约 35%、单卡解码吞吐提升 1.8 倍,千问平台与百炼同步提供 K3 API

算力紧缺:幸福的烦恼

K3 上线 48 小时后,用户请求量逼近集群承载极限。7月19日,月之暗面官方发文暂停 C 端新用户订阅,算力优先保障付费老用户——这不是饥饿营销,而是真真切切被流量打穿了。一个刚开源就”求用户别来”的模型,在 AI 行业历史上都算罕见。

一年六轮融资,估值 500 亿美元

融资节奏比模型发布更凶猛:

  • 1-2月:连融 3 轮,估值 100 亿 → 180 亿美元
  • 5月:D 轮,200 亿美元
  • 6月:E 轮,投前 315 亿美元
  • 7月29日:F 轮超 35 亿美元,估值 350 亿美元,超额 3 倍以上提前关闭
  • 7月底:G 轮(Pre-IPO)提前启动,投前估值 500 亿美元,机构称认购踊跃”可能下周关闭”

单轮 35 亿美元是中国大模型第二大融资纪录(仅次于 DeepSeek 6 月约 510 亿元融资),累计融资超 376 亿元。据 RFI/彭博报道,月之暗面已向投资者发出股东决议寻求支持香港上市,最早 6 个月内 IPO,已与中金公司、高盛洽谈。

商业化数据撑得起这个估值:ARR 2026 年 3 月破 1 亿美元,5 月 2 亿,6 月站稳 3 亿美元——三个月翻三倍;API 收入占七成以上;K3 发布后日销售额至少增长 6 倍。中国 AI 模型已占 OpenRouter 等平台整体使用量 60%。

对行业格局的三点冲击

第一,开源闭源的性价比天平被撬动。K3 的 1/2 到 1/3 运行成本,让”自部署还是用 API”的选择题重新变得艰难。对 DeepSeek、GLM 等开源阵营来说,压力直接拉满——DeepSeek V4 GA 已两度延期到 8 月中旬,V4-Pro 预览版榜单排名跌至第 25 位,低于 Kimi K2.7 Code 和 MiniMax M3。

第二,中国开源模型开始反向输出标准。昇腾 0day 适配、阿里 Day0 适配,说明国产算力厂商把 K3 当成事实标准来跟。黄仁勋公开力挺中国开源大模型(DeepSeek、Kimi),称”优秀开源模型应被美国公司使用”。

第三,开源社区的信任投票。K3 上线 30 分钟登顶 HF 趋势榜,全面开源后自由下载、微调、商用部署——开源社区用脚投票,选择了这个新王。

下一步值得盯的:G 轮是否会真的”下周关闭”、IPO 时间表、以及 8 月中旬 DeepSeek V4 GA 与 K3 的正面交锋。2026 年的开源大模型之战,才刚刚进入高潮。


← Back to blog