
2026年的夏天,中国大模型赛道迎来了新的分水岭。7月中旬,月之暗面发布了全球最大开源模型Kimi K3,以2.8万亿参数、100万词元上下文窗口和原生多模态融合能力,直接冲上各大AI头条。它不仅在多项权威测评中超过GPT-5.6等闭源模型,更以“开源+超大参数”的组合拳,重新定义了行业的技术天花板。
但更值得关注的,是这场技术秀背后愈演愈烈的资本肉搏。月之暗面与DeepSeek,这对曾经的“友商”,正上演一场典型的互联网式逆袭与反逆袭。故事的上半场属于DeepSeek——2025年春节,它凭借极致性价比和硬核技术从巨头夹缝中杀出,R1模型让全球看到了强化学习在小参数模型上的潜力,一举成为开源界“黑马”。而下半场,属于月之暗面。Kimi K3的发布,标志着行业从“小参数、低成本”的路线,重新转向“参数竞赛”的深水区。
Kimi K3的参数从上一代的1.04万亿跃升至2.78万亿,增长167%,激活参数也翻了超两倍。这种跨越式增长并非单纯堆料。月之暗面团队在技术报告中指出,过去一年行业过度聚焦后训练(强化学习、思维链),却忽略了预训练基座对模型能力上限的决定性作用。当海外头部模型开始限制API访问、蒸馏路径变窄,重仓预训练、做大基座,就成了一项不得不做的“基本功”。
DeepSeek自然不会坐视不理。它迅速推出V4系列“满血版”,性能直追GPT-5.6,同时推出峰谷计费机制,以极致的性价比吸引中小团队和独立开发者。两家公司包揽了全球权威开源模型榜单前两名,形成了中国AI领域罕见的“双雄格局”。
资本市场的反馈同样激烈。月之暗面半年内累计融资超39亿美元,总融资额突破376亿元人民币,成为国内大模型创业公司中累计融资最多的企业。而DeepSeek的API调用量持续攀升,商业化路径日渐清晰。大模型行业已从“烧钱换增长”进入“赚钱求生存”阶段,那些只有技术没有收入的公司,正被市场无情淘汰。
从更大的视角看,Kimi K3与DeepSeek的竞争,本质上是两种技术路线的碰撞:是以超大参数构建能力上限,还是以极致性价比扩大应用生态?两者没有绝对优劣,却共同推动了中国AI从“追赶者”向“定义者”的转变。当参数竞赛再次重启,下一个问题或许不再是“谁参数更大”,而是“谁能把参数真正转化为生产力”。