DeepSeek、Qwen、Kimi,美国和硅谷已经快经不起中国开源大模型的连环暴击了。Sad。
7月27日深夜,月之暗面(Kimi)正式开源了K3的模型权重。2.8万亿总参数、性能据说接近全球最顶级模型Claude Fable 5,完全免费下载、本地部署、自由商用,太炸裂了。
硅谷再一次恐慌,费城半导体和美股狂跌。黄仁勋紧急开通X,发公开信力挺中国AI,下面签名的公司,已经有一大串了。
摩根大通说这是"DeepSeek 2.0 时刻",杨植麟,终于走到了一个和梁文锋接近的位置。杨圣,呼之欲出。
作为中国最顶级的两家独立大模型公司,DeepSeek和Kimi你追我赶,各不相让。去年初的DeepSeek R1让梁文锋封神,杨植麟失意,而今,他终于靠K3扳回了一局。
技术之外,这两家公司也走在资本化的竞速路上。按照最新融资估值,两家都已达到500亿美元。从流程来判断,Kimi的上市之路会比DeepSeek更快。
梁圣也好,杨圣也罢,他们都是中国开源模型的代表,共同向世界展示了,中国大模型,快追上美国了。全球AI,中美双线叙事开演。
1、
一家中国创业公司,一个90后。这次算是扬眉吐气了。
Kimi K3是2.8 万亿参数的MoE模型,在Artificial Analysis智能指数上排全球第三,前面只有Claude Fable 5和GPT-5.6 Sol;在Frontend Code Arena编程榜单上,则以 1679 分登顶,超越所有闭源模型。
K3通过 KDA 混合线性注意力、Attention Residuals 等架构创新,用远少于 OpenAI、Anthropic 的算力和资金,训出了接近它们的模型,这与DS去年的冲击的逻辑一致。
更意外的是,这么强的模型给大家全开放了。AI创业者拍手称庆,“他们永远也夺不走我的Fable 5”了,Kimi K3,成了他们的Fable 5。
不过,Kimi的算力瓶颈也是显而易见,7月19日宣布暂停C端新用户订阅,优先保障现有付费用户算力。
硅谷感受到中国大模型的强压,不是第一次了。
2025年1月,DeepSeek发布R1并同步开源权重,硅谷震动。Meta的生成式AI团队成立四个“战情室”,专门研究DeepSeek-R1。美国经济学家布莱恩·雅各布森说,这可能改变人工智能的叙事。
接着是去年11月,阿里巴巴的通义千问Qwen,几乎所有人都在用,硅谷患上了“Qwen Panic”,让人疯狂。
更大的震撼便是Kimi K3。7月22日,美国白宫科技政策办公室负责人公开指控月之暗面,声称Kimi K3涉嫌违反出口管制。
随后,黄仁勋发布了他的第一条X帖子,《开放权重与美国AI领导力》,反对封禁中国大模型,直接跟白宫开干。因为开源模型“降低了AI使用门槛,扩大了整体市场,带动了芯片、算力需求”。
谁影响我卖AI芯片给中国,我就怼谁。老黄的精明在于,他比华盛顿那帮人更早看透了一件事:封锁没有用。
过去几年,美国对华芯片出口管制层层加码。但DeepSeek、Kimi用事实证明,限制没那么有效。中国团队在算力紧缺之下,做出了逼近全球最强闭源模型的东西。
更令硅谷不安的是模式。DeepSeek基于阿里Qwen蒸馏,Kimi K3开源权重,中国公司不仅在追赶,还在重新定义游戏规则。
开放权重让任何人可以下载、检查、修改、在自己的设备上运行。这不再是买不买得到芯片的问题,这是生态的问题。
美国的技术霸权,在开源面前正在被一寸一寸地消解。
2、
K3的火爆,直接把创始人杨植麟推到了聚光灯下。
一个中国 90 后创业者,卡内基梅隆大学博士毕业,拒绝谷歌、苹果邀约回国创业,开发出顶级模型,对 OpenAI、Anthropic、谷歌三家闭源巨头说:"我免费",开源社区已经有人喊"杨圣"了,带点调侃,带点敬意。
(网传月之暗面团队酒吧庆祝)
就像梁文锋梁圣。都是开源,都是活菩萨,都狙击了美国AI叙事。
作为中国独立大模型公司的创始人,他们总是免不了被放在一起比较。
2024年,杨植麟的月之暗面一出生就风华正茂,凭借首个支持输入200万汉字的大模型Kimi Chat,加上疯狂投流,拿下3600万用户,在国内仅次于豆包。
然而去年初,随着DeepSeek推出开源模型R1,出色的推理表现引发全民追捧,Kimi和一众大模型公司都立刻相形见绌,黯然失色,用户选择用脚投票,迅速流失。
一边,梁文锋迅速被捧上神坛,冠以梁圣之名,还去了民企座谈会。另一边,Kimi和杨植麟深陷困境,无人问津。甚至有人觉得他们快活不下去了。
至暗时刻,杨植麟做了一个艰难的决定:砍掉多余业务,全力研发基座模型和Agent。
今年春节后,Kimi 接连推出K2、2.5都有惊喜,直到K3大爆。
Kimi K3,不仅是月之暗面自身能力的展示,更是中国基础模型研发实力强劲的证明,甚至重塑了全球AI竞争格局。
杨植麟也终于,可以与梁文锋并排。
更微妙的是,在他们背后,也站着不同的巨头。Kimi背后是阿里,2024年阿里财报披露,向Kimi投资合计约 8 亿美元,购入约 36% 股权,经过多轮融资稀释后,预计当前仍持有20%以上,是最大机构股东。
DeepSeek的背后则站着腾讯。今年梁文锋放风要融资后,吸引大批机构和公司上门,最后落定的,除了梁文锋本人投200亿,就属腾讯的100亿最多了。
所以某种程度上,梁文锋和杨植麟的赛跑,也是DeepSeek-腾讯阵营和Kimi-阿里阵营的竞争。
当然正如梁圣所言,AI市场足够广阔,商业化可以做得非常大,完全可以容纳两家公司。
3、
Kimi K3火爆的另一面,也伴随着诸多争议,如API太贵,稳定性太差等。不可忽视的,是其频繁更新模型背后的融资和上市冲动。
2025年底,杨植麟还在全员信中写道:“我们短期不着急上市,也不以上市为目的。”但转年火爆的二级市场、焦虑的投资人,彻底打乱了他的节奏。
月之暗面被裹挟着,开启了资本扩张最凶猛的一年。1月至2月连续完成三轮融资,5、6月再接两轮,投前估值已涨至315亿美元。
如今,公司计划8月启动Pre-IPO轮融资,目标投前估值500亿美元。半年之内从43亿到500亿美元,上涨超过10倍。
无独有偶,一直坚持不融资的梁文锋,也打开了DeepSeek融资的大门。短短3个月估值翻了约7倍,首轮融资超500亿人民币,估值超500亿美元(3500亿人民币)。
有消息说,DeepSeek第二轮融资目标募集至少100亿元人民币,估值约710亿美元(4800亿人民币)。
但就在几天前,梁文锋和投资人的闭门会议四小时讲话泄露,传闻他对此非常不满,暂缓了第二轮融资。
市场预计,Kimi最快6个月内将登陆香港资本市场,比DeepSeek走先一步。
但杨植麟与循环智能股东们之间的仲裁仍未了结,这会让上市审核更复杂、时间窗更紧;而真正决定其能否尽快递表的硬约束,是红筹/VIE架构拆除何时完成。
两件事叠加,Kimi上市时间窗的博弈,正在紧张进行中。
DeepSeek那边,目前股权仍高度集中,梁文锋直接持股34%,最终受益股份约81.65%,合计控制超过80%投票权,暂时不符合上市公司的股权特征,预计IPO不会太快。
截至目前,几轮融资已经让两家公司估值飙涨,个人身价飙升。上市后预计会涨得更多,参考智谱、长鑫科技等,万亿市值也很快会达到。
这样的财富增长速度,远超互联网时代的富豪们,无论是丁磊、李彦宏、马云、马化腾还是张一鸣。
梁文锋、杨植麟的行业影响力和话语权,也将进入此前中国创业者从未抵达的境界。
当然,风险也有。以大模型性能为核心的估值体系其实非常脆弱,不然智谱也不会因为K3的发布就股价暴跌。长期而言,大模型公司们还必须证明自己的收入和盈利能力。
在2026年这个夏天,杨植麟终于追上梁文锋了。这不是终点,只是一个赛点。
他们两人,一个从量化金融跨界而来,一个从学术象牙塔坚决出走,用自己独特的技术和能力,证明在美国算力封锁下,依然可以跑出优秀、领先的模型,令世界刮目相看。
也是他们,用开源模型冲击了中美AI产业的竞争和权力结构,重新定义了全球AI的生态和游戏规则。
这一切,才刚刚开始。
(本文仅为商业分析,不构成投资建议。)