我有一种预感:第二个震惊硅谷的 "梁文峰",已经出现了!
谁能想到,DeepSeek 之后,第二个让华尔街集体冒冷汗的中国人,竟然是一个几个月前还被嘲笑 "掉队" 的 90 后。
他叫杨植麟。
7 月 16 日,杨植麟创办的月之暗面突然扔出 Kimi K3。没有铺天盖地预热,也没有开几十场发布会,直接把模型往桌上一拍:2.8 万亿参数,原生多模态,100 万 token 上下文,还要开放模型权重。
这一巴掌拍下去,硅谷直接安静了三秒,然后炸了。
先说几个硬数据,都是第三方评测机构实打实测出来的,不是自吹自擂。独立评测机构 Artificial Analysis 给 K3 打了 57 分,全球排第三,前面只有 Claude Fable 5 和 GPT-5.6 Sol 两个闭源大佬。
这是开源模型有史以来第一次摸到全球前三的门槛。
马斯克看完直接在评论区甩了句 "令人敬佩的",转头就回去催自己的团队,说正在训练的 2 万亿参数 Grok 新模型 "可能超越 Kimi"。
月之暗面官号也不客气,直接回了句 "欢迎加入 2 万亿 + 俱乐部"。
你品品这味儿,搁以前都是中国公司追着硅谷的尾灯跑,现在反过来了,马斯克要拿 "即将发布" 的模型来对标一个已经落地的中国产品。
很多人可能对杨植麟这个名字还陌生,但在学术圈,这人早就是个传说级的存在。
1993 年广东汕头出生,信息学竞赛保送清华姚班,年级第一毕业拿了特等奖学金,CMU 四年读完博士,师从 AI 大牛。
谷歌大脑、Meta AI 都待过,苹果当年主动挖他,他说 "不自己创个业会后悔一辈子",转头就回国了。
2023 年创办月之暗面,公司名字取自 Pink Floyd 的经典专辑《月之暗面》,连产品名都叫 Kimi—— 那是他自己的英文名。
一开始顺风顺水,Kimi Chat 靠着 200 万字超长上下文一炮而红,月活峰值冲到过两千多万。
然后就是所谓的 "掉队期"。百模大战打起来,大厂烧钱砸流量,Kimi 的月活一度从两千多万跌到九百万左右,网上到处都是 "月之暗面不行了"" 杨植麟只会做学术不懂做产品 " 的声音。
换别人可能就慌了,赶紧跟进烧钱抢用户,杨植麟偏不,直接砍了营销投流,把人和钱全砸回底层模型研发上。
现在回头看,这步棋走得是真狠。别人在卷 C 端用户量的时候,他在闷头堆参数、改架构;别人在比拼日活月活的时候,他在憋一个 2.8 万亿参数的开源王炸。
说到这儿就不得不提梁文锋和 DeepSeek。
这俩人简直是中国 AI 突围的两种经典模板 —— 梁文锋走的是极致成本路线,用硅谷二十分之一的钱干出同样的效果,直接把英伟达股价干崩了,动摇的是 "算力就是一切" 的底层逻辑;
杨植麟走的是开源生态路线,把 3 万亿级别的模型权重直接开放给全世界,动摇的是 "闭源垄断" 的商业模式。
一个打成本,一个打生态,前后脚出手,硅谷想不冒汗都难。
我个人最看重的还不是参数多少、跑分第几,而是 "开源" 这两个字的分量。
2.8 万亿参数,7 月 27 日完整开放权重,商用权限全放开,这意味着什么?
意味着全球任何一个开发者、任何一家中小企业,不用再给 OpenAI 或者 Anthropic 交 API 过路费,就能自己部署、微调一个接近前沿水平的大模型。
以前开源模型和闭源模型之间隔着一道天堑,差着一两个量级。K3 这一下把鸿沟给填上了一大半。
就像 Atreides 管理合伙人 Gavin Baker 说的,这可能是 AI 的一个重要拐点 —— 对 OpenAI 和 Anthropic 可能不是好事,但对全世界其他所有公司来说,都是净收益。
当然了,吹归吹,差距还是要认。综合能力 K3 还是排第三,跟前两名有距离,推理速度偏慢也是实测出来的问题。
发布才两天就因为用户请求量太大触发了订阅熔断,说明算力储备确实跟硅谷巨头不是一个量级。
但这恰恰是最有意思的地方。DeepSeek 用极低的成本证明 "堆算力不是唯一出路",月之暗面用开源证明 "闭源垄断不是唯一玩法"。
两家都是成立才三年左右的创业公司,都不是什么互联网巨头亲儿子,都在硅谷认定的游戏规则之外,走出了自己的路。
硅谷真正怕的,从来不是某一个中国模型,而是这种 "你定规则我破局" 的迭代速度。
去年还在说中国 AI 落后两年,今年就有两家公司轮番摸到前沿门槛,而且打法一个比一个野,一个比一个不按常理出牌。
梁文锋已经用实际行动告诉华尔街,中国人做 AI 不仅能跟上,还能把成本打下来。现在杨植麟又补一刀,告诉全世界,顶尖模型也可以是开源的
下一个站出来的会是谁?没人知道。但可以确定的是,硅谷独家定义 AI 未来的日子,已经一去不复返了。
