
从烧钱投流被质疑,到K3发布震动硅谷,再到秘密交表启动IPO——杨植麟只用了不到两年。
9月2日,据《晚点 LatePost》报道,月之暗面已于本周以保密形式向港交所递交A1文件,正式启动港股IPO流程。A1是企业申请在港上市时提交的正式申请表。联席保荐机构锁定中金与高盛。月之暗面方面回应称目前暂无可以披露的信息。
按照计划,公司有望于2027年初成为继智谱、MiniMax之后第三家公开上市的国产大模型头部企业。从成立到启动IPO,月之暗面只用了三年多。
而就在2025年底,创始人杨植麟还曾在内部信中表示短期不急于IPO。短短八个月,态度急转的背后,是Kimi K3带来的连锁反应。
月之暗面的一级市场估值,在2026年画出了一条近乎垂直的曲线。
2025年12月完成C轮融资时,公司估值约43亿美元。进入2026年,融资节奏显著提速。1至2月连续完成三轮融资,估值从100亿美元攀升至180亿美元。5月D轮后达200亿美元。6月E轮投前估值升至315亿美元。7月F轮募得超35亿美元,投后估值达到350亿美元。原定8月启动的G轮(Pre-IPO轮)被迫提前,投前估值已升至500亿美元。
八个月,估值从43亿涨到500亿,涨幅超过10倍。
估值跃升最直接的催化剂,是7月发布的Kimi K3。
总参数量2.8万亿,原生支持视觉理解,100万Token上下文窗口,面向软件工程、知识工作、深度研究、多模态理解等复杂任务优化。在Frontend Code Arena编程盲测中,K3以1679分登顶全球第一。在Artificial Analysis综合评测中排名全球第三,仅次于Claude Fable 5和GPT-5.6 Sol。
硅谷震动随之而来。K3发布当天,智谱股价下跌28.49%,MiniMax跌15.62%。费城半导体指数当周大幅下挫,英伟达短暂丢掉全球市值最高公司头衔,外媒称之为DeepSeek 2.0时刻。
更关键的是商业化数据。K3发布前,月之暗面ARR在3月突破1亿美元,5月达2亿美元,6月站稳3亿美元。API收入已占整体收入七成以上,海外开发者成为重要客户来源。
但这条陡峭曲线背后,是一个被DeepSeek逼到墙角的故事。
2025年1月,DeepSeek R1横空出世,上线不到两周日活冲破3000万,成为史上最快达成这一里程碑的国民应用。Kimi的投流打法被一夜推翻——DeepSeek几乎没有广告投放,只靠模型硬实力完成病毒式口碑传播。当月DeepSeek月活冲到3370万,是Kimi的1.7倍。国内AI原生App行业前三从豆包、Kimi、文小言,换成了DeepSeek、豆包、元宝。
与此同时,零一万物、百川相继放弃通用基座模型训练,转向垂直应用。月之暗面不仅叫停了C端投放,还暂停了Ohai、Noisee等其他C端应用。投流规模较2024年四季度骤降超七成,公司陷入长达16个月的融资空窗期。
但杨植麟做了两个关键决定。
第一个,彻底放弃C端流量内卷,all in基座模型研发。第二个,在DeepSeek抢走深度思考制高点后,转向抢占Agent制高点——成为国内最接近Anthropic技术范式的玩家之一。
2025年2月,Kimi K2发布,全球首个万亿参数开源MoE模型,编码、Agent、数学推理均表现惊艳。K2.5引入Agent集群能力,刚好踩中OpenClaw带来的Agent热风口。发布后不到20天,收入超过2025年全年总和。
2026年7月,K3发布,演讲里关于混合线性注意力、注意力残差、RL Scaling的路线图全部兑现。
成立三年,月之暗面股东覆盖阿里、腾讯、美团龙珠、红杉中国、IDG等一线机构,社保基金、中国移动产业基金等国家队也已入场。
技术突破、融资暴增、估值跃迁在不到两个月内集中落地。但阶段性登顶不等于落袋为安。杨植麟曾在访谈中把做大模型比作爬雪山:也许有一天会发现,这座雪山没有尽头,我希望它一直没有尽头。