WAIC 前夕重磅炸场!月之暗面发布Kimi K3,作为全球首款 2.8 万亿参数开源大模型,百万 Token 超长上下文、代码全模态能力断层领跑国内,多项测评超越 GPT-5.6、Fable 5,直接搅动全球 AI 资本市场;公司投前估值冲击3380 亿元(500 亿美元),国产大模型彻底告别低价内卷,正式站上全球高端定价赛道⚡。
Kimi K3 最大突破在于原创 KDA 混合线性注意力 + 注意力残差架构,不靠模型蒸馏堆砌能力,百万上下文解码速度提升 6.3 倍,训练效率上涨 25%。模型原生支持 100 万 Token 窗口,可完整读取整套代码仓库,一次性完成工程级跨文件修改;多模态评测 BrowseComp 拿下 91.2% SOTA 成绩,网页生成、视觉交付完成度远超同类产品。 三大核心应用场景精准落地:长程编程开发、端到端知识工作、复杂深度推理,在前端开发榜单中得分反超海外两大头部闭源模型,代码一次通过率大幅领先。 创始人杨植麟团队坚持全开源路线,底层技术、论文完整对外公开,业内预判后续社区可基于 K3 蒸馏轻量化高效小模型,大幅降低行业推理算力成本。
本次 K3 定价引发全网热议:未缓存输入 20 元 / 百万 Token、输出 100 元 / 百万 Token,价格为 DeepSeek V4 Pro 的 20 倍,对标海外仅为 GPT-5.6 Sol 六成、Fable 5 三成。 官方回应定价逻辑清晰:SOTA 级模型理应匹配商业价值,国产大模型不该被贴上廉价标签。单任务综合成本测算下,K3 实际开销低于海外头部模型,长任务返工率更低,长期综合性价比突出。 但 2.8 万亿参数算力消耗巨大,单模型运行需 20 张 H100 显卡支撑,上线仅 48 小时用户流量直接打满算力集群,官方紧急暂停新用户 K3 订阅,优先保障存量付费客户使用体验,同步拆分独立代码会员产品线优化调度。高盛研报定性:这是中国大模型掌握全球定价权的标志性节点。
K3 发布次日,全球科技板块迎来连锁反应:英伟达、谷歌、Meta、英特尔股价同步走低;港股 AI 企业大幅承压,智谱单日暴跌 28.49%,MiniMax 下跌 15.62%,市场担忧行业竞争格局重构。 马斯克主动发文点赞 Kimi K3,预热自家 Grok 4.5 并放话对标,月之暗面官方坦然回应欢迎同台竞技;OpenAI 高管公开抨击开源路线削弱行业资本回报,杨植麟 CMU 导师、苹果前 AI 总监 Russ 公开力挺开源战略,称开放权重是更难、更具长期价值的赛道。
资本市场给出极高预期,月之暗面计划 8 月启动上市前最后一轮融资,目标投前估值 500 亿美元,最快半年登陆港股。 核心底气来自创始人杨植麟:清华本硕满分学霸、CMU 四年速通博士,XLNet、Transformer-XL 两大 NLP 奠基论文出自其手,论文总引用量超 2 万次;既深耕底层芯片优化,又具备成熟商业布局能力,放弃海外教职高薪选择回国创业,兼具前沿科研与企业管理双重能力,团队人才吸纳实力行业领先。
机构梳理本轮变革三大核心趋势: ✅ 赛道逻辑切换:比拼底层原创架构,而非低价走量,高端能力拥有独立溢价空间; ✅ 分层市场成型:万亿级大模型主攻企业复杂工程、长周期推理,轻量化蒸馏模型适配普通日常需求; ✅ 国产 AI 全球化提速:K3 定价锚定海外中端区间,在全球市场形成差异化竞争力,打破海外厂商垄断。
业内判断,Kimi K3 只是起点,月之暗面并未止步 2.8 万亿参数,后续将持续扩张模型规模,同时攻坚 “无限上下文” 技术。这场由中国团队主导的全球大模型竞赛,产业、资本、定价规则都将迎来全新重塑。