7月27日晚,月之暗面悄无声息地干了件大事:开源了Kimi K3。
不是发布,是开源。模型权重、技术报告、训练 Infra 代码,一股脑全放出来了。
2.8万亿参数,混合专家架构(MoE),原生视觉理解,100万 token 上下文窗口。这个参数规模意味着什么?全球最大开源模型,没有之一。
性能直接踩着GPT-5.6往上爬。在Code Arena测试里,Kimi K3拿下第一,超过了Claude Fable 5和GPT-5.6。Fortune杂志的评价是:"第二次DeepSeek冲击"。上一次是中国模型让硅谷睡不着觉,这一次是同一家公司再补一刀。
具体能做什么?写代码、读论文、处理长文档、视觉理解……100万 token 窗口是什么概念?一本《战争与和平》扔进去还有富余。普通模型的上下文窗口装不下的东西,Kimi K3能一口气吞下去。
月之暗面这次开源的不只是模型,还有三样东西:MoonEP(分布式训练引擎)、FlashKDA(高效注意力机制)、AgentEnv(智能体环境)。行内人一看就知道,这才是真正的护城河——让其他公司也能训练自己的大模型,但底层的训练工厂是月之暗面建好的。
开源这事有意思的地方在于:月之暗面说"每个人都可以下载并部署",但明眼人都知道,真正跑2.8万亿参数模型的门槛不低。普通开发者玩玩可以,真要商用,GPU成本就够喝一壶。
更有意思的是另一边:Kimi K3开源同一天,有消息传出月之暗面正在筹备赴港IPO。如果成真,这将是港股第一家大模型上市公司。从Kimi K1到K3,也就一年多的事,估值据说已经奔着百亿美元去了。
开源和上市,两件事放在一起看挺有意思的。开源能打响品牌、吸引开发者、构建生态;上市能拿到钱继续烧。这套组合拳,国内AI公司越来越熟练了。
附:Kimi K3已在国家超算互联网AI社区上线,API一键调用,企业和开发者可以直接部署使用。