2.8万亿参数,Claude Fable 5和GPT-5.6全被它踩在脚下。
7月27日晚,月之暗面正式开源Kimi K3模型,并同步开放模型权重和技术报告。同时开源的还有支撑Kimi K3训练的三项关键Infra技术:MoonEP、FlashKDA和AgentEnv。
这是全球参数规模最大的开源模型之一。Kimi K3采用混合专家(MoE)架构,具备原生视觉理解能力,上下文窗口达到100万token。换句话说,你可以往里面塞一整本书,然后问它任何问题。
月之暗面还拉来了国家超算互联网AI社区做背书。7月28日,国家超算互联网AI社区正式上线Kimi K3的模型文件下载和API调用服务,企业和开发者可以一键部署使用。
Code Arena测试榜单上,Kimi K3已经冲到了第一的位置。
怎么理解这件事?
开源模型这条路上,之前最亮眼的标签是"对标GPT-4"——大家都在比谁能更接近那个天花板。现在Kimi K3直接绕过去了。它不是踩着GPT-5.6上位,而是踩着Claude Fable 5和GPT-5.6两个对手一起踩。Fortune在报道里用了"第二次DeepSeek冲击"这个词。
上一次是DeepSeek V3,用不到600万美元的训练成本打穿了行业认知。这一次是Kimi K3,用开源姿态把参数规模推到2.8万亿,同时在多个基准测试里跑到了前面。
对普通开发者来说,这是最实在的好处——你可以直接下载模型文件,自己部署跑起来,不用再等API排队或者付月费。无论你是想做内部研发,还是想嵌进自己的产品里,都可以。
月之暗面正在筹备赴港IPO。这个时间点开源Kimi K3,冲刺上市的意图很明显——用开源生态换市场份额,用榜单第一换市场信心。
大模型开源这场仗,变得越来越有意思了。