2.8万亿参数,Code Arena第一,超过Claude Fable 5和GPT-5.6——这就是月之暗面刚开源的Kimi K3。
7月27日晚,月之暗面正式发布Kimi K3的模型权重和技术报告,并开源了支撑Kimi K3训练的三项关键技术:MoonEP、FlashKDA和AgentEnv。这是一个拥有2.8万亿参数的混合专家(MoE)模型,具备原生视觉理解能力,支持100万token的上下文窗口。
关键数据:
(1) 2.8万亿参数,混合专家架构
(2) 原生视觉理解,不是后来加的视觉模块
(3) 100万token上下文窗口,一次能处理相当于约75万字的中文文本
(4) Code Arena排名第一,踩着Claude Fable 5和GPT-5.6上位
月之暗面CEO杨植麟之前说过,开源是为了让更多开发者用上顶级大模型。现在每个人都可下载部署Kimi K3,用于内部研发或嵌入面向用户的产品。
7月28日,国家超算互联网AI社区同步上线Kimi K3的API调用服务。企业和开发者通过API一键调用,快速下载模型文件并部署——2.8万亿参数的开源大模型,直接能用。
这波操作有意思的地方在于:Kimi K3开源同一天,国家超算互联网AI社区就上线了配套服务。这个响应速度说明什么?说明国内大模型生态的基础设施已经ready了,不是实验室里的demo,是能直接跑起来的生产级工具。
从Claude Fable 5到GPT-5.6,顶级模型榜单被一个中国团队的开源模型踩在脚下。上一次类似的冲击还是DeepSeek V3发布的时候,外媒Fortune称之为"第二次DeepSeek冲击"。这一次,冲击变成了常态。
对了,Kimi K3还筹备赴港IPO。如果成真,将是中国AI大模型公司上市第一股。开源刷榜、API Ready、IPO在望——月之暗面这一套组合拳,打得挺猛的。