Kimi K3发布,宣称打平GPT-4.5
Moonshot AI周一发布最新大模型Kimi K3,官方测试显示其性能已接近GPT-4.5和Claude 3.7 Sonnet。这家成立仅两年的中国AI公司,靠Kimi助手月活用户从年初的200万暴涨至2100万,增幅高达940%。
但就在K3发布前一天,Moonshot联合创始人杨植麟被曝卸任CEO,转任首席科学家。原COO张予彤接任,这一人事地震让外界对中国AI独角兽的内部治理产生疑虑。
K3强在哪里?
根据Moonshot公布的测试数据,K3在MMLU、HumanEval等基准测试中与GPT-4.5几乎持平。具体来看:
(1) 数学推理:AIME 2024测试准确率89%,略高于GPT-4.5的87%
(2) 代码能力:LiveCodeBench得分与Claude 3.7 Sonnet相当
(3) 中文理解:领先GPT-4o约15个百分点
当然,第三方独立测评还没出来,官方数据的参考价值几何还得打个问号。
换帅背后:融资压力还是路线之争?
杨植麟的突然转身让创投圈炸锅。有消息称,Moonshot正在洽谈新一轮融资,估值可能达到30亿美元。投资人担心技术创始人直接挂帅会影响商务拓展,这才有了这轮调整。
另一种说法是,杨植麟与管理层在"是不是该学OpenAI走闭源路线"上存在分歧。Kimi目前仍坚持开源策略,但这意味着商业化路径会更长。
不管原因是什么,中国AI大模型竞赛已进入下半场:产品能卖出去才是硬道理,光有技术指标已经不够了。
正文完