Moonshot 发布 2.8 万亿参数 Kimi K3:前端编码榜登顶超 Fable 5,权重 7 月 27 日开放

月之暗面 7 月 16 日发布 Kimi K3:2.8 万亿参数 MoE、100 万 token 上下文、原生多模态,号称迄今最大的开放权重模型。匿名 checkpoint 揭盲后以 1679 Elo 登顶 Arena.ai 前端编码榜,超过 Claude Fable 5 和 GPT-5.6 Sol;完整权重和技术报告定于 7 月 27 日放出,开源许可证条款尚未公布。

关键事实

Kimi K3 于 7 月 16 日上线:2.8 万亿总参数的 MoE 架构,每 token 只激活 896 个专家中的 16 个(约 1.8%),上下文窗口 100 万 token,原生支持视觉输入。此前它以匿名 checkpoint 形式在 Arena.ai 前端编码榜(Frontend Code Arena)参与盲测,揭盲后以 1679 分排名第一,高于 Claude Fable 5(1631)和 GPT-5.6 Sol(1618),在 7 个前端任务类目中拿下 6 个头名——相比 Kimi K2.6 的第 18 名跳升 17 位。API 定价为输入 $3/M(缓存命中 $0.3/M)、输出 $15/M。

「开放」还差最后一步

需要区分的是:Arena 名次来自第三方平台投票,而 Terminal-Bench 2.1 的 88.3 分等其余成绩目前均为 Moonshot 自报,有第三方发布日评测给出了不同排序,待 7 月 27 日随权重一同发布的技术报告验证。许可证条款也尚未公布——「开放权重」最终开放到什么程度还是未知数。另据 Artificial Analysis 的独立综合评估,K3 智能水平与 Opus 4.8、GPT-5.5 相当,仍低于 Fable 5 和 GPT-5.6 Sol。

影响判断

如果权重如期放出,这将是开源阵营首次把 3 万亿参数级模型摆上桌面,对自建推理的团队是新选项也是新门槛:社区估算量化版也需要约 650GB–1TB 内存。更现实的参考意义在编码赛道——K3 登顶的恰好是 Gemini 3.5 Pro 这次跳票卡壳的科目,中国开源模型在细分能力上与闭源旗舰的差距正在按月缩小。

via: Moonshot AI 官方发布、Tom's Hardware、Arena.ai 榜单(2026-07-16)