Kimi K3 发布:2.8 万亿参数开源旗舰登顶前端代码竞技场
Moonshot AI 放出迄今最大的开源级模型:百万 token 上下文、多榜单挤进前三,全球开发者从性能一路聊到定价。
7 月 16 日,Moonshot AI(月之暗面)正式发布 Kimi K3——2.8 万亿参数的开源权重旗舰,也是迄今规模最大的开源级大模型。发布数小时内,它就在 Arena.AI 的 Frontend Code Arena(前端代码竞技场)从第 18 名跃升至榜首,把一众闭源旗舰甩在身后。
模型概况
架构上,K3 采用 896 个专家的 MoE 设计,每个 token 仅激活 16 个专家;两项新技术 Kimi Delta Attention(KDA)与 Attention Residuals(AttnRes)用于改善长序列与深层网络中的信息流动,支撑 100 万 token 上下文以及长程编码与智能体任务。
关键数字
2.8T
参数规模
开源级最大
1M tokens
上下文窗口
长程编码/智能体
$3 / $15
API 定价
每百万输入/输出 token
07-27
权重开放
官方承诺日期
评测榜单表现
发布首周主要榜单成绩
| 榜单 | 成绩 | 名次与对比 |
|---|---|---|
| Frontend Code Arena(Arena.AI) | 1679 | 第 1:发布数小时内从第 18 升至榜首 |
| GDPval-AA v2 | 1687 | 第 3:次于 Claude Fable 5 Max(1815)与 GPT-5.6 Sol Max(1747.8) |
| AA-Briefcase | 1527 | 第 2:超过 GPT-5.6 Sol Max(1495) |
| Artificial Analysis 综合 | Elo 1547 | 第 2:较上代 K2.6 大幅跃升 |
全球开发者反应
- 「前端榜登顶」成为发布当天最出圈的话题,大量前端开发者晒出与闭源旗舰的对比试用。
- 有开发者评价它是「非常好的模型」,并认为这种表现无法用蒸馏来解释。
- Simon Willison 实测:推理只有单一力度档位,一次回复消耗了 13,241 个推理 token,成本可观。
- 定价争议:$3/$15 直接对标 Anthropic Sonnet 档,是中国实验室迄今最贵的 API,「开源但不便宜」引发热议。
- 地缘讨论再起:在美国算力出口管制背景下做出 3T 级开源模型,「开源前沿的护城河是否被击穿」成为一周热帖。
这很昂贵——鹈鹕花了 25 美分!
— Simon Willison,骑车鹈鹕基准实测
Kimi K3 官方快速上手 Moonshot 平台文档与 API 指南 官方↗ Simon Willison 的第一手评测 鹈鹕基准、定价与推理 token 消耗观察 评测↗