2.8 万亿参数
国产已上线模型中最大参数规模之一,输出速度最高 260 Tokens/s,复杂推理与长链路任务的基础。
模型 · Moonshot Kimi K3
2026 年 7 月 17 日正式上线的 Moonshot 旗舰(模型 ID k3):2.8 万亿参数、100 万 token 上下文、原生视觉能力,输出速度最高 260 Tokens/s,SWE-Bench 等编程评测接近 Anthropic 前沿水平。
国产已上线模型中最大参数规模之一,输出速度最高 260 Tokens/s,复杂推理与长链路任务的基础。
Pro 档(¥199/月,年付 ¥159/月)及以上解锁百万 token 长对话;256K 以内可改用 k3-256k 省额度版。
模型 ID k3-256k:256K 内效果与 K3 相同、消耗约为其一半,不支持视频输入,适合日常问答与单文件修改。
新增编程型号 kimi-for-coding(最高 1M 上下文),是 K2 线在新会员体系下的接续型号。
UI 截图还原、设计稿转代码是 K3 的招牌场景,前端开发者重点。
SWE-Bench 等评测接近 Anthropic 前沿水平,与 GLM-5.2 同属国产第一梯队。
| 平台 | 入门价 | K3 可用性 |
|---|---|---|
| OpenCode Go | $10/月 | 可用 · 5h 约 110 次请求 |
| Kimi Code Plan | ¥99/月(Plus) | 可用 · 免费档与 Go 档无 coding 额度 |
| Kimi Code Plan Pro | ¥199/月(年付 ¥159) | 解锁 1M 上下文 + 高速版(需 Pro 及以上) |
| Kimi Code Plan Max | ¥699/月(年付 ¥559) | 最高档 · 年付最高立省 ¥1,680 |
两者都是 1M 上下文旗舰:GLM-5.2 榜单名次更高(开源第一)、起步更便宜(¥94.4 年付可用);K3 参数更大、视觉与前端正向能力突出,其 1M 上下文需要 Pro 档(¥199/月)。
预算有限二选一:通用工程选 GLM-5.2,前端/多模态选 K3。两者也可通过 OpenCode Go 一份 $10 订阅同池使用(K3 约 110 次/5h,GLM-5.2 约 880 次/5h)。
不能。K3 需 Plus(¥99/月)及以上;免费档与 Go 档均无 Kimi Code 额度,可先用 K2.7 验证工作流再升级。
K3 在参数规模(2.8T)、视觉能力与长上下文上限全面超越 K2.7;日常轻任务 K2.7 依然够用,且与 K3 共享额度。
需要 Pro(¥199/月,年付 ¥159/月)及以上档位;Pro 与 Max 均可调用 1M 超长对话。
Kimi 新增的编程型号(模型 ID kimi-for-coding),最高支持 1M 上下文,与 K3、k3-256k 同池可选;K2.7 Code 高速版(kimi-for-coding-highspeed)负责高吞吐场景,需 Pro 及以上。
官方新增「加油包」(Extra Usage):订阅额度用尽后按量扣费兜底,单次最低 ¥25,每日最多 10 次、累计 ¥3,000,余额上限 ¥10,000,余额不过期可叠加,并与网页端 Kimi 共享。
可用但单价较高(5h 约 110 次),适合把 K3 当「专家」按需调用,日常任务交给池内更便宜的 DeepSeek/MiMo。