Appearance
Kimi / Moonshot AI
最后核对:
2026-07-24
Kimi 这条线最值得单独看的一点,是它把 Agent、知识工作、长链路执行 和 模型架构 放在了同一套叙事里。
1. 2025 以来的关键节点
| 时间 | 模型 / 事件 | 关键变化 |
|---|---|---|
2025-07-11 | Kimi K2 | 官方明确为 MoE 模型,强调 open agentic intelligence |
2026-04-20 | Kimi K2.6 | 强化长程编码、主动 Agent 与多工具执行 |
2026-07-16 | Kimi K3 | 明确进入 open frontier intelligence 路线,进一步强化知识工作与长任务执行 |
补充说明:
- 当前 Kimi Platform 文档中还提供
kimi-k2.7-code与kimi-k2.7-code-highspeed。 - 这说明 Kimi 近期路线非常明确地在把“coding model”和“general-purpose / knowledge-work model”分开。
2. Kimi 的架构路线为什么很特别
2.1 它不是只围绕聊天能力扩张,而是围绕“Agent 作为工作同事”扩张
从 Kimi 博客和平台文档能看出的高频关键词包括:
agentic intelligenceknowledge workcodingvideo / image / text unified understandingagent swarmtool calls
这说明 Kimi 的路线不是简单做通用聊天,而是在把模型做成 知识工作执行体。
2.2 官方公开了相当多架构信号
已知官方公开信号包括:
Kimi K2:1T total parameters、32B activated parametersKimi K3:Stable LatentMoE,896 experts中激活16个Kimi K3:使用Kimi Delta Attention (KDA)与Attention Residuals
这类披露在主流前沿厂商里并不常见,说明 Kimi 很愿意把它的“为什么擅长长任务、为什么能做大规模 Agent”讲明白。
3. 公开参数与上下文
| 模型 | 总参数 | 激活参数 / 专家信号 | 上下文 | 备注 |
|---|---|---|---|---|
Kimi K2 | 1T | 32B activated | 官方路线延续到后续平台模型 | 明确是 MoE |
Kimi K2.6 | 官方页面未再次强调总参数 | 官方未在平台页单独列出 | 262,144 | 更偏 general-purpose + agent |
Kimi K2.7 Code | 官方平台页未披露总参数 | 官方未在平台页单独列出 | 262,144 | 更偏 coding + agent |
Kimi K3 | 官方博客强调可扩展到 trillion-parameter regime | 896 experts 中有效激活 16 个 | 1,048,576 | 长任务与知识工作主力 |
4. 当前官方价格
以下价格来自 Kimi Platform 官方文档,单位为 CNY / 1M tokens。
| 模型 | 缓存输入 | 非缓存输入 | 输出 | 上下文 |
|---|---|---|---|---|
kimi-k2.6 | ¥1.10 | ¥6.50 | ¥27.00 | 262,144 |
kimi-k2.7-code | ¥1.30 | ¥6.50 | ¥27.00 | 262,144 |
kimi-k2.7-code-highspeed | ¥2.60 | ¥13.00 | ¥54.00 | 262,144 |
kimi-k3 | ¥2.00 | ¥20.00 | ¥100.00 | 1,048,576 |
4.1 这组价格体现了什么
Kimi 的价格表最值得注意的不是“贵”或“便宜”,而是:
- 对
缓存命中极其敏感 - 高端长上下文和知识工作模型会把
输出价拉得很高 - 这说明它更像在卖“复杂长任务执行能力”,而不是卖最便宜文本 token
5. Kimi 为什么特别适合看“Agent 视角下的模型”
5.1 优势
- 对知识工作、长链路执行和多工具任务有非常明确的产品定义
- 架构披露较多,便于理解成本结构
- K3 对
1M context和 Agent 工作流的强调非常直接 - K2.6 / K2.7 Code / K3 的分层很适合做模型路由
5.2 边界
- 如果你的任务只是短问答,Kimi 很多优势用不上
- 高能力档的输出价格不低
- 真正要把 Kimi 的价值吃出来,需要你也有 Agent、工具和长任务编排能力
6. 一个关键理解:Kimi 在押注“知识工作自动化”
Kimi 不是单纯在追聊天体验,而是在押注:
- 研究
- 编码
- 文档生产
- 报告与演示
- 长时 Agent
这些真实知识工作流程。
所以如果你的场景是:
- 研究报告生成
- 长链路自动化任务
- 代码与文档混合产出
- 多步骤知识工作
Kimi 往往比“只看聊天测试”的印象更强。
7. 选型建议
优先考虑 Kimi 的情况:
- 你要做
coding + knowledge work + agent - 你要做长链路任务,而不是短 prompt
- 你很在意模型对真实知识工作的完成度
如果你更关心:
- 极低单价
- 极致性价比与更广开源适配
8. 主要来源
- Kimi Research Blog:https://www.kimi.com/blog/
- Kimi K2.6:https://www.kimi.com/blog/kimi-k2-6
- Kimi K3:https://www.kimi.com/blog/kimi-k3
- Kimi K2 报告:https://platform.kimi.com/blog/posts/k2-report
- Kimi Pricing K2.6:https://platform.kimi.com/docs/pricing/chat-k26.md
- Kimi Pricing K2.7 Code:https://platform.kimi.com/docs/pricing/chat-k27-code.md
- Kimi Pricing K3:https://platform.kimi.com/docs/pricing/chat-k3.md