Skip to content

Kimi / Moonshot AI

最后核对:2026-07-24

Kimi 这条线最值得单独看的一点,是它把 Agent知识工作长链路执行模型架构 放在了同一套叙事里。

1. 2025 以来的关键节点

时间模型 / 事件关键变化
2025-07-11Kimi K2官方明确为 MoE 模型,强调 open agentic intelligence
2026-04-20Kimi K2.6强化长程编码、主动 Agent 与多工具执行
2026-07-16Kimi K3明确进入 open frontier intelligence 路线,进一步强化知识工作与长任务执行

补充说明:

  • 当前 Kimi Platform 文档中还提供 kimi-k2.7-codekimi-k2.7-code-highspeed
  • 这说明 Kimi 近期路线非常明确地在把“coding model”和“general-purpose / knowledge-work model”分开。

2. Kimi 的架构路线为什么很特别

2.1 它不是只围绕聊天能力扩张,而是围绕“Agent 作为工作同事”扩张

从 Kimi 博客和平台文档能看出的高频关键词包括:

  • agentic intelligence
  • knowledge work
  • coding
  • video / image / text unified understanding
  • agent swarm
  • tool calls

这说明 Kimi 的路线不是简单做通用聊天,而是在把模型做成 知识工作执行体

2.2 官方公开了相当多架构信号

已知官方公开信号包括:

  • Kimi K21T total parameters32B activated parameters
  • Kimi K3Stable LatentMoE896 experts 中激活 16
  • Kimi K3:使用 Kimi Delta Attention (KDA)Attention Residuals

这类披露在主流前沿厂商里并不常见,说明 Kimi 很愿意把它的“为什么擅长长任务、为什么能做大规模 Agent”讲明白。

3. 公开参数与上下文

模型总参数激活参数 / 专家信号上下文备注
Kimi K21T32B activated官方路线延续到后续平台模型明确是 MoE
Kimi K2.6官方页面未再次强调总参数官方未在平台页单独列出262,144更偏 general-purpose + agent
Kimi K2.7 Code官方平台页未披露总参数官方未在平台页单独列出262,144更偏 coding + agent
Kimi K3官方博客强调可扩展到 trillion-parameter regime896 experts 中有效激活 161,048,576长任务与知识工作主力

4. 当前官方价格

以下价格来自 Kimi Platform 官方文档,单位为 CNY / 1M tokens

模型缓存输入非缓存输入输出上下文
kimi-k2.6¥1.10¥6.50¥27.00262,144
kimi-k2.7-code¥1.30¥6.50¥27.00262,144
kimi-k2.7-code-highspeed¥2.60¥13.00¥54.00262,144
kimi-k3¥2.00¥20.00¥100.001,048,576

4.1 这组价格体现了什么

Kimi 的价格表最值得注意的不是“贵”或“便宜”,而是:

  • 缓存命中 极其敏感
  • 高端长上下文和知识工作模型会把 输出价 拉得很高
  • 这说明它更像在卖“复杂长任务执行能力”,而不是卖最便宜文本 token

5. Kimi 为什么特别适合看“Agent 视角下的模型”

5.1 优势

  • 对知识工作、长链路执行和多工具任务有非常明确的产品定义
  • 架构披露较多,便于理解成本结构
  • K3 对 1M context 和 Agent 工作流的强调非常直接
  • K2.6 / K2.7 Code / K3 的分层很适合做模型路由

5.2 边界

  • 如果你的任务只是短问答,Kimi 很多优势用不上
  • 高能力档的输出价格不低
  • 真正要把 Kimi 的价值吃出来,需要你也有 Agent、工具和长任务编排能力

6. 一个关键理解:Kimi 在押注“知识工作自动化”

Kimi 不是单纯在追聊天体验,而是在押注:

  • 研究
  • 编码
  • 文档生产
  • 报告与演示
  • 长时 Agent

这些真实知识工作流程。

所以如果你的场景是:

  • 研究报告生成
  • 长链路自动化任务
  • 代码与文档混合产出
  • 多步骤知识工作

Kimi 往往比“只看聊天测试”的印象更强。

7. 选型建议

优先考虑 Kimi 的情况:

  • 你要做 coding + knowledge work + agent
  • 你要做长链路任务,而不是短 prompt
  • 你很在意模型对真实知识工作的完成度

如果你更关心:

  • 极低单价
  • 极致性价比与更广开源适配

建议继续看 DeepSeekQwen

8. 主要来源