Appearance
Claude / Anthropic
最后核对:
2026-07-24
Anthropic 这条线最值得看的,不只是“模型强不强”,而是它把 长上下文、prompt caching、tool use、agentic coding 和 企业化稳定性 放得非常前。
1. 2025 以来的关键节点
| 时间 | 模型 / 事件 | 关键变化 |
|---|---|---|
2025-02-24 | Claude 3.7 Sonnet | Anthropic 首次把“混合推理”更明确地产品化,兼顾即时响应与可延长思考 |
2025-05-22 | Claude 4 | 正式把 Opus 4 与 Sonnet 4 推向以 coding / agent 为核心的前沿路线 |
2026 | Claude 4.5 / 4.6 / 4.7 / 4.8 | 继续强化 agentic coding、长上下文、输出质量和企业化部署能力 |
说明:
- 本页只讨论
2026-07-24之前已经落地的版本。 - 晚于
2026-07-24的未来发布日期,不纳入本页结论。
2. 架构路线怎么看
2.1 Claude 路线的核心不是“公开多少参数”,而是“把复杂任务做稳”
Anthropic 当前公开资料里,最强烈的信号不是总参数,而是:
1M contextprompt cachingtool useagentic codingdata residencybatch
这说明 Claude 的架构与产品路线,是围绕“长任务、复杂任务、企业任务如何稳定执行”来展开的。
2.2 工程上的典型感受
如果把 GPT 更看成“能力平台”,Claude 往往更像“长任务与复杂 coding 的稳态执行层”。
它在官方文档中的表达明显更偏:
- coding agent
- enterprise work
- output quality
- context reliability
这也是为什么很多团队会把 Claude 放在:
- 代码评审
- 长文档改写
- 长链路工具执行
- 多轮 agent 任务
这些比单轮问答更复杂的位置。
3. 公开参数与上下文
| 模型 | 官方参数披露 | 上下文 | 备注 |
|---|---|---|---|
Claude 3.7 Sonnet | 官方未披露总参数 / 激活参数 | 旧代长上下文能力已较强 | 2025 年的重要过渡代 |
Claude Opus 4.1 | 官方未披露 | 200K 级主线能力 | 截至当前已标记 deprecated |
Claude Sonnet 4.5 | 官方未披露 | 与长上下文路线深度绑定 | 进入新定价与区域推理规则 |
Claude Sonnet 4.6 | 官方未披露 | 1M | 官方明确说明 1M context 标准价可用 |
Claude Opus 4.6 | 官方未披露 | 1M | 更偏复杂 agentic coding |
Claude Opus 4.7 / 4.8 | 官方未披露 | 1M | 继续强化复杂企业任务与长链路执行 |
4. 当前官方价格观察
以下是 2026-07-24 官方价格页能确认的代表性标准价,单位为 USD / MTok。
| 模型 | 标准输入 | 5m Cache Write | 1h Cache Write | Cache Hit / Refresh | 输出 |
|---|---|---|---|---|---|
Claude Opus 4.1 | $15 | $18.75 | $30 | $1.50 | $75 |
Claude Sonnet 4.5 | $3 | $3.75 | $6 | $0.30 | $15 |
Claude Sonnet 4.6 | $3 | $3.75 | $6 | $0.30 | $15 |
Claude Opus 4.5 | $5 | $6.25 | $10 | $0.50 | $25 |
Claude Opus 4.6 | $5 | $6.25 | $10 | $0.50 | $25 |
Claude Opus 4.7 / 4.8 | $5 | $6.25 | $10 | $0.50 | $25 |
4.1 Claude 价格表最值得看什么
最关键的不是“Claude 贵不贵”,而是它把几件对长任务很重要的规则写得很清楚:
prompt caching单独计费1M context是否标准价格可用Batch是否半价inference_geo: "us"是否有1.1x溢价
也就是说,Claude 非常适合那些已经开始认真做:
- 长上下文会话
- 提示缓存
- 区域合规
- 大批量离线任务
的团队。
5. 为什么 Claude 在 Agent 和 Coding 场景经常被放到高位
5.1 优势
- 长上下文文档与代码任务稳定性好
- Prompt caching 设计清晰,适合重复大前缀工作流
- 文档对工具使用、区域推理、长上下文费用边界交代得很完整
- 很适合做“重任务、长任务、复杂任务”的主力模型
5.2 边界
- 单价通常高于大量开源 / 稀疏路线
- 官方不公开总参数与底层训练细节
- 如果你的工作流很短、很高频、很模板化,Claude 的强项不一定能完全转化成 ROI
6. 一个很重要的工程判断
很多团队把 Claude 只理解成“更会写字”或者“更会写代码”,这其实低估了它的真正价值。
更准确的理解通常是:
- Claude 擅长的是
长任务稳定性 - 尤其是跨多轮、跨工具、跨大上下文的任务连续性
所以如果你做的是:
- 大文档理解
- 代码代理
- 多步审批 / 研究 / 报告生成
- 长链路人机协同任务
Claude 经常会比只看单轮 benchmark 更有优势。
7. 选型建议
更适合选 Claude 的情况:
- 你做的是
agentic coding - 你需要
200K~1M级上下文且愿意做缓存治理 - 你重视长任务稳定性和企业化文档边界
- 你能接受更高的基础单价来换更好的复杂任务表现
如果你更重视:
- 开源可控
- 参数公开
- 极致性价比
8. 主要来源
- Anthropic Models overview:https://platform.claude.com/docs/en/about-claude/models/overview
- Anthropic Pricing:https://platform.claude.com/docs/en/about-claude/pricing
- Anthropic 官方发布:https://www.anthropic.com/news/claude-3-7-sonnet
- Anthropic 官方发布:https://www.anthropic.com/news/introducing-claude-4