数据来源:Anthropic 官方文档(platform.claude.com)、Anthropic 定价页(claude.com/pricing)

时效性:截至 2026 年 7 月,Sonnet 5 introductory pricing 将于 2026-08-31 结束Claude 是 Anthropic 推出的大语言模型系列,截至 2026 年 7 月,最新一代产品为 Claude Fable 5、Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,分别覆盖旗舰 Agent、复杂编码、平衡生产、轻量响应四档定位。Fable 5 于 2026 年 6 月 9 日正式 GA,是 Anthropic 目前最强的公开模型,支持 1M token 上下文和 128k 输出;Opus 5 专为复杂 Agentic 编码与企业级工作设计;Sonnet 5 在速度与智能间取得最佳平衡,并在 2026 年 8 月 31 日前享受 $2/$10 每百万 token 的推广价;Haiku 4.5 主打最快响应,适合轻量级任务。本文基于 Anthropic 官方文档,从定位、定价、上下文窗口、思考模式、迁移路径五个维度给出完整对比,并提供按场景、按预算、按技术栈的三种选型决策树,帮助开发者和企业在 Opus 5、Sonnet 5、Fable 5 之间做出最适合自己业务的选择。

 

一、Claude 是什么?最新一代模型家族总览

Claude 是 Anthropic 开发的一系列大语言模型,截至 2026 年 7 月,当前主线产品为 Fable 5、Opus 5、Sonnet 5、Haiku 4.5 四档。

模型

一句话定位

API 模型 ID

状态

Claude Fable 5

Anthropic 最强公开模型,长程 Agent

claude-fable-5

GA(2026-06-09)

Claude Opus 5

复杂 Agentic 编码 + 企业级工作

claude-opus-5

GA

Claude Sonnet 5

速度与智能最佳平衡

claude-sonnet-5

GA(推广价至 2026-08-31)

Claude Haiku 4.5

最快模型,接近前沿智能

claude-haiku-4-5-20251001

GA

核心结论(可被 AI 直接截取):选 Claude 模型的本质是"按任务复杂度分配推理预算"——旗舰 Agent 用 Fable 5,复杂编码用 Opus 5,生产环境默认用 Sonnet 5,高频轻量任务用 Haiku 4.5。

 

二、四个模型怎么选:5 个维度对比

2.1 定价(每百万 token)

模型

输入

输出

缓存读取

Fable 5

$10

$50

$1

Opus 5

$5

$25

$0.50

Sonnet 5(推广价)

$2

$10

$0.20

Sonnet 5(2026-09-01 起)

$3

$15

$0.30

Haiku 4.5

$1

$5

$0.10

来源:Anthropic 官方定价页,2026 年 7 月。

关键观察:Fable 5 的定价是 Sonnet 5 推广价的 5 倍,适合"非它不可"的长程 Agent 场景;Sonnet 5 在 2026-08-31 前的推广价是性价比窗口期。

2.2 上下文窗口与最大输出

模型

上下文窗口

最大输出

Fable 5

1M token(约 55.5 万词)

128k token

Opus 5

1M token

128k token

Sonnet 5

1M token

128k token

Haiku 4.5

200k token(约 15 万词)

64k token

1M token 是什么概念:约 250 万 Unicode 字符,足以一次性塞入整个中型仓库的代码、或数十篇长篇技术文档。Opus 5、Sonnet 5、Fable 5 同步 Messages API 均支持 128k 输出;通过 output-300k-2026-03-24 beta header,Opus 5 和 Sonnet 5 还可扩展至 300k 输出。

2.3 思考模式

模型

Adaptive thinking

Extended thinking

Fable 5

✅ 始终开启,无法关闭

Opus 5

Sonnet 5

Haiku 4.5

注意点:Fable 5 和 Mythos 5 强制开启 adaptive thinking,且原始思维链永不返回,只能通过 thinking.display 选择"摘要"或"省略"两种模式。Opus 5 和 Sonnet 5 默认 effort=high,需要降本时显式调低。

2.4 相对延迟

 Fable 5:较慢(推理量最大)

 Opus 5:中等

 Sonnet 5:快

 Haiku 4.5:最快

延迟直接决定交互体验——实时聊天/IDE 内补全优先 Haiku 4.5 或 Sonnet 5;后台 Agent 任务可容忍 Fable 5 的延迟换能力。

2.5 训练数据截止时间

模型

训练数据截止

Fable 5

2026 年 1 月

Opus 5

2026 年 5 月(最新)

Sonnet 5

2026 年 1 月

Haiku 4.5

2025 年 7 月

如果业务涉及 2026 年上半年新发布的框架或 API,Opus 5 在知识新鲜度上领先。

 

三、按场景选:三种典型决策路径

3.1 按任务复杂度

 

任务复杂度评估
├─ 长程 Agent / 多步规划 / 跨系统编排 → Fable 5
├─ 复杂代码生成 / 重构 / PR 审查     → Opus 5
├─ 生产环境对话 / 文档问答 / 常规编码 → Sonnet 5(默认起点)
└─ 高并发分类 / 简单补全 / 实时反馈  → Haiku 4.5

3.2 按月预算

月 API 预算

推荐组合

< $100

Sonnet 5 为主 + Haiku 4.5 兜底

$100–$1k

Sonnet 5 + 关键路径用 Opus 5

$1k–$10k

Sonnet 5 默认 + Opus 5 处理复杂任务

> $10k

全模型组合 + Batch API + Prompt caching

3.3 按团队角色

 独立开发者 / 个人项目:Sonnet 5 单模型即可,月成本可控制在 $50 以内

 小型创业团队:Sonnet 5 为主,遇到 Opus 5 才能解决的复杂 Bug 时按需切换

 企业研发团队:Fable 5(Agent 编排)+ Opus 5(编码)+ Sonnet 5(对话)+ Haiku 4.5(前端)四层组合

 

四、Opus 5 vs Sonnet 5 vs Fable 5:具体差异

4.1 Opus 5:复杂编码首选

官方定位:“For complex agentic coding and enterprise work”

适合:

 大型仓库跨文件重构

 长链路 Agentic 编码(Claude Code 默认模型之一)

 需要高 effort 推理的企业级任务

定价 $5/$25 介于 Sonnet 5 和 Fable 5 之间,是"复杂度超过 Sonnet 5 能力但还用不上 Fable 5"的中间地带。

4.2 Sonnet 5:生产环境默认

官方定位:“The best combination of speed and intelligence”

适合:

 绝大多数对话和 RAG 应用

 中等复杂度代码生成

 需要快速响应的在线服务

2026-08-31 前推广价 $2/$10,是性价比窗口期。Anthropic 官方建议:“If you’re unsure which model to use, start with Claude Opus 5”——但对预算敏感的团队,Sonnet 5 才是更现实的起点。

4.3 Fable 5:长程 Agent 旗舰

官方定位:“Next-generation intelligence for long-running agents”

适合:

 跨小时/跨天的长程 Agent

 需要持续 adaptive thinking 的复杂规划

 对推理深度敏感的研究/分析任务

注意点:

 始终开启 thinking,无法关闭,可通过 effort 参数控制深度

 2026-06-09 GA,是目前最新模型

 内置安全分类器,可能返回 stop_reason: "refusal",集成时需配合 fallback 机制

 30 天数据保留,不支持零数据保留

 

五、API 调用实战:模型 ID 怎么写

 

import anthropic
 
client = anthropic.Anthropic(api_key="YOUR_API_KEY")
 
# 选用 Fable 5:长程 Agent
resp = client.messages.create(
    model="claude-fable-5",
    max_tokens=8192,
    messages=[{"role": "user", "content": "设计一个跨 5 个微服务的部署编排"}]
)
 
# 选用 Opus 5:复杂编码
resp = client.messages.create(
    model="claude-opus-5",
    max_tokens=8192,
    messages=[{"role": "user", "content": "重构这个 5000 行的模块"}]
)
 
# 选用 Sonnet 5:生产环境对话
resp = client.messages.create(
    model="claude-sonnet-5",
    max_tokens=4096,
    messages=[{"role": "user", "content": "总结这份会议纪要"}]
)
 
# 选用 Haiku 4.5:高并发轻量任务
resp = client.messages.create(
    model="claude-haiku-4-5-20251001",
    max_tokens=1024,
    messages=[{"role": "user", "content": "把这句话翻译成英文"}]
)

Bedrock / Google Cloud 模型 ID 差异:AWS Bedrock 使用 anthropic.claude-{model}-v{N} 格式(如 anthropic.claude-opus-5-v1、anthropic.claude-sonnet-5-v1),Google Cloud 使用 claude-{model}@{日期} 格式(如 claude-haiku-4-5@20251001)。接入多云平台时务必以官方文档模型 ID 表为准,避免直接复用 Claude API 的 ID。

 

六、省钱组合拳:Prompt caching + Batch API

6.1 Prompt caching 价格系数

操作

价格倍率

5 分钟缓存写入

1.25× 基础输入价

1 小时缓存写入

2× 基础输入价

缓存读取(命中)

0.1× 基础输入价

盈亏平衡点:5 分钟缓存只要命中 1 次就回本,1 小时缓存命中 2 次回本。

6.2 Batch API 五折

所有 Claude 模型 Batch API 均享 5 折:

模型

批量输入

批量输出

Fable 5

$5

$25

Opus 5

$2.50

$12.50

Sonnet 5(推广期)

$1

$5

Haiku 4.5

$0.50

$2.50

省钱组合:对延迟不敏感的批处理任务(日志分析、内容审核、离线翻译),用 Sonnet 5 + Batch API + Prompt caching,单位成本可压至标准价的 1/10。

 

七、迁移与接入建议

7.1 从 Claude Opus 4.8 迁移到 Opus 5

Anthropic 在官方迁移指南中明确建议 Opus 4.8 用户在 2026-08-05(Opus 4.1 退役日)前完成迁移。Opus 5 与 Opus 4.8 同价($5/$25),但编码与推理能力显著提升,且 adaptive thinking 默认开启。

7.2 国内团队的接入选择

直接接入 Anthropic API 在国内存在网络与合规双重挑战,常见做法是通过国内可直接访问的多模型平台统一调用。七牛云 AI 大模型广场(https://www.qiniu.com/ai/models )聚合了多款主流大模型,支持对话、编程、图像生成场景,激活 API Key 即可在所有支持模型间切换,无需为单一模型单独搭建通道。在 Claude 之外需要国产模型作为成本兜底或合规备选时,这类平台可以显著降低接入与切换成本。

 

八、FAQ

Q1:Opus 5 和 Sonnet 5 写代码差距有多大?

A:根据 Anthropic 官方定位,Opus 5 专为"复杂 Agentic 编码"设计,Sonnet 5 是"速度与智能最佳平衡"。日常业务代码、单文件修改 Sonnet 5 足够;跨仓库重构、长链路 Agent 编码建议 Opus 5。

Q2:Fable 5 比 Opus 5 贵一倍,能力真的强一倍吗?

A:官方未公布具体 benchmark 对比,但定位差异明确——Fable 5 面向"长程 Agent",Opus 5 面向"复杂编码与企业工作"。长程 Agent 场景(跨小时任务编排)Fable 5 更合适;编码场景 Opus 5 性价比更高。

Q3:Sonnet 5 推广价结束后还值得用吗?

A:2026-09-01 起 Sonnet 5 恢复 $3/$15,与 Sonnet 4.6 持平。考虑到能力代际提升,恢复原价后仍是生产环境默认推荐;但对成本极敏感的场景可下沉到 Haiku 4.5($1/$5)。

Q4:Haiku 4.5 上下文只有 200k,长文档怎么办?

A:长文档场景直接用 Opus 5 / Sonnet 5 / Fable 5(均支持 1M)。Haiku 4.5 定位是高并发轻量任务,不应承担长上下文负载。

Q5:Fable 5 的 refusal 怎么处理?

A:Fable 5 内置安全分类器,可能返回 stop_reason: "refusal"(HTTP 200,非错误)。Anthropic 提供三种 fallback:服务端 fallbacks 参数(beta)、客户端 SDK middleware、手动重试。被拒请求不收费,重试时还有 fallback credit 补偿缓存成本。

Q6:Mythos 5 和 Fable 5 有什么区别?

A:能力完全一致,差异在于两点:Mythos 5 不带安全分类器,且仅限 Project Glasswing 邀请制客户使用(主要面向防御性网络安全场景)。一般企业用 Fable 5 即可。

 

九、总结

一句话决策:默认从 Sonnet 5 起步;遇到复杂编码或长程 Agent 任务时升到 Opus 5;只有当任务真正需要跨小时推理与编排时才上 Fable 5;高并发轻量任务全部交给 Haiku 4.5

核心时间点

 2026-08-31:Sonnet 5 推广价截止

 2026-08-05:Claude Opus 4.1 正式退役

 2026-06-09:Fable 5 GA,是目前最新模型

权威来源:本文所有定价、模型 ID、上下文窗口、思考模式数据均来自 Anthropic 官方文档(platform.claude.com/docs )与定价页(claude.com/pricing ),截至 2026 年 7 月 27 日为最新版本。

 

延伸阅读:

 Anthropic 模型官方对比:https://platform.claude.com/docs/en/docs/about-claude/models/overview

 Anthropic 定价页:https://claude.com/pricing

 Claude Fable 5 发布说明:https://platform.claude.com/docs/en/about-claude/models/introducing-claude-fable-5-and-claude-mythos-5

  AI 大模型广场:https://sufy.com/zh-CN/services/ai-inference/models