Claude Sonnet 5.5 是 Anthropic 于 2026 年 9 月 28 日发布的 Claude 5.5 系列第二款模型。Claude API 的标准全球价格为每百万输入 token 2 美元、每百万输出 token 10 美元,整个 1M 上下文窗口采用统一费率。如果你正在查找 sonnet 5.5 vs haiku 5.5 或 sonnet 5.5 bedrock,关键区别是:Haiku 的 API 价格更低,但按提示长度分档;Bedrock 则由 AWS 独立定价。
选型时,需要分清三类信息:Anthropic 的规格与评测、Arena 的人类偏好评分,以及 OpenRouter 的 token 使用量。它们回答的问题不同。本文价格依据 2026 年 10 月 11 日的文档,Arena 数据发布于 10 月 8 日,OpenRouter 周榜统计窗口为 10 月 4 日至 10 日。
Sonnet 5.5 价格:标准、缓存与批处理费率
Claude API 价格页列出了以下全球费率。所有价格均为美元/百万 token;缓存时长指缓存写入选项。
| token 或处理类别 | Sonnet 5.5 价格 |
|---|---|
| 标准输入 | $2 |
| 标准输出 | $10 |
| 5 分钟缓存写入 | $2.50 |
| 1 小时缓存写入 | $4 |
| 缓存读取 | $0.10 |
| Batch API 输入 | $1 |
| Batch API 输出 | $5 |
缓存读取价格存在资料差异:发布公告写的是 $0.20,当前价格页则为 $0.10,即标准输入价格的 0.05 倍。本文采用当前价格页的数值。仅限美国的推理适用 1.1 倍价格系数;上表列的是全球价格。
Sonnet 5.5 在整个 1M 上下文窗口内保持统一的输入与输出费率。估算预算时,应分别计算普通输入、缓存写入、缓存读取和输出,不能把所有 token 都按标准输入价格计费。Batch 是另一种处理方式,估算 Batch API 任务时应使用对应费率。
模型概览给出的最大输出为 128K;Batch API 搭配 beta 请求头可达到 300K。输出上限与 Batch 折扣是两个独立信息:允许生成更长的响应,并不意味着总费用更低。
Sonnet 5.5 在 Arena 与 OpenRouter 的排名
Arena 衡量的是特定类别中的人类偏好,本文引用的整体文本榜启用了风格控制。榜单条目为 claude-sonnet-5.5-xhigh,对应 xhigh 努力级别变体。这个成绩不能直接代表所有 Sonnet 5.5 配置,也不能等同于默认 high 努力级别的成绩。
| Arena 类别,2026 年 10 月 8 日 | 名次 | 评分 | 置信区间 | 票数 |
|---|---|---|---|---|
| 整体文本,风格控制 | 32 | 1475.8 | 1467.0–1484.6,95% CI | 4,838 |
| 编程 | 18 | 1531.8 | 1514.6–1549.0 | 1,176 |
→ 在 AI Rank 查看: Claude Sonnet 5.5 的 Arena 评分、名次与 90 天走势
当前票数仍较少,置信区间较宽。整体文本榜中,GPT-6 Astra Max 位列 35,评分 1475.1,与 Sonnet 的 1475.8 很接近;仅凭这点分差,无法有把握地判断偏好高低。编程榜中,Sonnet 5.5 的名次高于 Sonnet 5 high,后者位列 36、评分 1519.1,但两者的努力级别也不同。Haiku 5.5 尚未进入 Arena,因此目前没有可用于对比的 Haiku 5.5 Arena 评分。
OpenRouter 的 10 月 4 日至 10 日文本周榜中,Sonnet 5.5 位列 15,使用量 1.69T token,环比上周增长 216%。Haiku 5.5 位列 23,使用量 818B token,标记为新上榜;Sonnet 5 位列 28,使用量 679B token,下降 17%。这些数字反映 OpenRouter 平台上的 token 使用量,不是质量评分,也不代表整个市场。
→ 实时使用量: 在 AI Rank 的 OpenRouter 模型使用量榜 查看它本周的名次(按 token 计,2026-10-04 至 10-10 窗口)。
Sonnet 5.5 vs Haiku 5.5:该选哪个?
价格是目前最明确的区别。Haiku 5.5 按提示长度分为两档,Sonnet 5.5 则在整个上下文窗口内使用统一费率。下表为 Claude API 标准价格,单位为美元/百万 token。
| 模型与提示长度 | 输入 | 输出 |
|---|---|---|
| Sonnet 5.5,整个 1M 上下文 | $2 | $10 |
| Haiku 5.5,不超过 100K token | $0.10 | $0.50 |
| Haiku 5.5,超过 100K token | $0.50 | $2.50 |
Anthropic 将 Sonnet 5.5 的延迟档位标为“Fast”,Haiku 5.5 标为“Fastest”;两者默认努力级别分别为 high 和 medium。模型对照表中,两者均有 1M 上下文和 128K 最大输出。Haiku 面向高调用量、成本敏感的应用;当 Sonnet 公布的能力与任务需求相关时,可以评估这些能力是否值得更高的 token 费率。
如果预算是主要约束,先根据提示长度确定 Haiku 的适用档位。如果任务与 Sonnet 发布评测覆盖的工作相近,可以将 Sonnet 纳入候选,再按自己的验收标准判断。现有证据不足以证明两者之间存在适用于所有任务的质量赢家:Haiku 没有 Arena 条目,OpenRouter 使用量较高也不能解决质量比较问题。
更多信息可参考 AI Rank 的 Haiku 5.5 API 价格指南与 Haiku 5.5 基准成绩文章。
Sonnet 5.5 Bedrock:模型 ID 与价格说明
AWS 模型卡记录了以下标识符:
| 接入方式 | 标识符 |
|---|---|
| Claude API | claude-sonnet-5-5 |
| Amazon Bedrock 模型 | anthropic.claude-sonnet-5-5 |
| Bedrock 全球推理配置文件 | global.anthropic.claude-sonnet-5-5 |
| Bedrock 美国地理推理配置文件 | us.anthropic.claude-sonnet-5-5 |
| Bedrock 欧洲地理推理配置文件 | eu.anthropic.claude-sonnet-5-5 |
Sonnet 5.5 自 2026 年 9 月 28 日起在 Bedrock 和 Claude Platform on AWS 提供。AWS 还记录了支持 Anthropic Messages API 的 bedrock-mantle 端点。选择接入方式时,应核对模型卡中最新的区域可用性。
Bedrock 价格由 AWS 独立制定。 上面的 Claude API 价格表不能作为 Bedrock 报价。所提供的证据没有核实 Bedrock 价格,请到 AWS Bedrock 价格页查看相应 AWS 费率。
Anthropic 公布的基准成绩
Anthropic 在发布公告中报告了以下结果:
| 评测 | Sonnet 5.5 | Anthropic 报告的对照成绩 |
|---|---|---|
| Terminal-Bench 4.0 | 70.6% | Sonnet 5:10.3%;Opus 5.5,Xhigh:66.4% |
| CursorBench 4.0 | 55.5% | Opus 5.5:57.8% |
| OSWorld 2.1 | 80.1% | — |
| GDPval-AA v2.1 | 1844 | Opus 5.5:1846 |
Anthropic 还报告,在其测试中,Sonnet 5.5 比 Sonnet 5 快 30% 以上,单项任务成本最多降低 30%。单项任务成本属于厂商评测结果,与公开的每 token 费率是不同概念。这些评测由厂商运行,努力级别存在差异,AI Rank 没有独立复现这些结果。
局限与核对要点
选型前,先确认供应商、模型标识符、努力级别、价格日期和任务要求。Sonnet 5.5 支持自适应思考,默认努力级别为 high;Arena 条目使用 xhigh。文档列出的知识截止时间为 2026 年 6 月,退役时间不早于 2027 年 9 月 28 日。
解读数据时,应考虑 Arena 的置信区间、Haiku 数据缺失,以及 OpenRouter 仅覆盖单一平台的限制。重新核对缓存读取价格和 AWS 区域可用性,并在实际任务上评估效果,再决定是否将公开基准成绩作为部署依据。
选型前先对比: 价格和排名每天都在变,决定前先看 AI Rank 的最新模型排名。
或 📱 下载 AI Rank App 在手机上随时查看。
本文使用自动化编辑辅助,于 2026 年 10 月 11 日依据官方资料与指定日期的 AI Rank 数据核对,未进行自有跑分测试。