资讯 · 改写稿

Claude Haiku 5.5 的价格与定位:小模型开始拼单价

结论先给:这一代小模型的重点不在跑分,而在单价——来源称 Haiku 5.5 平均比上一代便宜约 75%,同时把 Sonnet 的缓存读价格砍半。对高频、成本敏感的任务,这是更实际的信号。

来源(Anthropic,2026-10-07)把 Claude Haiku 5.5 定位成「我们发布过的最便宜、最快、也最强的小模型」,面向的是高频、成本敏感的场景:摘要、上下文压缩、数据库查询、分类请求这类又快又重复的活。它同时被建议作为 Opus 5.5 与 Sonnet 5.5 的子代理来分担编码任务,也适合对速度敏感的场景,例如实时客服与浏览器操作。

价格:分档单价

来源给出的单价(每百万 token,按上下文长度分「≤100k」与「>100k」两档):

来源称,综合下来它比 Haiku 4.5 平均便宜约 75%。同时,Sonnet 5.5 的缓存读价格从 $0.20 降到 $0.10(降幅 50%);由于缓存读占模型 token 消耗的很大一块,来源称这让 Sonnet 5.5 在多数代理类任务上整体便宜约 20%。

本站计算——把新的订阅额度折成 token 量:来源称 Max 5x 用户每月获 $100 额度、Max 20x 为 $200、Team 最高 $500(在成员间池化)。按 Haiku 5.5 输入价 $0.10/百万 token 计,$100 约合 10 亿输入 token(100 ÷ 0.10 = 1000 个百万)。当然实际用量里输出更贵($0.50 起),这个数字更适合当「量级参考」而不是预算上限。

可用范围

来源称 Haiku 5.5 已在 AWS、Google Cloud、Microsoft Azure 等平台上线,模型 ID 为 claude-haiku-5-5,并提供了迁移指南。

怎么判断该不该换到它

来源反复强调的适用面是「高频、可重复」:摘要、上下文压缩、分类、数据库查询。判断方法可以很朴素——如果你的任务里,同一个提示词一天要跑成百上千次,且每次输出都很短,那么决定成本的是单价而不是跑分;反过来,如果任务是「一天问几次、但每次都要它想很久」,那这类小模型并不合适,该看的是推理更强的大模型。换句话说,它优化的是「每一次调用有多便宜」,不是「一次能想多深」。

本站计算——把来源给的「平均便宜约 75%」换成倍数关系:单位成本降到原来的约四分之一(1 − 0.75 = 0.25),也就意味着同一笔预算能处理约 4 倍的调用量(1 ÷ 0.25)。对按量付费的团队来说,这个倍数比任何跑分都更能影响月账单。

容易踩的坑

只看跑分不看单价:这一代小模型的卖点恰恰是成本。

忽略上下文分档:同一模型在 >100k 上下文时单价会跳到另一档。

把订阅额度和 API 计价混着算:两者口径不同,别用同一个数字下结论。

自检清单

常见问题

Claude Haiku 5.5 的定位是什么?

来源称它是最便宜、最快、也最强的小模型,面向摘要、压缩、数据库查询、分类等高频且成本敏感的任务,也可作为 Opus 5.5 / Sonnet 5.5 的子代理。

它的价格是多少?

来源给出的单价(每百万 token)为:输入 $0.10/$0.50、输出 $0.50/$2.50、缓存读 $0.01/$0.05、缓存写 $0.125/$0.625,按上下文是否超过 100k 分两档。

相比上一代便宜多少?

来源称 Haiku 5.5 平均比 Haiku 4.5 便宜约 75%。

订阅额度有什么变化?

来源称新增每月 API 额度:Max 5x 用户 $100、Max 20x 用户 $200,Team 订阅最高 $500 并在成员间池化。

来源参考

以上为外部来源;本文为 RefHub 用自己的结构重写,事实以来源页为准,价格与政策会变,请回源核对当日。

下一步:各类 AI 工具的价格横评,读 AI 工具价格盘点;按单价算可用额度,见 额度计算器。