模型指南 · Claude Haiku 4.5

Claude Haiku 4.5 完整指南
$1/$5 每 MTok,截至 2026-09-29 实测 30 天 139,341 次调用——全平台前三

Claude 系列里最便宜、最快的档位,$1/$5 每百万 token;QCode 上 30 天实测 139,341 次(2026-09-29 查),全平台排第三,仅次于 claude-sonnet-5 与 deepseek-v4.1-flash。

更新于 2026-09-19

Claude、GPT 与国产模型共用一把 key,按 token 计费;可调型号以 /models 为准。

#claude-haiku-4-5#$1/$5 每 MTok#高吞吐低延迟#139,341 次/30 天 · 截至2026-09-29

四个关键数字

$1 / $5

每百万 token(输入/输出)

Claude 全系最便宜的档位,只有 Opus 5.5($4/$20,2026-09-22)的四分之一。

139,341

30 天真实调用次数

2026-09-29 实测:Claude Haiku 4.5 的 30 天调用量 139,341 次,全平台第三,上面是 claude-sonnet-5(202,293 次)与 deepseek-v4.1-flash(179,461 次)。

第 3 名

全平台 30 天调用量排名(2026-09-29)

截至 2026-09-29 实测,在 QCode 所有在售模型里,Haiku 4.5 的 30 天调用量排第三,是平台上的主力档位之一。

低延迟

定位

面向高吞吐量、对延迟敏感、低复杂度的任务:分类、抽取、路由、简单编辑。

Haiku 4.5 是什么

Claude Haiku 4.5 是 Claude 系列里最便宜、速度最快的档位,定价 $1/$5 每百万 token(输入/输出),只有现役 Opus 5.5($4/$20,2026-09-22 发布)的四分之一。它的定位不是拼推理深度,而是拼吞吐量和响应速度——分类、信息抽取、请求路由、格式化、简单编辑这类高频、低复杂度的任务是它的主场。QCode 上截至 2026-09-29 的 30 天实测调用 139,341 次、全平台排第三,说明大量用户已经把它用作日常高频任务的默认选择之一。

为什么它的调用量这么高

站内已有的成本优化建议里就提到:复杂任务用 Sonnet,格式化等简单任务切换 Haiku,避免用 Opus 完成 Sonnet/Haiku 就能胜任的工作。Haiku 4.5 的低价格和低延迟,让它天然适合被大量高频调用的场景(比如 agent 工作流里的路由判断、批量格式化),这正是它调用量位居全平台前三的原因(2026-09-29 实测)——它不是被单独大量使用,而是被大量工作流当成「默认的轻量档位」持续调用。

时间线

长期在售

Claude Haiku 4.5 作为 Claude 系列最便宜档位持续在售,定价 $1/$5 每 MTok。

近期

随着 agent 化工作流普及,Haiku 被越来越多框架设为默认的轻量路由档位。

2026-09-28 官方

官方 Sonnet 5.5 发布页把 Claude Haiku 5.5 列为同家族型号,并写明它的定位(high-volume and cost-sensitive applications);当时价格、上下文与模型 ID 均未公布。2026-10-07 已发布,模型 ID claude-haiku-5-5。

已确认 vs 需要自己核实

已确认

Haiku 4.5 定价 $1/$5 每 MTok;QCode 上 30 天实测 139,341 次(截至 2026-09-29,平台用量核实);具体路由 id 为 claude-haiku-4-5-20251001 这个快照版本;官方弃用表写明其退役日为「Not sooner than October 15, 2026」——最早可能日,不是当天关停。

需要自己核实

「便宜的模型能力一定弱」是常见的刻板印象,但 Haiku 4.5 在它擅长的任务类型(分类、抽取、路由、简单编辑)上表现足够可靠;具体能否满足你的复杂任务需求,建议先用小规模实测判断,而不是仅凭价格下结论。

适合 Haiku vs 需要更强档位

适合用 Haiku 4.5

高吞吐量、对延迟敏感、任务本身不复杂:分类、抽取、路由、格式化、简单编辑,这类场景用 Haiku 性价比最高。

需要 Sonnet 或 Opus

复杂推理、长链路 agentic 任务、需要深度代码理解的场景,Haiku 的能力上限不是为这类任务设计的,建议换更高档位。

怎么用

在 QCode 上直接调用 claude-haiku-4-5 即可,接口与 Claude 其它模型一致。建议的用法是分层路由:把任务先按复杂度分类,简单、高频的部分路由给 Haiku,复杂、低频的部分路由给 Sonnet 或 Opus,这样既能控制成本,又不牺牲复杂任务的质量。

在 QCode 上怎么办

QCode 上 Haiku 4.5 与 Claude 全系列共用一把密钥,按官方价 × 服务费率计费;把高频简单任务分流给 Haiku,是控制整体 token 预算最直接有效的办法之一。

常见问题

Haiku 4.5 在全平台调用量里排第几?

截至 2026-09-29 的 30 天实测,Haiku 4.5 以 139,341 次排全平台第三,仅次于 claude-sonnet-5(202,293 次)与 deepseek-v4.1-flash(179,461 次)。排名会随用量变化。

Haiku 4.5 比 Sonnet 5、Opus 系列便宜多少?

Haiku 4.5 是 $1/$5 每 MTok,Sonnet 5 是 $2/$10,现役 Opus 5.5(2026-09-22 发布)是 $4/$20、上一档 Opus 5 是 $5/$25,Fable 5.1 是 $10/$50(Anthropic 官方价表,2026-09-29 核对)。Haiku 分别是 Sonnet 5 的一半、Opus 5.5 的四分之一。Sonnet 5 的 $2/$10 已在 2026-08-10 由官方转为永久价,原定 2026-09-01 涨到 $3/$15 不再适用。

Haiku 4.5 适合做 agent 里的什么角色?

适合做路由判断、工具调用参数抽取、结果格式化这类高频但不需要深度推理的子任务,把复杂决策留给 Sonnet 或 Opus。

为什么调用量这么高但很多人没意识到自己在用它?

很多框架/工作流会把 Haiku 设为默认的轻量档位,自动处理分类、路由等后台任务,用户往往只感知到主模型(比如 Sonnet)的存在,Haiku 在背后被高频调用。

Haiku 4.5 和 Claude Code 默认模型是什么关系?

Claude Code 默认使用 Sonnet 5,Haiku 4.5 更多是作为可选的轻量档位,由用户或框架显式路由简单任务过去,而不是默认的主力交互模型。

QCode 上用 Haiku 4.5 怎么计费?

按官方价 $1/$5 每百万 token(输入/输出)× 服务费率计费,与 Anthropic 官方 API 的计价基准一致,不做额外加价。

信息来源

Haiku 4.5 的定价与定位描述来自站内已核实的 Claude 成本优化专页;30 天真实调用数据来自 QCode 平台用量核实,2026-09-29 抓取;所引 Anthropic 官方价表、弃用表与 2026-09-28 发布帖均取自 2026-09-29 核对的存档(路由快照 id 为 claude-haiku-4-5-20251001)。

高频任务,交给 Haiku 4.5

一把 QCode 密钥调用 Haiku 4.5 及 Claude 全系列,按官方价 × 服务费率计费。

相关阅读

本页模型定价与调用数据基于站内已核实信息与 QCode 平台用量核实,不代表 Anthropic 官方立场;具体调用量与在售状态以 QCode 平台实时数据为准。

先体验,再决定

不确定选哪档?先买体验版(¥60/月),满意再升级,旧套餐剩余价值按比例退回余额。