Claude Haiku 4.5 是 Anthropic 面向交互应用、高吞吐处理和有边界智能体步骤的快速模型。最重要的事实是它的 200,000 token 上下文:它比更大的 Claude 档位便宜、响应更快,但不像 Sonnet 5 和 Opus 5 那样列出 100 万上下文。因此,它适合抽取、分类、短编码循环和浏览器尺度的任务,不应自动承担超长、多阶段计划。
我在 2026 年 9 月 21 日核对的 Claude Haiku 4.5 模型页列出固定 ID claude-haiku-4-5-20251001、200K 上下文、64K 最大输出和每百万 token 输入/输出 1/5 美元。Anthropic 将它标为 Active(latest),退休时间不早于 2026 年 10 月 15 日。下文会说明如何验证浏览器工作流;本文没有完成登录 Tabbit 实测。
关键结论
Haiku 4.5 是 Anthropic 当前比较表中最快、价格最低的模型,使用手动 extended thinking,不提供新模型的自适应 effort 控制。
200K 上下文和 64K 输出是实际边界,不等同于 Sonnet 5 或 Opus 5 的 1M 上下文。
API 价格是输入 1 美元、输出 5 美元每百万 token;缓存和 Batch API 另有规则,Claude 订阅、云平台和 Tabbit 不是同一账单。
Anthropic 宣称它以三分之一成本和两倍以上速度达到接近 Sonnet 4 的编码表现。独立结果只支持具体任务,不能证明普遍领先。
先用 Haiku 处理输入、输出和验收标准都清楚的任务;需要更深计划、更大上下文或更强审查时再升级。
Claude Haiku 4.5 速查
Claude Haiku 4.5 模型资源、提示词集合和测评集合保留来源路径,但不会授予 API 额度、Claude 方案或浏览器权限。
| 项目 | 当前信息 | 边界 |
|---|---|---|
| 定位 | 当前 Claude 阵容中最快、接近前沿能力的路线 | “最快”是阵容定位,不是你应用的延迟保证。 |
| 发布 | 2025-10-15 | 发布日期不等于当前可用。 |
| API ID | claude-haiku-4-5-20251001;别名 claude-haiku-4-5 | Bedrock、Google Cloud 使用提供商 ID。 |
| 上下文 / 输出 | 200K / 64K token | 工具和历史会减少有效空间。 |
| 输入 / 输出 | 文本和图片 → 文本 | 工具权限来自具体 API 或客户端。 |
| 思考 | 手动 extended thinking,无默认 effort | thinking budget 会改变延迟、成本和缓存行为。 |
| API 价格 | 输入 1 / 输出 5 美元每百万 token | 缓存、Batch、订阅和云账单分开。 |
| 生命周期 | Active(latest);不早于 2026-10-15 退休 | “不早于”不是无限期支持承诺。 |
从 Haiku 3.5 到 4.5 改了什么
Anthropic 将 Haiku 4.5 定位为效率升级:小模型以更快、更便宜的路线提供接近前沿的能力。官方发布称它以三分之一成本和两倍以上速度达到类似 Sonnet 4 的编码表现,并改善电脑使用。这些是发布方结论,不是最新的统一独立复测。
迁移指南中更值得注意的是工程变化:替换模型 ID,重新检查独立限额;从 Claude 3.x 迁移时只使用 temperature 或 top_p 其中一个;更新工具版本,移除 undo_edit;处理 refusal stop reason;并适应 Claude 4 更简洁直接的表达。复杂推理可手动打开 extended thinking 并设置预算,不能假定它有 Sonnet 5 的 adaptive 控制。
| 迁移问题 | Haiku 3.5 → 4.5 | 需要验收 |
|---|---|---|
| 模型字符串 | claude-3-5-haiku-20241022 → claude-haiku-4-5-20251001 | 固定快照、别名和提供商 ID。 |
| 参数 | 旧代码可能同时设置两个采样参数 | 只留 temperature 或 top_p,确认不会 400。 |
| 工具 | 可能依赖旧工具版本 | 更新 editor/code execution,移除 undo_edit。 |
| 停止原因 | 处理器可能只处理成功文本 | 明确处理 refusal 并测试回退。 |
价格、获取方式与 200K 边界
当前价格页列出输入 1、输出 5 美元每百万 token。5 分钟缓存写入为 1.25 美元,1 小时写入为 2 美元,缓存命中为 0.10 美元。Batch API 将输入和输出打五折,但异步批处理成本不能代表交互延迟。区域和市场平台也可能有自己的加价和计费单位。
| 渠道 | Anthropic 文档说明 | 仍需检查 |
|---|---|---|
| Claude API | 固定 ID、别名、token 价格和手动思考 | 组织限额、缓存、速率和状态。 |
| Claude 产品 / Code | 发布时已进入 Anthropic 产品和 Code | 方案、实时选择器、额度、工具和地区。 |
| Bedrock / Vertex / Foundry | 列出提供商 ID 和可用渠道 | 地区、端点、配额、数据条款和账单。 |
| Tabbit Browser | 独立的浏览器客户端 | 实时模型、有效上下文、工具权限和账号。 |
200K 不是脚注。90 页文档、很长的浏览器会话或代码库加工具历史可能在模型得出结论前耗尽上下文。此时应分块并保留引用、压缩稳定上下文,或升级到 Claude Sonnet 4.6、Claude Sonnet 5或更大模型。不要把 API 单价当成 Claude 订阅或 Tabbit 价格。
独立测试说明了什么
DataLLM Lab 在 2026 年 7 月 29 日用九个独立 Python 函数测试,Haiku 4.5 得到 9/9,平均 3.7 秒,每千任务测得 0.94 美元,与 Sonnet 5 和 Opus 4.8 在该测试中持平。作者明确说这不覆盖长上下文重构、智能体循环或模糊规格,所以它只能支持有边界的函数任务。
ORCFLO 在 2026 年 5 月 10 日的 32 模型批次中测试分析、写作、抽取、摘要和行为可靠性,由四名独立评审打分。Haiku 4.5 质量排名 20/32,成本 13/32,响应时间 11/32。这支持“吞吐组合有价值”,不支持“所有任务质量领先”。一项 2026 年代码审查研究使用 150 个样本,也只能代表其数据、评审和任务设计,不能替代 Tabbit 测试或人工复核。
社区反馈同样指向边界。ClaudeAI 讨论中有人认为工具调用更快,但复杂计划较弱;文档解析讨论中有人认为结构化抽取优于更大模型;另有用户描述无人值守编译流程删除目录。它们是工作负载信号,不是受控统计。
按场景制定升级规则
| 工作负载 | 先用 | 何时升级 | 验收 |
|---|---|---|---|
| 分类、抽取、短摘要 | Haiku 4.5 | 需要跨文档深度对齐 | schema 和抽样来源一致。 |
| 小型编码、lint 修复 | Haiku 4.5 + 测试 | 多文件计划或测试连续失败 | diff、测试、复核和回滚。 |
| 长 PDF、研究合成 | 分块 Haiku 4.5 | 接近 200K 或引用漂移 | 页覆盖、引用和人工抽查。 |
| 复杂智能体计划 | 对比 Sonnet / Opus | 计划丢失或工具重复 | 步骤、停止条件和日志。 |
| 高吞吐交互界面 | Haiku 4.5 | 错误代价高于 token 节省 | p95、修正率和接受结果。 |
Reddit 的Claude Code 成本讨论给出了一种合理路由:日常任务先用 Haiku,变难后切到 Sonnet。这是个人策略,不是订阅额度与 API 价格的换算。
Tabbit Browser 的实践边界
当任务从网页、标签组、截图或本地文件开始时,Tabbit Browser可以提供独立的浏览器工作流。它不会增加 Anthropic 的 200K 上下文、改变退休日期或授予 Claude API 额度。本文没有登录 Haiku 4.5 实测,因此不声称选择器、有效上下文、延迟或工具行为。
如果实时选择器显示 Haiku 4.5,请从公开、可回滚的页面任务开始,记录模型名称、来源 URL、工具权限和停止行为,用已知答案的抽取任务比较结果,再测试一次应当升级的任务。AI 浏览器指南、浏览器自动化指南和智能体浏览器说明解释了客户端边界,但不会证明你的账号可用。
未知风险与结论
200K 是上限,工具、历史和输出会进一步压缩可用空间。
手动 thinking budget 会改变延迟、token 和缓存效率,应单独记录。
API、Bedrock、Vertex、Foundry、Claude Code 和浏览器可能有不同 ID、限制和退休时间。
社区既有快速成功,也有破坏性错误;写操作需要测试、权限边界和人工确认。
当前状态是 Active(latest),但“不早于 2026-10-15”不是无限期承诺。
Claude Haiku 4.5 适合作为短任务、重复任务和高吞吐工作中的效率优先默认值。它的价值不是“小模型取代一切”,而是很多任务并不需要 1M 上下文和更贵的档位。先固定输入、输出和验收标准,任务需要深度计划、更长上下文或复杂审查时再升级。固定模型 ID、保留回滚路径,并把 Tabbit 可用性视为独立的实时账号问题。
来源与 FAQ
主要来源是 Anthropic 的发布公告、模型页、迁移指南、价格页和生命周期页。独立来源包括 DataLLM Lab、ORCFLO和代码审查研究。社区链接随论点给出。
Claude Haiku 4.5 还可用吗?
Anthropic 模型页将它列为 Active(latest),退休不早于 2026 年 10 月 15 日。具体提供商、账号和产品仍需实时确认。
200K 足够处理大文档吗?
有边界的文档可能足够,但工具、历史和输出也会占用上下文。接近上限时使用分块、引用和人工抽查。
Haiku 4.5 支持 extended thinking 吗?
支持手动 extended thinking,需要设置 budget_tokens;它没有新 Claude 档位的 adaptive/default-effort 控制。应分别比较开启和关闭的结果。
Haiku 4.5 比 Sonnet 便宜吗?
API 标价为输入/输出 1/5 美元每百万 token,Sonnet 5 为 2/10,Sonnet 4.6 为 3/15。缓存、批处理、重试、输出长度和产品渠道会改变实际成本。
Haiku 4.5 能替代 Opus 编程吗?
它能处理有边界的编码和常规修复,窄任务基准也可能持平。复杂计划、广泛审查和模糊需求应通过固定回归样本决定,而不是一概替代。
Tabbit Browser 能用 Haiku 4.5 吗?
本文没有验证登录后的 Tabbit 账号。请检查实时模型选择器;这只能证明账号层面的结果,不能证明 Anthropic API 权限或价格。
常见问题
Claude Haiku 4.5 是什么?
Claude Haiku 4.5 是 Anthropic 于 2025 年 10 月 15 日发布的快速、低成本模型。固定 API ID 是 claude-haiku-4-5-20251001,便捷别名是 claude-haiku-4-5。它适合交互式和高吞吐任务,但不是所有长流程的默认答案。
Claude Haiku 4.5 的上下文和输出上限是多少?
当前 Claude Platform 页面列出 200,000 token 上下文和 64,000 token 最大输出。它们是模型上限;客户端、提供商或浏览器在扣除工具、历史和安全控制后可能暴露更少。
Claude Haiku 4.5 多少钱?
Anthropic 列出的价格是每百万输入 token 1 美元、输出 5 美元。5 分钟缓存写入为 1.25 美元,1 小时写入为 2 美元,缓存读取为 0.10 美元,Batch API 的输入和输出有五折优惠。订阅和提供商账单另算。
Claude Haiku 4.5 适合编程吗?
它适合有边界的编码、读代码、修 lint 和高吞吐智能体步骤。公开结果依赖任务:一个九函数 Python 测试得到 9/9,但社区也记录了复杂或无人值守计划中的错误。应配合测试和升级规则。
在哪里可以使用 Claude Haiku 4.5?
Anthropic 列出了 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 和 Claude Platform on AWS。Claude 产品也提供该模型,但账号、地区、额度、工具和实时选择器可能与 API 不同。
可以在 Tabbit Browser 使用 Claude Haiku 4.5 吗?
本文没有登录 Tabbit 实测,因此不声称选择器可见、有效上下文或延迟。请检查实时选择器并运行一个小型可回滚任务;Tabbit 的可用性和价格不是 Anthropic API 权益。