Claude Haiku 5.5是一款由Anthropic于2026年10月推出的轻量级大模型,主要用于高频调用与智能体任务执行,是 Haiku 系列首个支持 effort 多档调节的版本,可与 Claude Opus 5.5、Claude Sonnet 5.5 组合分工。
| 基础信息 | 内容 |
|---|---|
| 产品定位 | 轻量级大模型 |
| 出品方 | Anthropic |
| 发布时间 | 2026年10月7日 |
| 模型编码 | claude-haiku-5-5 |
| 推理强度 | 支持 effort 多档调节 |
| 输入价格 | 每百万 tokens 0.10 美元 |
| 输出价格 | 每百万 tokens 0.50 美元 |
| 知识工作得分 | GDPval-AA v2.1 1620 |

Claude Haiku 5.5 的核心能力
Claude Haiku 5.5 补齐了 Claude 5.5 家族中最轻的一档,定位是高频调用与批量任务。官方把它归入通用 AI 模型 序列,基准结果由 Anthropic 于 2026 年 10 月公布。
成本结构与定价
Haiku 5.5 每百万 token 的输入价格为 0.10 美元、输出价格为 0.50 美元,缓存读取 0.01 美元、缓存写入 0.125 美元。官方对比表把上一代 Haiku 4.5 的输入与输出列为 1.00 与 5.00 美元,两档均下降约九成,缓存读取由 0.10 美元降到 0.01 美元。单次提示词超过 10 万 token 时按更高一档计价。
可调 effort 设置
Haiku 5.5 是 Haiku 级模型中首个提供 effort 调节的版本,用户可在成本与智能之间取舍。官方给出 OSWorld、GDPval-AA 与 Humanity’s Last Exam 三项基准在各档 effort 下的表现,用于按任务复杂度选择档位。
智能体与计算机操作能力
官方基准显示,OSWorld 2.1 计算机操作得 72.4%,上一代 Haiku 4.5 为 15.7%,OpenAI GPT-6 Luna 为 48.9%。智能体编码 Terminal-Bench 4.0 得 39.2%,Haiku 4.5 为 0.0%。知识工作 GDPval-AA v2.1 得 1620,Haiku 4.5 为 735;AA-Briefcase v1.1 得 1578,Haiku 4.5 为 614。多学科推理 Humanity’s Last Exam 在无工具条件下得 45.9%、含工具为 57.4%;视觉推理 Chartography 得 46.4%,Haiku 4.5 为 6.4%。
与 Claude 5.5 家族的组合分工
Anthropic 把 Haiku 5.5 定位为家族中的轻量档,复杂智能体编码任务仍建议使用 Claude Opus 5.5(1M token 上下文,Terminal-Bench 4.0 得 70.6%)。官方同时下调了 Claude Sonnet 5.5 的缓存读取价格,由每百万 token 0.20 美元降到 0.10 美元。
Claude Haiku 5.5 与同类轻量模型的对比
| 对比维度 | Claude Haiku 5.5 | GPT-6 Luna | DeepSeek V4.1 Flash | Claude Haiku 4.5 |
|---|---|---|---|---|
| 出品方 | Anthropic | OpenAI | DeepSeek | Anthropic |
| 产品定位 | 轻量级大模型 | 高频调用轻量模型 | 多模态低成本主力 | 上代轻量级模型 |
| 缓存读取 | 0.01 美元 | 0.01 美元 | 0.02 元 | 0.10 美元 |
| 输入价格 | 0.10 美元 | 0.10 美元 | 1.0 元 | 1.00 美元 |
| 输出价格 | 0.50 美元 | 0.50 美元 | 4.0 元 | 5.00 美元 |
| 开源情况 | 闭源 | 闭源 | 开放权重 | 闭源 |
| 知识工作 | 1620 | 1437 | 未参加官方对比 | 735 |
| 计算机操作 | 72.4% | 48.9% | 未参加官方对比 | 15.7% |
| 终端编码 | 39.2% | 16.4% | 未参加官方对比 | 0.0% |
上表 Claude Haiku 5.5、GPT-6 Luna 与 Claude Haiku 4.5 三列取自各自官方发布材料,DeepSeek V4.1 Flash 一列取自 DeepSeek 官方定价文件,其中 DeepSeek V4.1 Flash 采用峰谷计价,闲时价格更低。几款模型的差别集中在能力抬升的幅度上:Haiku 5.5 与上一代同门之间,三项智能体基准同时拉开明显差距;与同为高频定位的 GPT-6 Luna 相比,两者的价格档位接近,Haiku 5.5 在计算机操作一类任务上的领先幅度更大。
需要更高编程与智能体能力的场景,可以参考 Claude Sonnet 5.5(Anthropic 推出的通用大模型,上下文 1M token,最大输出 128K token,在 Terminal-Bench 4.0 上得 70.6%)。
Claude Haiku 5.5 的应用场景与适用人群
该模型面向调用量大、对单次成本敏感的任务,常见场景包括:
- 批量内容处理:对评论、工单与文档做分类、摘要与结构化抽取,单条成本低。
- 智能体子任务:在长流程中承担检索、校验与格式转换等步骤,把复杂推理交给更重的模型。
- 计算机操作类任务:按 OSWorld 覆盖的界面操作场景执行点击与填写流程。
- 高并发接口:在成本敏感的产品里承担默认档,按 effort 档位调节质量。
适用人群:需要大规模调用大模型的产品与研发团队、构建多模型分工架构的开发者,以及希望在成本与质量之间灵活取舍的运营团队。
Claude Haiku 5.5 的使用方法
模型通过 Anthropic 官方 API 与 Claude 各客户端提供,按以下顺序接入:
- 获取密钥:在 Claude Haiku 5.5 官方页面 查看能力说明与定价,再从控制台创建 API 密钥。
- 选择模型:调用时指定模型编码
claude-haiku-5-5。 - 设置档位:按任务复杂度选择 effort 档位,批量分类类任务用低档,计算机操作与工具调用类任务用高档。
- 控制单次规模:单次提示词低于 10 万 token 时适用较低一档计价,超长上下文会切到更高档。
- 组合调用:把复杂智能体编码任务交给 Claude Opus 5.5 或 Claude Sonnet 5.5,Haiku 5.5 承担其中高频的轻量步骤。
首次接入建议先用小批量任务核对 effort 档位与成本的关系,再决定默认配置。
Claude Haiku 5.5 的价格与开源情况
Claude Haiku 5.5 每百万 token 的输入价格为 0.10 美元、输出价格为 0.50 美元,缓存读取 0.01 美元、缓存写入 0.125 美元;单次提示词超过 10 万 token 时按 0.50 与 2.50 美元计价。按官方对比表,其输入与输出价格分别为上一代 Haiku 4.5 的十分之一。
模型不开放权重,属于闭源模型,通过 Anthropic API 与 Claude 客户端使用,不支持本地部署。Anthropic 同时在订阅侧增加了额度安排,Max 5x 用户每月可获得 100 美元的 API 额度,Max 20x 用户为 200 美元。
Claude Haiku 5.5 的常见问题
Claude Haiku 5.5 与 Haiku 4.5 的主要区别是什么?
两者都以低成本高频调用为定位。Haiku 5.5 是首个支持 effort 多档调节的 Haiku 级模型,OSWorld 2.1 由 15.7% 提升到 72.4%,Terminal-Bench 4.0 由 0.0% 提升到 39.2%,输入与输出价格分别为上一代的十分之一。
Claude Haiku 5.5 的 effort 设置怎么用?
effort 用于在成本与智能之间取舍。官方给出 OSWorld、GDPval-AA 与 Humanity’s Last Exam 三项基准在各档位下的表现,可按任务类型选择:批量分类用低档,计算机操作与工具调用类任务用高档。
Claude Haiku 5.5 与 Claude Sonnet 5.5、Claude Opus 5.5 怎么配合?
Haiku 5.5 承担高频、轻量的步骤,Sonnet 5.5 与 Opus 5.5 负责复杂智能体编码等任务。官方数据显示,Terminal-Bench 4.0 上 Haiku 5.5 为 39.2%,Sonnet 5.5 为 70.6%。
浙公网安备33010202004812号