Haiku 5.5 对比 Haiku 4.5:有哪些变化,值得升级吗?
Claude Haiku 5.5 与 Claude Haiku 4.5 全面对比:上下文窗口、输出上限、思考方式、强度档位、工具与价格,以及开发者迁移时需要注意的破坏性变更。

Claude Haiku 5.5 接替 Claude Haiku 4.5,成为 Anthropic 新一代"快速、低成本"模型。下面分别从使用者和开发者的角度,看看到底变了什么。
参数对比
| Claude Haiku 5.5 | Claude Haiku 4.5 | |
|---|---|---|
| 上下文窗口 | 100 万 token | 20 万 token |
| 最大输出 | 12.8 万 token | 6.4 万 token |
| 思考方式 | 自适应思考,默认开启 | 手动设置思考预算 |
| 思考强度档位 | low · medium · high · xhigh · max | 不支持 |
| 浏览器操作工具 | 支持 | 不支持 |
| 每百万 token 输入 / 输出价格 | $0.10 / $0.50(提示词 ≤ 10 万 token) | $1 / $5 |
主要升级
上下文扩大 5 倍。 100 万 token 意味着整份文档、整个代码库可以一次放进请求里,不必再切块。
输出翻倍。 最多 12.8 万 token 输出,长稿、报告、代码一次写完。
思考深度可调。 Haiku 5.5 会自己决定想多少,effort 参数控制思考深度:要聊天速度就用 low,要准确就用 high。在 Haiku55 的对话框里,对应快速、智能、深度三种模式。
价格大幅下降。 提示词不超过 10 万 token 时,输入和输出价格都只有 Haiku 4.5 的十分之一。但要注意新分词器:同样的文本大约多出 30% 的 token。
更擅长 Agent 任务。 Anthropic 表示,Haiku 5.5 在指令遵循和作为子 Agent 运行方面明显更强。
开发者需要注意的破坏性变更
如果你要把 API 代码从 claude-haiku-4-5 迁移到 claude-haiku-5-5:
- 不再支持手动思考预算。
thinking: {type: "enabled", budget_tokens: N}会返回 400,改用自适应思考并设置output_config.effort。 - 不再支持自定义采样参数。 非默认的
temperature、top_p、top_k会返回 400,请用提示词或结构化输出来控制。 - 不再支持 assistant 预填充。
messages必须以 user 消息结尾。 - Computer use 改用新的 toolset(Claude API 与 Google Cloud)。
- 对话要"只追加不修改"。 如果修改了之前的对话、系统提示词或工具,回传的思考块会失效。
另外,回复可能以 thinking 块开头(请按类型读取内容块),模型的安全分类器也可能返回 stop_reason: "refusal"。
要不要换?
对绝大多数人来说:要。Haiku 5.5 处理长输入更从容、该思考时会思考,按官方标价成本只有 Haiku 4.5 的一小部分。最直观的方式就是免费和 Haiku 5.5 聊几句。
Haiku55 是独立服务,与 Anthropic 不存在隶属关系。Claude 和 Haiku 是 Anthropic, PBC 的商标。