模型发布与规格特性
2026年10月7日,Anthropic 正式发布了 Claude 5.5 家族的小型模型 Claude Haiku 5.5。目前,该模型已在 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 以及 GitHub Copilot 等平台同步提供。
Anthropic 官方将 Haiku 5.5 定位为专为高容量、成本敏感型任务设计的模型,具备 100 万 token 的上下文窗口以及 128k 的最大输出限制。此外,该模型是首个支持“effort”参数(自适应思考/推理深度控制)的 Haiku 模型,且该功能默认开启。
阶梯定价机制与缓存优惠
在定价机制方面,Claude Haiku 5.5 采用了基于提示词长度的阶梯定价模式,分界线设定为 100,000 tokens。对于 10 万 tokens 以内的请求,输入价格为每百万 token 0.10 美元,输出价格为 0.50 美元,缓存读取价格为每百万 token 0.01 美元;超过 10 万 tokens 的请求,输入价格则调整为每百万 token 0.50 美元,输出价格为 2.50 美元,缓存读取价格为每百万 token 0.05 美元。
同日,Anthropic 宣布将 Claude Sonnet 5.5 的提示缓存读取价格下调 50%,从每百万 token 0.20 美元降至 0.10 美元,其缓存写入价格保持不变。官方表示,由于缓存读取在 token 消耗中占比较大,此次降价将使大多数代理任务的整体运行成本降低约 20%。
与此同时,Anthropic 为 Claude Max 和 Team 订阅计划引入了每月的 API 额度。据 Unite.AI 报道,新增额度具体为 Max 5x 计划每月 100 美元,Max 20x 计划每月 200 美元,Team 计划为跨用户共享的最高 500 美元。
成本对比、分词器影响与安全评测
官方声明称,在 10 万 tokens 以内的请求中,Haiku 5.5 的价格比上一代 Haiku 4.5 低 90%,超过 10 万 tokens 的请求价格低 50%,官方估计其平均运行成本比 Haiku 4.5 低约 75%。多家媒体和独立分析指出,Haiku 5.5 在 10 万 tokens 以内的定价完全对标了 OpenAI 的 GPT-6 Luna。
不过,独立分析师测试发现,Haiku 5.5 采用了新的分词器,导致相同文本比 Haiku 4.5 多计算约 25% 到 30% 的 token。分析指出,当提示词超过 10 万 tokens 时价格飙升 5 倍,在长上下文任务中被认为不如竞品 GPT-6 Luna 具备性价比;新分词器带来的 token 消耗增加在一定程度上抵消了字面降幅,实际业务中的具体成本节约仍需开发者根据工作流进行独立测试。
在安全性表现上,官方系统卡显示,Haiku 5.5 在网络安全评估中显著优于 Haiku 4.5,但仍不及 Opus 5.5 和 Opus 5;同时其触发网络安全护栏的频率低于近期发布的其他模型。

