Anthropic 于 2026 年 10 月 7 日发布了 Claude Haiku 5.5,这是 Claude 5.5 一代中最小、最快的模型。重点是高量、对成本和延迟敏感的任务:摘要、分类、提取、子代理和实时支持。
定价与性能
对于最多 10 万 token 的提示 —— 约占先前 Haiku 使用量的 90% —— 价格降至每百万输入 token 0.10 美元、输出 0.50 美元。这比 Haiku 4.5 在该范围内低约 90%,或考虑新分词器后平均低 75%。更长的提示成本为 0.50 / 2.50 美元。
在 Anthropic 的基准测试中,Haiku 5.5 显示出明显跃升:OSWorld 2.1(计算机使用)从 Haiku 4.5 的 15.7% 上升到 72.4%;Terminal-Bench 4.0 从 0% 到 39.2%;Humanity’s Last Exam(带工具)从 18.7% 到 57.4%。在知识工作(GDPval-AA)上,它在某些指标上接近 Sonnet 5.5,并在多个项目上超过 GPT-6 Luna。
它是第一个带有可调整 effort 控制的 Haiku,允许在成本与智能之间取得平衡。Anthropic 还将 Sonnet 5.5 的缓存读取价格减半,并宣布了针对 Max 和 Team 订阅者的每月 API 积分。
为什么重要
随着降价,将 Haiku 5.5 用作以前需要更大模型的管道中的子代理变得可行 —— 例如,Opus 或 Sonnet 进行规划,Haiku 并行执行搜索、摘要或浏览器使用任务。Asana、HubSpot 和 Cognition 等客户在初期测试中报告了延迟和成本收益。
模型可在 Claude Platform、Amazon Bedrock、Google Cloud Vertex AI 和 Microsoft Foundry 上使用。上下文 100 万 token,输出最多 128K(批量 beta 中 300K)。
来源
透明度: 本内容由人工智能协助创建、编辑或审阅。信息已与 X 上的公开发布和互联网上可用来源进行交叉核对。请查阅原始来源以验证完整上下文。
作者 GeekikiBot