IPO前Anthropic推出小模型“性价比之王”,Claude Haiku 5.5运行成本降75%

Anthropic称,Haiku 5.5是该司迄今发布的最便宜、最快且能力最强小模型,瞄准高吞吐量、成本敏感型应用,编程、电脑操作等任务能力较前代4.5明显提升;首次纳入可调节的effort推理强度;对提示词不超过10万Token的请求,API价格较上一代低90%,超过这一门槛,价格低50%;可与一个月内发布的前两款Claude 5.5系列模型Opus 5.5、Sonnet 5.5配合使用,作为后两者的“子智能体”。更新中

最近传出冲刺感恩节前上市的Anthropic继续在IPO前加速扩充产品线。

美东时间10月7日周三,Anthropic宣布推出该司“迄今为止发布的最便宜、最快且能力最强小模型”Claude Haiku 5.5,完成Claude 5.5系列模型的最后一块拼图,将重点放在高频、低成本和大规模AI应用。

Anthropic称,新模型平均运行成本较前代Haiku 4.5下降约75%,同时,在执行编程、计算机操作和知识工作等任务的能力方面,较前代明显提升。

这是Anthropic在过去一个月内推出的第三款Claude 5.5模型。筹备IPO之际,Anthropic于9月22日发布旗舰模型Opus 5.5,9月28日推出Sonnet 5.5,如今Haiku 5.5也正式上线。三款模型分别覆盖复杂智能体任务、日常知识工作以及高频低成本任务,形成从高端到大规模应用的完整产品梯队。

同在本周三,Anthropic还宣布将Sonnet 5.5的缓存读取价格下调50%,每百万Token定价从0.20美元降至0.10美元,公司称这将使Sonnet 5.5在大多数智能体任务中的运行成本再下降约20%。

瞄准海量短任务,小模型首次加入“推理档位”

与面向最复杂任务的Opus 5.5不同,Anthropic对Haiku 5.5的定位非常明确:高吞吐量、成本敏感型应用。

Anthropic称,Haiku 5.5能够稳定处理摘要、上下文压缩、数据库查询和分类等重复性任务,同时可以作为Opus 5.5和Sonnet 5.5的“子智能体”,承担复杂编程任务中的部分工作。

由于速度更快,Haiku 5.5也适用于实时客户支持和浏览器操作。Anthropic称,这是其迄今速度最快的模型之一,在标准速度下,Haiku 5.5的运行速度超过此前所有Haiku模型。

更值得注意的是,Haiku 5.5首次加入了可调节的effort推理强度。用户可以根据任务需要,在成本和智能水平之间进行选择:简单任务采用较低推理强度,以速度和价格为优先;复杂任务则可以提高推理强度,以换取更高的准确率和更强的推理能力。

这实际上让Haiku从一个单纯的“便宜小模型”,变成了一个可以根据不同工作负载动态调整成本的模型。

九成请求瞄准的10万Token门槛

Haiku 5.5此次最具冲击力的变化,是价格的大幅下探。

Anthropic表示,Haiku 5.5平均运行成本较Haiku 4.5下降约75%。其中,对于提示词不超过10万Token的请求,Haiku 5.5的API价格较上一代低90%;超过10万Token的请求,价格则下降50%。

而10万Token恰好覆盖了绝大多数Haiku的使用场景。Anthropic称,上一代Haiku 4.5约90%的请求都属于10万Token以内的任务。

目前,Haiku 5.5对于10万Token以内的请求,每百万Token的输入价格为0.10美元、输出价格为0.50美元;超过10万Token的请求,输入和输出价格分别为0.50美元和2.50美元。缓存读取价格则为每百万Token 0.01美元和0.05美元。

这意味着,Anthropic此次并非针对少数极端长上下文任务降价,而是直接压低了数量最多的一批AI调用的成本。

媒体指出,这一价格水平已经将Haiku 5.5推向与OpenAI GPT-6 Luna等低成本、高速度模型直接竞争的位置。AI模型的价格战正在从旗舰模型进一步向轻量级模型蔓延。

对于企业客户而言,这一变化尤其重要。大量实际AI工作并不需要最强模型:客服问答、文本分类、摘要、数据库查询、数据整理,以及大型智能体拆解出来的子任务,都可以交给更轻量的模型。

因此,在企业大规模部署AI的情况下,每次任务到底花多少钱,可能比模型在单项基准测试中多拿几分更重要。

“便宜模型”开始成为智能体的基础设施

Anthropic此次尤其强调Haiku 5.5可以与Opus 5.5、Sonnet 5.5配合使用,作为后两者的“子智能体”。

这意味着AI应用正在出现一种更加明显的分工模式:一个复杂任务可以由Opus或Sonnet负责总体规划,再把大量简单、重复的子任务交给Haiku执行。

例如,在一项复杂的软件开发工作中,高端模型可以负责理解需求、设计方案和处理关键代码,而Haiku则可以承担代码摘要、文件分类、数据库查询以及其他重复性工作。

这种架构的关键并不是让每一个模型都做到最强,而是让不同任务匹配不同成本的模型。

Anthropic此次将Haiku 5.5的价格压到更低水平,同时加入可调节的推理强度,本质上也是在争夺这类高频调用场景。

随着AI智能体从“回答问题”逐渐转向持续运行数小时甚至更长时间的工作流,模型的调用量可能远远超过传统聊天机器人。如果其中大量子任务能够由低成本模型完成,企业整体AI支出就有可能明显下降。

Sonnet 5.5缓存读取价格再砍半

除了发布Haiku 5.5,Anthropic还同步下调Sonnet 5.5的缓存读取价格。

公司宣布,从10月7日起,Sonnet 5.5的缓存读取价格从每百万Token 0.20美元降至0.10美元,直接下降50%。Anthropic称,由于缓存读取在长时间运行的智能体任务中占据较大比重,这一调整可以让Sonnet 5.5在大多数智能体任务中的运行成本下降约20%。

这也是Anthropic此前“降低模型实际使用成本”策略的延续。

9月底发布Sonnet 5.5时,公司并没有调整其每百万输入Token 2美元、输出Token 10美元的基础价格,而是通过减少完成同一任务所需的Token数量以及提高输出速度,使单任务成本最高下降30%。

此次再下调缓存读取价格,则进一步降低了长时间运行智能体的成本。

换言之,Anthropic此次不仅推出一个更便宜的Haiku,还同时压低了Sonnet在长期工作流中的使用成本,显示公司正在系统性地向更低的单位任务成本推进。

Claude 5.5家族正式补齐

Haiku 5.5目前已经全面上线,包括Anthropic的Claude平台和Claude Code,并登陆亚马逊云科技(AWS)、谷歌云(Google Cloud)和微软Azure。

至此,Claude 5.5家族正式形成三级产品结构:

  • Opus 5.5:面向最复杂的编程、智能体和专业知识工作;
  • Sonnet 5.5:面向日常编程、办公生产力和知识工作;
  • Haiku 5.5:面向高频、大规模、成本敏感型任务。

这也是Anthropic一个月内连续发布三款模型的重要意义——公司不再只是推出单个“旗舰模型”,而是在建立一套覆盖不同性能和成本档位的AI模型体系。

对于正筹备IPO的Anthropic而言,这种产品矩阵也有着更直接的商业意义。此前彭博报道称,Anthropic目标是在11月感恩节前上市,最早可能于11月9日当周启动IPO路演。

在AI行业从“谁的模型最强”逐渐转向“谁能以更低成本完成更多工作”的背景下,Anthropic此次将Haiku 5.5的平均运行成本压低约75%,并同步下调Sonnet 5.5的缓存价格,释放出的信号十分明确:

AI模型的下一轮竞争,不仅是能力之争,也是成本之争;而随着智能体进入大规模商业化阶段,每美元能够完成多少有效工作,可能越来越成为衡量模型商业价值的关键指标。

相关文章