Haiku 5.5发布,Anthropic开始撒钱

Haiku 5.5发布,Anthropic开始撒钱
2026年10月08日 08:06 字母榜

前几天Claude刚增加了简体中文界面,这会儿国庆假期刚过,Anthropic又把Haiku 5.5拿出来了。

这是Haiku系列今年第一次更新,也是继9月22日Opus 5.5、9月28日Sonnet 5.5后,Anthropic在大约半个月里补齐的第三款5.5模型。

这次更新,Haiku 5.5把短上下文调用的价格一口气砍了90%。

在10万Token以内,每百万Token输入只要0.1美元,输出0.5美元,缓存读取甚至只要0.01美元。上一代Haiku 4.5对应的价格还是1美元、5美元和0.1美元。

Anthropic自己算下来,大多数典型工作负载的实际成本大约降了75%。

可以说,在OpenAI把Luna卖到一毛钱之后,Anthropic只用了15天,就把Haiku的输入从1美元压到了一毛钱,直接贴着GPT-6 Luna打。

而且Anthropic今天砍价的还不止Haiku。

几乎同时,它又宣布把Sonnet 5.5的缓存读取价格直接减半,从每百万Token 0.2美元降到0.1美元。

这个数字,同样正好追平GPT-6.1 Sol。

这还没完。从本周开始,Claude Max和Team用户每个月都会得到一笔Claude Platform额度:Max 5x是100美元,Max 20x是200美元,Team则根据席位计算,最多可以共享500美元。

换句话说,至少按照API额度的面值来看,Anthropic几乎把Max用户每个月交给它的订阅费,又原样返了一份回来。

上市在即,Anthropic现在简直是演都不演了。

01

跑腿担当Haiku 5.5

上一代Haiku 4.5推出还是去年10月,这次的Haiku 5.5可是时隔一年的“大更新”,非常有看头。

首先是基础规格。Haiku 4.5只有20万Token上下文,到Haiku 5.5直接拉到了100万Token;最大输出也从6.4万Token翻倍到12.8万Token。

它还第一次加入了Adaptive Thinking和可调节的effort——简单来说,以前Haiku更像一台只管快速给答案的小模型,而现在,遇到稍微复杂一点的问题,也可以自己决定要不要动动脑子。

同时新增的还有Browser Use,让模型直接操作网页;安全机制也换上了新的分类器拒答机制。

便宜快速依然是Haiku最重要的卖点。

按照Anthropic的说法,Haiku 5.5是目前Claude家族里标准模式下速度最快的模型,适合那些需要低延迟、大量调用的任务。比如实时聊天、客服、语音助手、信息提取、文件整理,以及越来越常见的浏览器和电脑操作。

官方列出的典型场景里,最值得关注的就是把它作为Opus和Sonnet下面的Subagent——之前只是简单一提,到5.5这一代,Subagent已经被Anthropic明确放进了Haiku的核心用途里。

可以认为,Haiku正在变成Claude家族里专门负责“跑腿”的那个。

比如你让AI做一份报表,负责整体结构和判断的可能还是Opus或者Sonnet,但查一份财报里的具体数字、整理一批资料、点几下网页、分类一堆信息,这些小任务完全可以交给Haiku。

这个定位和OpenAI刚发布的GPT-6 Luna非常像,同样主打高频、大规模、成本敏感的任务,上下文也同样是约100万Token,最大输出12.8万Token。

关键是,这两款模型的价格也被拉到了几乎相同的位置。

Haiku 5.5在10万Token以内,每百万Token输入0.1美元、输出0.5美元、缓存读取0.01美元;Luna也是0.1美元、0.5美元和0.01美元。

不过,Haiku 5.5一旦Prompt超过10万Token,整档价格会直接涨到短上下文的5倍:输入变成0.5美元、输出2.5美元、缓存读取0.05美元。

Luna那边也不是一成不变,但变得比Haiku温和一点。OpenAI规定,Prompt超过27.2万输入Token后,整次请求都会按长上下文价格计费:输入和缓存价格翻倍,输出涨到1.5倍,也就是0.2美元输入、0.75美元输出、0.02美元缓存读取。

说完了价格,该看看性能了。

至少从Anthropic公布的测试来看,Haiku 5.5在不少Agent相关任务上压了Luna一头,甚至超了不少。

比如在电脑操作测试OSWorld 2.1上,Haiku 5.5拿到72.4%,GPT-6 Luna只有48.9%;Agent Coding测试Terminal-Bench 4.0里,Haiku是39.2%,Luna只有16.4%;FrontierCode 1.1上,两者分别是46.4%和42.4%。

知识工作也类似。在GDPval-AA v2.1里,Haiku 5.5拿到1620分,Luna是1437分;AA-Briefcase v1.1则是1578分对1336分。

另外,在第三方评测平台Artificial Analysis的Intelligence Index上,Haiku 5.5最高档拿到43分,而GPT-6 Luna最高档是38分。

不过Luna也不是全面落后。在Artificial Analysis自己的电脑/网页自动化评测AutomationBench-AA上,Luna反而以53.2%明显超过Haiku的35.4%。

现在Haiku 5.5已经进入Claude的Free、Pro、Max、Team和Enterprise套餐,Web、iOS和Android都能用;开发者也可以通过Claude API、Claude Code,以及AWS、Google Cloud和Microsoft Foundry调用。

顺便一提,虽然Anthropic在发布公告里直接把Haiku 5.5称为目前最快的Claude模型,但在脚注里又很老实地补了一句:这是指各模型都跑在标准速度下的情况。如果打开快速模式,Haiku 5.5还是跑不过Opus。

拿最便宜的“跑腿模型”和最贵的加速档比,多少有点不讲武德。

02

统统大降价

然而,和另外两个“撒币”行为相比,Haiku 5.5简直就像开胃小菜。

Anthropic同时正式下调了Sonnet 5.5的缓存读取价格,从每百万Token 0.2美元降到0.1美元,目前没有注明任何限时条件。Haiku 5.5公告里的最新价目表已经把Sonnet 5.5的价格改了。

这看起来只是价目表里一个不起眼的小数字,但对Agent来说,影响可能比想象中大得多。

Anthropic自己估算,因为Agent在长时间运行时会反复读取系统提示词、工具定义和历史上下文,缓存读取往往会消耗很大一部分Token,所以这一刀下去,大多数Agent任务跑Sonnet 5.5的总体成本还能再降大约20%。

在这条降价消息下面,开发者几乎是一片叫好。

可以说,Anthropic直接从两头一起给Agent压价:一边把跑腿的成本压下去,另一边把主Agent长期工作的成本也压下去了。

更离谱的还在后面:

从这周开始,Claude Max和Team套餐会额外附赠一笔Claude Platform API额度:Max 5x每月100美元,Max 20x每月200美元;Team则按照席位计算,所有额度汇总到一起,每月最多500美元。

也就是说,从API标价来看,一个Max 20x用户每个月交200美元订阅费,Anthropic现在又额外给他发200美元API额度。

而且这笔钱和原本Claude、Claude Code、Cowork里的订阅用量是分开的,不会占掉原来的额度。虽然没用完会过期,但每个计费周期都会重新发。

更重要的是,官方表示这些额度可以用于Claude API、Batch API、Claude Console Playground、Claude Managed Agents和Claude Agent SDK,而且任何当前可用的Claude模型都能花。

这意味着,只要第三方Harness最终调用的是你这个Claude Console组织里的API Key,同样可以消耗这笔余额。

你可以自己写一个Agent,可以用Agent SDK,可以让别人的Harness调用Claude。只要最后用的是Anthropic的Token,它甚至愿意先替你出一部分钱。

(账号仍然完好的)Max用户简直要笑疯了好吗?

不过,这也不是完全没有限制。

API额度不能拿来抵Claude Code里的交互式使用,也不能抵Claude、Claude Code和Cowork超额之后的Extra Usage;Bedrock、Google Cloud Vertex AI和Microsoft Foundry里的Claude调用也不算,新Max或Team用户还要先订阅满7天才能领取。

但这些限制并不影响它的方向,Anthropic几乎要把“快来订阅”顶在脑门上。

说来有趣,就在前几天,Claude社区里还有人在认真讨论:Anthropic需要一款更便宜的模型。

有人专门拿Haiku 4.5和刚发布的GPT-6 Luna算了一遍账。前者每百万Token输入1美元、输出5美元,后者只有0.1美元和0.5美元,整整差了十倍。在Agent会大量调用worker模型的情况下,这个差距足以直接决定开发者的选择。

有人甚至直接说,虽然他们公司喜欢Claude,但真正干活的主力模型还是Luna,原因就是API账单差太多。

结果,社区前脚还在说Claude太贵,Anthropic后脚就像把评论区打印出来了一样,直接开始大降价。

把今天这三件事放在一起看,Haiku负责让Subagent便宜,Sonnet负责让长时间运行的Agent便宜,API Credit则直接给Max和Team订阅再塞一笔开发预算。

为了推动Claude进入更多Agent和Harness、再冲一下销量,Anthropic也开始搞“百亿补贴”了。

03

上市前,再冲一把

这一连串的动作,很难不和Anthropic即将上市的消息联系在一起。简直就像商场开业前先发点优惠券来吸吸流量——如果它还需要更多流量的话。

路透社在Haiku 5.5发布之后直接把这次更新放在了IPO语境里:Anthropic正在为计划中的上市继续扩充Claude产品线。Haiku 5.5也是Claude 5.5家族在一个月内补齐的第三款模型。

此前报道显示,Anthropic原本最早计划在10月中旬启动IPO营销,但最新安排可能推迟到11月美国中期选举之后。如果计划不再继续后移,Anthropic最快也就是接下来这一两个月正式冲刺上市。

而且Anthropic现在其实很需要在上市前继续证明自己的增长。

路透社此前披露,Anthropic的年化收入已经从2025年底大约90亿美元,一路冲到今年7月底超过650亿美元;公司内部还预计,2028年收入可能达到1900亿至2000亿美元。

这意味着,它现在最需要证明的,不只是Claude够不够强,还有Claude能不能继续卖得更多。

尤其是,OpenAI还在持续施压。

路透社此前援引Ramp数据称,GPT-6 Astra已经拿到其追踪企业AI支出的约13%,Claude Fable约为8%;OpenRouter上,OpenAI模型的用户支出也一度超过Anthropic,这是两年半以来第一次。消息人士称,这已经让一些潜在IPO投资者重新评估Anthropic此前在企业AI市场的领先位置。

现在看来,这篇报道标题中提到的“新模型”,应该指的就是5.5这一套组合。

某种意义上,Anthropic这次几刀,几乎都是冲OpenAI去的——OpenAI把价格往下打到哪里,Anthropic就跟到哪里。

Haiku 5.5把短上下文输入价格从1美元直接压到0.1美元,正好和GPT-6 Luna同价;Sonnet 5.5的缓存读取从0.2美元砍到0.1美元,又正好追平GPT-6.1 Sol。

说到底,上市前最怕的就是增长不好看。

如果模型价格更低,可以换来更多API调用;如果Max订阅更划算,可以换来更多付费用户;如果开发者更愿意把Claude塞进自己的Agent和Harness里,也就意味着未来可能有更多稳定的Token消费。

今天这些降价和补贴花出去的钱,可以先算成获客成本。只要它能在上市前把用户、收入和调用量再往上冲一冲,这笔账就不难解释。(作者:袁心玥)

财经自媒体联盟更多自媒体作者

新浪首页 语音播报 相关新闻 返回顶部