刚刚,Claude Haiku 5.5发布!价格暴降90%
2026-10-08 · svagl.com

就在刚刚,Anthropic 发布了 Claude Haiku 5.5,单价只有上一代 Haiku 4.5 的 1/10、Sonnet 5.5 的 1/20,和 OpenAI 的 GPT-6 Luna 一个价。 官方跑分表里 Luna 交了成绩的六项全输给了它,好几项还咬住了 Sonnet。 操作电脑的 OSWorld 从上一代的 15.7% 冲到 72.4
就在刚刚,Anthropic 发布了 Claude Haiku 5.5,单价只有上一代 Haiku 4.5 的 1/10、Sonnet 5.5 的 1/20,和 OpenAI 的 GPT-6 Luna 一个价。
官方跑分表里 Luna 交了成绩的六项全输给了它,好几项还咬住了 Sonnet。
操作电脑的 OSWorld 从上一代的 15.7% 冲到 72.4%,离 Sonnet 5.5 只差 11.5 个百分点
终端编程的 Terminal-Bench 4.0,上一代是零分,这次拿了 39.2%
知识工作的 GDPval-AA 拿下 1620 分,是上一代的两倍多
「人类最后的考试」HLE 不带工具,从 10.2% 涨到 45.9%
价格是每百万 Token 输入 0.10 美元、输出 0.50 美元,这是提示在 10 万 Token 以内的价格,超过 10 万按输入 0.50 美元、输出 2.50 美元算。
缓存读取每百万 Token 0.01 美元,走批处理再打五折。
官方测算下来,同样的活平均比 Haiku 4.5 省 75% 左右,同样的预算大约能跑四倍的调用量。
没省到九成,是因为超过 10 万 Token 的请求只便宜一半,好在上一代 Haiku 约九成请求都在 10 万以内,另外新分词器会让同样一段话多出三成左右的 Token。
和 GPT-6 Luna 比,10 万 Token 以内两家的输入、输出、缓存价格完全一样。
面对长上下文时 Luna 更便宜,它要到 27 万 Token 左右才涨价,涨完也才输入 0.20 美元、输出 0.75 美元。
Sonnet 5.5 的缓存读取也从今天起砍半,每百万 Token 从 0.20 美元降到 0.10 美元,官方算下来多数 Agent 任务能便宜两成左右。
Max 和 Team 订阅本周起每月送 API 额度,Max 5x 送 100 美元、Max 20x 送 200 美元,Team 最多 500 美元、全队共用,在 Claude Platform 上哪个模型都能用。
跑分压过 Luna 但复杂编程还差 Sonnet 一截
这一代 Haiku 相比上一代,跑分进步巨大。
操作电脑的 OSWorld 从上一代的 15.7% 冲到 72.4%,离 Sonnet 5.5 只差 11.5 个百分点
终端编程的 Terminal-Bench 4.0,上一代一分没拿到,这次拿了 39.2%
知识工作的 GDPval-AA 拿下 1620 分,是上一代的两倍多
「人类最后的考试」HLE 不带工具,从 10.2% 涨到 45.9%
电脑操作是这次进步最猛的一项,OSWorld 上同价的 Luna 只有 48.9%,Haiku 5.5 甩开它 23.5 个百分点。
算上成本更夸张,它开到 Medium 档就超过了 Luna 满档的成绩,花的钱还更少。
知识工作的 GDPval-AA 上,Haiku 5.5 的 1620 分压过了 Luna 的 1437 分,离 Sonnet 5.5 的 1840 分还差一截,只开默认的 Medium 档也有 1277 分。
跑长线项目的 AA-Briefcase 上,它从上一代的 614 分涨到 1578 分,Luna 是 1336 分。
推理和读图上,HLE 带上搜索和代码工具时 Haiku 5.5 是 57.4%,Sonnet 5.5 是 64.5%。读专业图表的 Chartography,它从上一代的 6.4% 涨到 46.4%,Luna 是 29.1%,Sonnet 5.5 是 61.6%。
和 Sonnet 差距最大的是编程,Terminal-Bench 4.0 上它的 39.2% 是 Luna(16.4%)的两倍多,但 Sonnet 5.5 是 70.6%。
FrontierCode 上它的 46.4% 也赢了 Luna 的 42.4%,离 Sonnet 5.5 最好成绩的 52.1% 还差将近 6 个点。
官方也明说,复杂的 Agent 编程还是交给 Sonnet 5.5 和 Opus 5.5。
官方给 Haiku 5.5 的定位是量大、要快、要省钱的活,比如写摘要、压缩上下文、查数据库、做分类。
它也是目前最快的 Claude 模型,只比开了快速模式 (价格很贵!) 的 Opus 慢,适合实时客服和浏览器操作。
官方也给出了一批明星 AI 应用公司内测反馈。
Asana 测下来,任务完成的延迟比他们现用的模型降了三成多,Box 测得它的延迟只有 Haiku 4.5 的一半左右。
另一个主要用法是给 Opus 或 Sonnet 当子Agent,大模型拆任务、拿主意,Haiku 分头去跑。
Cognition 的 Devin Fusion 让 Opus 5.5 当主力、Haiku 5.5 当副手,FrontierCode 稳在 66.2 分的顶级水平,成本和延迟都降了下来。
金融 AI 公司 Rogo 让大模型做 PPT,Haiku 5.5 钻进 10-K 财报扒分部营收数据。
Claude 开发者账号给出了 Demo,任务是用一堆家用杂物设计装鸡蛋的架子,目标是从 32 米扔下不碎。
Opus 5.5 单干用了 3 分 37 秒、试了 25 种方案、花了 0.47 美元,带上 10 个 Haiku 5.5 子 Agent 只用了 58 秒、试了 86 种、花了 0.14 美元。
Haiku 5.5 已经在 Claude 客户端、Claude Code 和 AWS、谷歌云、微软 Azure、Cursor、OpenRouter 等平台上线,模型 ID 是 claude-haiku-5-5,上下文 100 万 Token,单次最多输出 12.8 万 Token。
它是第一个能调思考档位的 Haiku,从 Low 到 Max 一共五档,API 默认是 Medium。
Python 和 TypeScript SDK 也加上了电脑操作和浏览器操作,目前是 Beta。
从 Haiku 4.5 迁移过来,同样的文字 Token 会多三成左右,max_tokens 和成本预估得重算。
budget_tokens 换成了自适应思考加 Effort 档位,temperature、top_p、top_k 要删掉,预填回复不能用了,格式要求改用结构化输出。
电脑操作要换成新工具集 computer_toolset_20260801,Priority Tier 暂不支持。
嫌麻烦可以在 Claude Code 里跑一句:
当然,对于非开发者而言,你现在就可以直接在客户端里与 Haiku 5.5 对话了!
简单的问题就不要麻烦 Fable、Opus、Sonnet 了,Haiku 5.5 即使只是开 Low 档推理强度,也可以做到准确地秒出答案,完美替代搜索引擎了。