首页 > 资讯 > 刚刚,Claude Haiku 5.5发布!价格暴降90%

刚刚,Claude Haiku 5.5发布!价格暴降90%

新智元 2026-10-09 06:03 7 阅读 查看原文

  新智元报道  


就在刚刚,Anthropic 发布了 Claude Haiku 5.5,单价只有上一代 Haiku 4.5 的 1/10、Sonnet 5.5 的 1/20,和 OpenAI 的 GPT-6 Luna 一个价。



官方跑分表里 Luna 交了成绩的六项全输给了它,好几项还咬住了 Sonnet。


  • 操作电脑的 OSWorld 从上一代的 15.7% 冲到 72.4%,离 Sonnet 5.5 只差 11.5 个百分点
  • 终端编程的 Terminal-Bench 4.0,上一代是零分,这次拿了 39.2%
  • 知识工作的 GDPval-AA 拿下 1620 分,是上一代的两倍多
  • 「人类最后的考试」HLE 不带工具,从 10.2% 涨到 45.9%



实际能省多少钱


价格是每百万 Token 输入 0.10 美元、输出 0.50 美元,这是提示在 10 万 Token 以内的价格,超过 10 万按输入 0.50 美元、输出 2.50 美元算。


缓存读取每百万 Token 0.01 美元,走批处理再打五折。



官方测算下来,同样的活平均比 Haiku 4.5 省 75% 左右,同样的预算大约能跑四倍的调用量。


没省到九成,是因为超过 10 万 Token 的请求只便宜一半,好在上一代 Haiku 约九成请求都在 10 万以内,另外新分词器会让同样一段话多出三成左右的 Token。


和 GPT-6 Luna 比,10 万 Token 以内两家的输入、输出、缓存价格完全一样。


面对长上下文时 Luna 更便宜,它要到 27 万 Token 左右才涨价,涨完也才输入 0.20 美元、输出 0.75 美元。


Sonnet 5.5 的缓存读取也从今天起砍半,每百万 Token 从 0.20 美元降到 0.10 美元,官方算下来多数 Agent 任务能便宜两成左右。


Max 和 Team 订阅本周起每月送 API 额度,Max 5x 送 100 美元、Max 20x 送 200 美元,Team 最多 500 美元、全队共用,在 Claude Platform 上哪个模型都能用。



跑分压过 Luna
但复杂编程还差 Sonnet 一截


这一代 Haiku 相比上一代,跑分进步巨大。



  • 操作电脑的 OSWorld 从上一代的 15.7% 冲到 72.4%,离 Sonnet 5.5 只差 11.5 个百分点
  • 终端编程的 Terminal-Bench 4.0,上一代一分没拿到,这次拿了 39.2%
  • 知识工作的 GDPval-AA 拿下 1620 分,是上一代的两倍多
  • 「人类最后的考试」HLE 不带工具,从 10.2% 涨到 45.9%


电脑操作是这次进步最猛的一项,OSWorld 上同价的 Luna 只有 48.9%,Haiku 5.5 甩开它 23.5 个百分点。


算上成本更夸张,它开到 Medium 档就超过了 Luna 满档的成绩,花的钱还更少。



知识工作的 GDPval-AA 上,Haiku 5.5 的 1620 分压过了 Luna 的 1437 分,离 Sonnet 5.5 的 1840 分还差一截,只开默认的 Medium 档也有 1277 分。


跑长线项目的 AA-Briefcase 上,它从上一代的 614 分涨到 1578 分,Luna 是 1336 分。



推理和读图上,HLE 带上搜索和代码工具时 Haiku 5.5 是 57.4%,Sonnet 5.5 是 64.5%。读专业图表的 Chartography,它从上一代的 6.4% 涨到 46.4%,Luna 是 29.1%,Sonnet 5.5 是 61.6%。



和 Sonnet 差距最大的是编程,Terminal-Bench 4.0 上它的 39.2% 是 Luna(16.4%)的两倍多,但 Sonnet 5.5 是 70.6%。


FrontierCode 上它的 46.4% 也赢了 Luna 的 42.4%,离 Sonnet 5.5 最好成绩的 52.1% 还差将近 6 个点。


官方也明说,复杂的 Agent 编程还是交给 Sonnet 5.5 和 Opus 5.5。



适合拿来干什么


官方给 Haiku 5.5 的定位是量大、要快、要省钱的活,比如写摘要、压缩上下文、查数据库、做分类。


它也是目前最快的 Claude 模型,只比开了快速模式(价格很贵!)的 Opus 慢,适合实时客服和浏览器操作。


官方也给出了一批明星 AI 应用公司内测反馈。


Asana 测下来,任务完成的延迟比他们现用的模型降了三成多,Box 测得它的延迟只有 Haiku 4.5 的一半左右。



另一个主要用法是给 Opus 或 Sonnet 当子Agent,大模型拆任务、拿主意,Haiku 分头去跑。


Cognition 的 Devin Fusion 让 Opus 5.5 当主力、Haiku 5.5 当副手,FrontierCode 稳在 66.2 分的顶级水平,成本和延迟都降了下来。



金融 AI 公司 Rogo 让大模型做 PPT,Haiku 5.5 钻进 10-K 财报扒分部营收数据。



Claude 开发者账号给出了 Demo,任务是用一堆家用杂物设计装鸡蛋的架子,目标是从 32 米扔下不碎。



Opus 5.5 单干用了 3 分 37 秒、试了 25 种方案、花了 0.47 美元,带上 10 个 Haiku 5.5 子 Agent 只用了 58 秒、试了 86 种、花了 0.14 美元。




Haiku 5.5 使用指南


Haiku 5.5 已经在 Claude 客户端、Claude Code 和 AWS、谷歌云、微软 Azure、Cursor、OpenRouter 等平台上线,模型 ID 是 claude-haiku-5-5,上下文 100 万 Token,单次最多输出 12.8 万 Token。



它是第一个能调思考档位的 Haiku,从 Low 到 Max 一共五档,API 默认是 Medium。


Python 和 TypeScript SDK 也加上了电脑操作和浏览器操作,目前是 Beta。


从 Haiku 4.5 迁移过来,同样的文字 Token 会多三成左右,max_tokens 和成本预估得重算。


budget_tokens 换成了自适应思考加 Effort 档位,temperature、top_p、top_k 要删掉,预填回复不能用了,格式要求改用结构化输出。


电脑操作要换成新工具集 computer_toolset_20260801,Priority Tier 暂不支持。


嫌麻烦可以在 Claude Code 里跑一句:

/claude-api migrate this project to claude-haiku-5-5

让它自己改。


当然,对于非开发者而言,你现在就可以直接在客户端里与 Haiku 5.5 对话了!



简单的问题就不要麻烦 Fable、Opus、Sonnet 了,Haiku 5.5 即使只是开 Low 档推理强度,也可以做到准确地秒出答案,完美替代搜索引擎了。



快去试试吧!


参考资料:

https://www.anthropic.com/claude-haiku-5-5

编辑:马可 摩西


秒追ASI
⭐点赞、转发、在看一键三连⭐
点亮星标,锁定新智元极速推送!