微信扫码
添加专属顾问
我要投稿
小模型Haiku 4.5性能直逼旗舰,速度翻倍成本大降,AI能力下沉速度超预期。 核心内容: 1. Haiku 4.5性能接近旗舰Sonnet 4,部分任务表现更优 2. 速度提升一倍多,API调用成本降低三分之一 3. 安全性表现突出,成为Anthropic最安全的模型
10分钟前,Anthropic 发布了 Claude Haiku 4.5
先说结论:
直到上个月,Sonnet 4 还都是旗舰模型,现在一个小模型就能达到
从完整的 benchmark 来看,Haiku 4.5 的表现很有意思
编程能力:
数学能力:
Computer Use:
说实话,在计算机使用这个任务上,Haiku 4.5 的表现确实让人意外
Anthropic 特别强调了速度这个点
原话是:more than twice the speed
体感就是:同样的任务,等待时间直接砍半,Claude Code 写代码的速度感会好很多
对于需要频繁调用 API 的应用来说,这个速度提升的价值可能比成本降低更重要
对比 Sonnet 4 的价格,Haiku 4.5 便宜了三分之一:
对比一下 Sonnet 4 的价格,Haiku 4.5 便宜了三分之一
部署渠道:
基本上,能用 Claude 的地方,现在都能用 Haiku 4.5
模型名称:claude-haiku-4-5
这里有个很有意思的点:Haiku 4.5 是 Anthropic 目前最安全的模型
按照 Anthropic 的自动化对齐评估,Haiku 4.5 的 misaligned behaviors 比例甚至低于 Sonnet 4.5 和 Opus 4.1
然后,因为在 CBRN(化学、生物、放射性、核武器)风险评估中表现良好,Haiku 4.5 被归类为 ASL-2
相比之下,Sonnet 4.5 和 Opus 4.1 都是更严格的 ASL-3
我觉得吧,Haiku 4.5 的发布,其实展示了一个很清晰的趋势:
AI 能力的「下沉」速度,远比我们想象的快
五个月前还是旗舰的性能,现在已经变成了小模型的标配
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2025-11-16
vLLM× 魔搭社区,一文学会 Windows 本地部署大模型
2025-11-16
从想法到6.5亿美元:AI Products的三个关键要素
2025-11-16
Claude Skills到底是什么?一张表讲清楚它和MCP、Project的区别和联系!
2025-11-15
最近爆火的TOON是什么技术,跟JSON有什么区别
2025-11-15
GPT-5.1 系列模型正式上线 Azure AI Foundry
2025-11-15
实测文库genflow3.0:自带记忆和office三件套的通用Agent
2025-11-15
Google悄悄上线Code Wiki,让你在一个页面理解整个仓库
2025-11-15
这种全新的交互方式,会成为未来AI应用的标配吗?
2025-08-21
2025-08-21
2025-08-19
2025-10-02
2025-09-16
2025-09-19
2025-09-08
2025-09-17
2025-08-19
2025-09-29
2025-11-15
2025-11-14
2025-11-12
2025-11-10
2025-11-09
2025-11-09
2025-11-08
2025-11-06