微信扫码
添加专属顾问
我要投稿
小模型Haiku 4.5性能直逼旗舰,速度翻倍成本大降,AI能力下沉速度超预期。 核心内容: 1. Haiku 4.5性能接近旗舰Sonnet 4,部分任务表现更优 2. 速度提升一倍多,API调用成本降低三分之一 3. 安全性表现突出,成为Anthropic最安全的模型
10分钟前,Anthropic 发布了 Claude Haiku 4.5
先说结论:
直到上个月,Sonnet 4 还都是旗舰模型,现在一个小模型就能达到
从完整的 benchmark 来看,Haiku 4.5 的表现很有意思
编程能力:
数学能力:
Computer Use:
说实话,在计算机使用这个任务上,Haiku 4.5 的表现确实让人意外
Anthropic 特别强调了速度这个点
原话是:more than twice the speed
体感就是:同样的任务,等待时间直接砍半,Claude Code 写代码的速度感会好很多
对于需要频繁调用 API 的应用来说,这个速度提升的价值可能比成本降低更重要
对比 Sonnet 4 的价格,Haiku 4.5 便宜了三分之一:
对比一下 Sonnet 4 的价格,Haiku 4.5 便宜了三分之一
部署渠道:
基本上,能用 Claude 的地方,现在都能用 Haiku 4.5
模型名称:claude-haiku-4-5
这里有个很有意思的点:Haiku 4.5 是 Anthropic 目前最安全的模型
按照 Anthropic 的自动化对齐评估,Haiku 4.5 的 misaligned behaviors 比例甚至低于 Sonnet 4.5 和 Opus 4.1
然后,因为在 CBRN(化学、生物、放射性、核武器)风险评估中表现良好,Haiku 4.5 被归类为 ASL-2
相比之下,Sonnet 4.5 和 Opus 4.1 都是更严格的 ASL-3
我觉得吧,Haiku 4.5 的发布,其实展示了一个很清晰的趋势:
AI 能力的「下沉」速度,远比我们想象的快
五个月前还是旗舰的性能,现在已经变成了小模型的标配
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2025-11-30
麦肯锡重磅报告:关于未来的生存指南,当57%的工作被自动化,我们如何与AI结成利益共同体
2025-11-30
Token到底是个啥?看完这篇终于懂了
2025-11-29
Claude Opus 4.5 重磅登场:这哪里是小更,分明是重构大模型搞复杂活儿的底层逻辑
2025-11-29
Perplexity 团队深度解析|组织协作、AI原生产品体验与品牌美学
2025-11-29
ChatGPT 全球上线群聊功能
2025-11-28
如何规划一个「有节奏感」的AI产品路线图?
2025-11-28
用一个关键词总结Palantir AIP:面向对象编程
2025-11-28
基于大模型增强的少样本学习在用户投诉意图感知中的应用
2025-09-19
2025-10-02
2025-10-26
2025-09-16
2025-09-08
2025-09-17
2025-09-29
2025-09-14
2025-10-07
2025-09-30
2025-11-28
2025-11-27
2025-11-27
2025-11-27
2025-11-25
2025-11-25
2025-11-25
2025-11-23