微信扫码
添加专属顾问
我要投稿
Claude 3.7在代码编写和SVG卡片生成上超越Deepseek-R1和Grok3,展示AI模型的新高度。 核心内容: 1. Claude 3.7 Sonnet模型的介绍及其推理能力的提升 2. 比较Claude 3.7、Deepseek-R1和Grok3在代码能力测试的表现 3. SVG卡片生成能力对比,Claude 3.7的明显优势
Claude 3.7 Sonnet 是 Anthropic 最新的 AI 模型,定位为推理、编码和现实世界问题解决方面的重大进步。最大的变化是 Claude 3.7 Sonnet 现在支持思考模式,让我们可以看到模型的逐步推理过程。下面从代码能力测试和svg卡片生成两个维度跟最近火热发布的两个模型deepseek-R1和grok3做一下对比测试。
使用claude3.7实现一个前端页面,响应时长基本是秒回
创建一个包含CSS和JavaScript的单个HTML文件,用于生成一个带有动画的天气卡片。卡片应通过不同的动画直观地展示以下天气情况:
风:例如移动的云、摇摆的树木或风线。
雨:例如下落的雨滴、积水形成。
晴:例如闪烁的阳光、明亮的背景。
雪:例如飘落的雪花、积雪。
将所有天气卡片并排放置。卡片应有一个深色背景。提供所有HTML、CSS和JavaScript代码,全部包含在同一个文件中。JavaScript应包含一种方式,用于在不同的天气条件下切换(例如一个函数或一组按钮),以展示每种天气的动画效果。
切换到Deepseek-R1
响应时长111s,生成的html通过在线解析工具中看一下渲染效果
思考响应时长114s
看下代码效果:
三个前端代码能力相比哪个更强不言而喻
先让deepseek-r1生成一个关于MOE大模型的工作原理,然后绘制成svg图
以上就是跟大家分享的关于claude3.7、deepseek-r1以及grok3的代码能力和svg卡片生成能力的对比测试。总的来说claude3.7完胜另外两个大模型,这也能解释为什么现在最火的Cursor代码编辑器为什么会集成claude3.5的原因。当然以上的测试仅仅是从两个维度来做对比,还有其他维度比如逻辑推理、数学测试、语义理解、图文生成、性能等等。
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2026-06-21
[译] 我所知的全部智能体工程技巧
2026-06-20
13人团队叫板Anthropic:我们造了一个更快更便宜的大模型
2026-06-20
微信左上角长出“两只眼睛”:小微测试版,可能是微信 AI 化最关键的一步
2026-06-20
Agent Skill 管理范式探索:像管理软件包一样管理 Agent 能力
2026-06-18
企业智能体的下半场,如何让智能体越用越聪明?
2026-06-18
你的 Harness 工作流真的在进步吗?我们用一场考试撕掉了遮羞布
2026-06-18
Agent 记忆,我们全都理解错了?
2026-06-18
多 Agent 并行与 Headless 模式:让 Claude Code 效率翻 10 倍
2026-04-15
2026-04-07
2026-04-07
2026-03-31
2026-04-24
2026-04-17
2026-03-31
2026-04-05
2026-04-02
2026-04-05
2026-06-18
2026-06-18
2026-06-10
2026-06-10
2026-06-07
2026-06-06
2026-06-03
2026-06-02