微信扫码
添加专属顾问
我要投稿
DeepSeek V3.1震撼发布,性能超越Claude 4 Opus,成为开源模型新标杆! 核心内容: 1. V3.1 Base与Instruct双版本发布,采用MIT开源许可 2. 在多项基准测试中表现优异,尤其在编码任务上超越顶级闭源模型 3. 128k长上下文支持,适合复杂应用场景
昨晚 DeepSeek V3.1 Base / Instruct 在 Hugging Face 上低调发布,但引起了巨大的社区反响。
@scaling01
DeepSeek V3.1 在 Aider Polyglot 基准上击败了 Claude 4 Opus,成为目前表现最强的非-TTC 编码模型,而其成本仅约 1 美元。
@swyx
看起来 @deepseek_ai 依旧稳步推进,DeepSeek V4 很可能已经在路上了!
我这边整理了一下目前关于 V3.1 Base 的要点(毕竟现在没有一个地方能一次性看到所有信息):
可以预见,今年 11-12 月的模型大战会非常精彩。
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2025-08-21
突发!字节开源 36B 模型Seed-OSS
2025-08-20
DeepSeek-V3.1-Base来了!MoE架构+128K上下文,性能再进化
2025-08-20
39种Dify常见报错及解决方案汇总
2025-08-20
突发!DeepSeek刚刚开源V3.1-Base
2025-08-19
GPT-OSS 图解:架构、推理模式与消息通道
2025-08-19
PS 再见!阿里 Qwen 开源全能 P 图神器,人人都是设计师!
2025-08-19
AGI|研究报告还能这样写?揭秘Open Deep Research智能生成全流程
2025-08-19
gpt-oss 模型在 Azure A10 和单卡 H100 机型上的性能测评
2025-07-23
2025-06-17
2025-06-17
2025-07-23
2025-08-05
2025-07-14
2025-07-12
2025-07-29
2025-07-27
2025-07-31