微信扫码
添加专属顾问
我要投稿
DeepSeek V4重磅升级,架构与性能全面突破,阿里云AI网关率先支持其API调用。 核心内容: 1. DeepSeek V4-Pro/V4-Flash三大技术升级:流形约束残差架构、领域专家培育训练范式、混合注意力机制 2. 模型性能表现:Agent能力达开源最佳、1M上下文推理效率提升73%、世界知识接近Gemini-Pro 3. 阿里云AI网关独家支持:兼容OpenAI/Anthropic接口、提供多模型Fallback等企业级功能
今天,DeepSeek 发布两个模型,V4-Pro 和 V4-Flash。其架构和技术优势可以总结为:
从而带来了模型效果和性价比方面的提升,包括 [1]:
DeepSeek-V4 支持 OpenAI ChatCompletions 接口与 Anthropic 接口。调用新模型 API 时,Model 参数需要改为 deepseek-v4-pro 或 deepseek-v4-flash。
阿里云 AI 网关,提供 Model API、Agent API、MCP Server 的管理能力,现已率先支持 DeepSeek-V4 API 的管理。您可以通过阿里云 AI 网关,调用 DeepSeek-V4 API 服务,包括思考、多轮对话、Tool Call、Anthropic /v1/messages 兼容调用等功能,并支持在 Claude Code 上接入 DeepSeek-V4,此外,还实现了 DeepSeek-V4 和 Qwen 等其他模型之间的 Fallback 能力。
打开 AI 网关控制台[2]实例页面,在顶部菜单栏选择目标实例所在地域,并单击目标实例 ID。在左侧导航栏,单击 Model API,然后单击创建 Model API。
进入创建 Model API 表单后,您可按以下说明进行配置:
配置完后,进行用例测试:
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2026-06-17
GLM-5.2 技术解读:智谱百万上下文的新一代旗舰模型
2026-06-16
26.1%的AI编程技能有漏洞:NVIDIA开源 SkillSpector 能扫出什么?
2026-06-12
当 AI Coding Agent 成为基础设施:我们为什么要开源 LoongSuite Pilot
2026-06-09
CPU 跑得比 Whisper GPU还快的开源语音识别,本地部署
2026-06-09
别再问我什么是爱马仕!
2026-06-09
Open Design:开源界的 Claude Design 替代品,61.7K Star,21+ Agent 都能跑,本地第一
2026-06-08
我开源了 PPT-Library:让历史 PPT 变成 AI 可复用资产
2026-06-08
knowledge-work-plugins:Anthropic 官方开源的知识工作插件集,19,000+Star
2026-03-30
2026-04-09
2026-04-03
2026-03-23
2026-04-01
2026-03-31
2026-03-30
2026-04-18
2026-04-18
2026-03-31
2026-06-16
2026-05-30
2026-05-16
2026-04-22
2026-04-21
2026-04-15
2026-04-09
2026-04-01