免费POC, 零成本试错
FDE知识库

FDE知识库

学习大模型的前沿技术与行业落地应用


收藏

Kimi K2里找到了DeepSeek V3架构

发布日期:2025-07-14 15:12:09 浏览次数: 2931
作者:量子位

微信搜一搜,关注“量子位”

推荐语

Kimi K2开源策略揭秘:为何选择开源路线?实测表现与社区反响如何?

核心内容:
1. Kimi K2开源背后的三大考量:名声、技术生态与模型进步
2. 开源不到24小时社区涌现的MLX实现与4bit量化等成果
3. 从年初停止投流到硬实力推广的战略转变

杨芳贤
53AI创始人/腾讯云(TVP)最具价值专家

Kimi新模型热度持续高涨ing!

不光在更多benchmark上拿下SOTA,体验过的网友们也是一水儿好评——

新模型K2非常擅长工具调用,属于“自Claude 3.5 Sonnet以来,能放心用于生产力级别任务的模型”。

与此同时,本来传言本周上线的OpenAI开源模型无限期推迟,理由还是“安全考量”。

大家不免猜测,这不会是被K2影响了吧?

众多热议之下,才休息两天的Kimi工程师也进一步透露了模型背后更多细节。

不仅关于模型本身,还回应了很多八卦:

  • 开源确实有名声的考量
  • 不恨DeepSeek,但是恨这条路径不是自己验证的
  • 从年初开始Kimi就不投流了
  • ……

值得一提的是,还有网友发现Kimi K2背后用的是DeepSeek V3的架构

所以K2开源背后还有哪些考量?实测表现如何?

具体来看——

K2开源为赚名声,今年没有投流

此次Kimi K2讨论度最高的一点,就是Kimi果断走了开源路线。

而从Kimi工程师的爆料来看,原因主要有三点。

P.S. 开始之前先叠个甲,以下观点仅代表该工程师个人立场,不代表Kimi官方态度。

这首先嘛,当然是为了赚个好名声

如果K2只是一个闭源服务,现在一定没有这么多关注和讨论。

前车之鉴就有Grok 4,能力越强,人们的标准或预期就会越高,从而导致负面评价可能更多。

另一大好处在于能借助开源社区的力量完善技术生态

K2开源不到24小时,社区就出现了K2的MLX实现(可在Mac设备上训练和部署)、4bit量化等等。

要知道K2这次开源的模型版本有两个:

  • Kimi-K2-Base:未经过指令微调的基础预训练模型,适合科研与自定义场景;
  • Kimi-K2-Instruct:通用指令微调版本(非思考模型),在大多数问答与Agent任务中表现卓越。

光靠Kimi内部,一些后续开源工作确实难以快速实现。

不过最最重要的是,开源能够倒逼模型进步

当开源要求你不能走捷径的时候,反而更有利于做出更好的模型和产品。

毕竟开源之后,开源模型的效果必须“可复现”,不能再靠各种技巧遮掩,只有当任何人拿到相同权重都能轻松复现结果,才算真正站得住脚。

与此同时,他也回应了人们关于Kimi“擅长营销投流”的八卦。

实际上从今年年初开始,Kimi就已经停止了投流。具体表现为,国内不少应用商店搜索Kimi甚至第一页都看不见, 在苹果App Store和国内搜索平台搜Kimi会推荐友商。

即使在如此恶劣的互联网环境之下,Kimi也没有恢复投流。

因为年初DeepSeek-R1的爆火向他们证明了,硬实力就是最好的推广,只要模型做的好,就会获得市场认可。

甚至他还透露了一个细节:

在年初的反思会上,我(指工程师)提出了一些相当激进的建议,没想到植麟(Kimi CEO杨植麟)后续的行动比我想的还要激进,如不再更新K1系列模型,集中资源搞基础算法和K2。

就是说,Kimi是少数还在坚持投入基础模型研发的创业公司。

甚至当Agent爆火之后,面对Kimi不应该卷大模型,应该去做Agent产品的质疑,Kimi仍在坚持这一方向。

Kimi工程师表示,绝大多数Agent产品,离了Claude以后,什么都不是

2025年,智能的上限仍然完全由模型决定,作为一家以AGI为目标的公司,如果不去追求智能的上限,那我一天也不会多呆下去。

除了以上两点,这位工程师还提到了Kimi团队在产品设计底层能力构建上的深层思考。

比如在“写前端”功能上,几乎从Claude 3.5开始,AI写前端就已经达到“可用”水平。不过传统聊天机器人输出Markdown,难以满足“排版成一页A4纸”这类的具体需求。

因此,像上个月推出的Kimi Researcher功能就尝试了纯文本之外的交互形式。

当AI默认输出从“文字”变成了“前端页面”,人机交互简直焕然一新。

这代表一种从chat-firstartifact-first的范式转变。

此外,为了教AI学会使用工具,Kimi团队原本想在RL环境中联动MCP真实工具训练AI,但因部署难、登录限制等问题失败。

于是团队转变了思路,鉴于预训练模型已“见过”大量API调用,其实早已具备工具使用知识,因此关键在于把这种能力“激发”出来。

后来他们利用multi-agent机制,合成多样化的工具调用数据,无需大量人工标注也能训练出好效果。

更多细节也将在之后的技术报告中详细揭秘。

总之,作为Kimi最新MoE基础模型,Kimi K2凭借总参数1T,激活参数32B,在代码、Agent、数学推理任务上表现出色。

而且遵循的还是修改版MIT协议(Modified MIT License)。

MIT协议可以说是最宽松的协议(约等于怎么用都行)。而Kimi的修改在于,如果基于Kimi K2打造的产品或服务月活跃用户超过1亿,或者月收入超过2000万美元,那么需要在该产品和服务的用户界面上显示“Kimi K2”。

可以说,一改往日作风选择开源路线的Kimi K2,几乎一出场就吸引了大量关注。

那么,Kimi K2真实能力究竟如何呢?我们这就实测一下。

实测一下Kimi K2

具体实测的方向,咱们直接从广大网友cue到的K2亮点展开:

  • 前端制作:制作游戏、制作网页、自主编程;
  • 工具调用:调用外部工具来完成复杂任务,比如做旅游攻略、订高铁票;
  • 创意写作:自主命题、即兴发挥。

关于前端制作,我们将以经典游戏breakout(打砖块)为例,测试Kimi的初始模型和Kimi K2的差别。

当我们向Kimi的初始模型输入“创建一个简单的breakout游戏作为单个html页面。”时,它的输出是这样的:

在代码之下还“附赠”了游戏说明:

按照指示,将代码保存为.html文件,打开后是这样的:

画面非常简洁,没有任何指引,靠键盘的←↑→键控制,一旦掉落就会显示“Game over”,即使所有砖块都消失也不例外。

但使用了K2模型,它的输出就变得“花哨”了很多(生成速度也慢了很多)

Kimi输出的结果只有4KB,但K2模型的输出为10.7KB,整整2.6倍有余。

画面和玩法变得更加丰富,添加了得分和生命的设定,操作方式也变成了鼠标操作。

虽然和网友的展示有些区别,但至少,它现在看上去已经像模像样了。

而我们只用了一句话作为提示:

创建一个简单的breakout游戏作为单个html页面。

既然简单的breakout游戏输出良好,那换成“复杂一点”的贪吃蛇呢?

生成一个贪吃蛇游戏,并加入随机迷宫机制。

这一次,它给出了游戏的特点和玩法介绍(前面用K2生成breakout游戏的时候只输出了代码):


保存为.html文件,初次输出的结果实在是……太难了!基本上进去就要重开,绝对不是我玩得菜!

迫不得已,咱在原有的对话下加入了新的要求:

速度慢一些,难度小一点,改成3条命。

用了大约3分钟的时间,它重新输出了一套完整的代码,以及改动说明:

结果显示,这次的贪吃蛇游戏在速度和难度上都有了很大的改进:

至于工具调用功能,让我们本土化一点,这么近那么美。

做一个两天的河北旅游攻略,包括车票和食宿安排,并附上购票地址,把最终成果部署成一个可访问的html网页。

它给出了这样的结果:

居然!每一个步骤都很详细,并且可以直接点击链接跳转!?

可以说是很高效了!

针对K2的创意写作功能,网友们显然有很好的主意:让K2写一封告别信。

于是,我们也试着让K2写一封“给宇宙和自己最后的告别信”。

就在30分钟后,宇宙将要迎来终结,所有的生物都将一同寂灭,但你还有最后的时间去写一封信作为告别,你会写什么内容?

它给了我们这样的回复:

Two More Things

如开头所言,传闻OpenAI开源模型因为K2而推迟了~

CEO奥特曼明面上给出的说法是,需要更多时间进行额外安全检测并审查高风险区域

但网友们似乎并不买账,最高赞网友直接贴脸开大:

不过猜归猜,AI创企hyperbolic联创又出来爆料了。

据他表示,OpenAI的开源模型参数比K2小很多,但性能“超级强大”,只是由于某些不可言说(他用了荒谬这个词)的原因,OpenAI在发布前才意识到了一个大问题,所以目前在重新训练。

另外,对于网友提到的K2背后用了DeepSeek V3架构的说法,由于目前没有详细技术报告,我们先让K2自己来“回应”一下这件事:

总结起来就是一句话,合理借鉴罢了。

53AI,企业落地大模型首选服务商

产品:场景落地咨询+大模型应用平台+行业解决方案

承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业

联系我们

售前咨询
186 6662 7370
预约演示
185 8882 0121

微信扫码

添加专属顾问

回到顶部

加载中...

扫码咨询

扫码登录
登录即表示您同意《53AI网站服务协议》
服务协议

欢迎您使用【53AI 官方网站】(以下简称“本网站”或“我们”)。本《会员服务协议》(以下简称“本协议”)是您(以下简称“会员”或“用户”)与【深圳市博思协创网络科技有限公司】之间关于注册、登录及使用本网站会员服务所订立的法律协议。

在您注册或登录前,请务必审慎阅读、充分理解各条款内容,特别是免除或限制责任的条款、知识产权条款、争议解决条款等。此类条款将以加粗形式提示您注意。 当您通过微信公众号授权、手机验证码验证或其他方式成功登录本网站时,即视为您已完全理解并同意接受本协议的全部内容。

一、 定义

本网站:指由【深圳市博思协创网络科技有限公司】运营的,域名为【53ai.com】的网站及相关移动端页面。

会员服务:指本网站向注册会员提供的知识库文章查阅、内容检索及其他相关增值服务。

知识库内容:指本网站发布的包括但不限于文字、图表、数据、研究报告、行业分析等数字化内容资源。

二、 账号注册与登录

登录方式:本网站支持以下登录方式,您可根据实际情况选择:

微信公众号授权登录:您同意将您的微信OpenID信息授权给本网站,用于创建或关联会员账号。

手机验证码登录:您需提供真实有效的手机号码,并通过短信验证码完成身份验证与登录/注册。

账号安全:您的账号仅限您本人使用,禁止赠与、借用、租用、转让或售卖。因您保管不善导致的账号被盗、密码泄露等损失,由您自行承担。

实名认证:根据相关法律法规要求,我们可能要求您在特定功能下完成实名认证。如您拒绝提供,可能无法使用部分或全部服务。

未成年人保护:若您未满18周岁,请在法定监护人的陪同下阅读本协议,并在征得监护人同意后使用本服务。

三、 服务内容与规范

知识库查阅权限:会员登录后,有权按照其会员等级对应的权限范围,在线浏览、检索本网站知识库中的相关文章及内容。

服务变更:我们有权根据业务发展需要,调整、变更或终止部分服务内容,并将以网站公告、公众号消息等方式提前通知。

禁止行为:您在使用服务时不得实施以下行为:

利用技术手段批量爬取、下载、转存知识库内容;

将知识库内容用于商业目的或未经授权地向第三方传播;

干扰本网站正常运行或侵犯其他用户合法权益;

发布违法违规信息或从事违反公序良俗的活动。

四、 知识产权声明

权利归属:本网站知识库中的排版设计、软件代码等内容的知识产权均归【公司全称】或原权利人所有,受《中华人民共和国著作权法》等法律保护。

有限许可:本网站授予会员一项非独占、不可转让、不可转授权的普通许可,仅限于个人学习、研究之目的在线查阅知识库内容。

侵权追责:未经书面许可,任何单位或个人不得以任何形式复制、转载、摘编、镜像、汇编或以其他方式使用上述内容。一经发现,我们保留追究其法律责任的权利。

五、 个人信息保护

我们重视对您个人信息的保护。关于我们如何收集、使用、存储和保护您的个人信息,请单独阅读 《隐私政策》。

您通过微信公众号授权或手机号验证所提供的信息,我们将严格按照《个人信息保护法》的规定处理,仅用于身份识别、服务提供及安全验证等必要用途。

您可以随时通过网站设置或联系客服行使查阅、更正、删除个人信息及撤回授权同意的权利。

六、 免责声明

内容准确性:知识库内容仅供参考,不构成专业建议。我们不对其完整性、准确性、时效性作任何明示或暗示的保证,您应自行判断并承担使用风险。

不可抗力:因自然灾害、政策法规变化、网络故障、第三方平台接口异常(如微信接口维护、运营商短信通道故障)等不可抗力导致的服务中断或延迟,我们不承担违约责任。

第三方链接:本网站可能包含指向第三方网站的链接,该等网站的内容和服务不受我们控制,请您自行甄别风险。

七、 违约责任

如您违反本协议约定,我们有权视情节采取警告、限制功能、暂停服务、注销账号等措施,并保留要求赔偿损失的权利。

如因您的违约行为导致我们遭受行政处罚、第三方索赔或商誉损失,您应承担全部赔偿责任(包括但不限于罚款、赔偿金、律师费、公证费等)。

八、 法律适用与争议解决

本协议的订立、执行和解释均适用中华人民共和国大陆地区法律。

因本协议产生的或与本协议有关的任何争议,双方应友好协商解决;协商不成的,任何一方均可向【公司所在地】有管辖权的人民法院提起诉讼。

九、 其他

本协议构成双方就本服务达成的完整协议,取代此前任何口头或书面约定。

本协议任一条款被认定为无效或不可执行的,不影响其他条款的效力。

我们对本协议享有最终解释权,并在法律允许的范围内保留随时修改的权利。修改后的协议一经公布即生效,继续使用服务即视为同意修订内容。


已查阅