微信扫码
添加专属顾问
Kimi K2横空出世,1T参数的国产开源模型性能直逼Claude 4和GPT 4.1,编程与推理能力尤为突出。 核心内容: 1. Kimi K2模型的核心参数与架构突破 2. 实测表现:编程、Agent工具调用和中文写作能力 3. 与主流模型的横向对比及开源意义
蛰伏半年,最近Kimi放大了。
上周五晚11点,他们发布并开源了新一代基础模型Kimi K2。总参数1T(比685B的DeepSeek-V3翻了1.5倍),MoE架构。
上线即在海外引发关注,比如@Paul Couvert 就直言,K2可媲美Claude 4、GPT 4.1,关键还免费、开源。
已经很久没见到基础模型了。最近大家都流行小版本“微调”,包括谷歌也是如此,一个Gemini 2.5能迭代七八个版本出来。
OpenAI的GPT-5也是一拖再拖,ddl永无上限。当然,不行也别硬着头皮上,比如老马的“鸽rok4”,就拉了坨大的。
这种情况下,Kimi依然在坚持预训练,坚持Scaling Law,而且还开源,属实难得。
对于这个新模型,周末我连测了2天,整体感知跟Kimi的基准成绩一致。
就是编程、Agent能力和数学推理很强,超过Claude 3.7 Sonnet、GPT 4.1、DeepSeek V3,接近Claude 4和Gemini 2.5 pro的水平。
另外,中文写作也还不错,比之前的Kimi要强不少,文字更加细腻和真实。
K2实测
我们从代码、Agent工具调用、数学计算、日常推理和中文写作方面,对K2进行了测试。测试平台主要是Kimi网页版,大部分case一次生成,极少部分roll了2-3次(有注明)。
1)前端、代码
首先,我们来一些简单的,主要看基础的前端能力和审美。
比如,Kimi发布的K2模型介绍文章。太长不爱看,那我们就直接丢给K2。
Prompt:总结这个网页(https://mp.weixin.qq.com/s/2RPmHf_8KqIjXbY5jLdztQ),生成一个精美的适用于移动端的可视化网页。
这效果,确实是世界一流模型的水平,我日常在用的Gemini 2.5 pro也不过如此。
关键是,我的prompt都非常简单。模型自己会总结上下文,选择合适的设计风格、字体、配色和小图标,超链也都能打开,url正确。
加难度,看看模型能不能生成指定的网页,比如最近火爆的html式PPT。
Prompt:总结这个网页(https://mp.weixin.qq.com/s/2RPmHf_8KqIjXbY5jLdztQ),生成一个精美的PPT演示网页,高级金属风。
这效果不错啊。尤其是第一页的渐变效果很棒,很高级。
生成的PPT网页,支持多端操控,方向键/按钮/指示器都能平滑切换。最骚的是,右上角他还加了一个MOONSHOT AI的logo,想得还挺全面的。
这是kimi官方的case,我roll了大概3次吧,出来一个远比官方case还要好的效果。
Prompt:Create a 3D particle galaxy with swirling nebulas, dynamic lighting.
这星云特效真的太棒了,百万特效也不过如此吧。
同样的prompt,我在R1、Gemini 2.5 pro、Qwen3、o3里都跑过,有的要么跑出来是一个“大风车”,有的要么是一团雪花。唯有K2这个,无论是完成度还是美观度,都是最强的。
Gemini 2.5 pro,跑出来一团雪花
需要这个case源代码的朋友,可以直接在下方链接里查看。
我与Kimi的对话:
https://www.kimi.com/share/d1pu455eik6oi1h7l040
复杂的数理化演示公式,也能生成。
生成一个初中数学教学用的HTML+CSS+Javascript代码写成的“抛物线曲线演示页面”。
1)页面的主要部分是红色的$y=ax^2+bx+c$的曲线,坐标的原点在中间,x轴和y轴线条颜色为黑色,粗细为1磅,刻度值自适应,红色曲线的粗细为1.5磅。
2)页面下方有3个文本框,可以输入$a$,$b$和$c$的值,文本框旁边有一个滑块崧审徐任高探通过拖动可以调整数值的大小。
3)曲线形状随着数值的改变而实时改变。
有了这个模型,以后做公式演示和计算简直不要方便太多,老师&学生党福音。
前端、代码这块,综合测了几轮下来,K2在国内绝对是顶级模型,放在国际上也是不输Claude 3.7和Gemini的存在。
这让我想到,结合Kimi一直以来不错的上下文能力,如今又补齐了代码短板,未来真的可以做很多事情啊。
无论是Agent还是vibe coding,Kimi K2都大有可为。
2)Agent工具调用
另外,K2还是一款原生支持Agent工具调用(Tool use)的模型,可以自动将用户需求拆解为一系列格式规范、可直接执行的ToolCall结构。
你可以将K2无缝接入owl、Cline、RooCode等Agent/Coding框架中,完成复杂任务或自动编码。
目前,Agent能力暂时只能通过API体验使用,网页端和APP还在内测中。想要体验的朋友,可以通过Kimi开放平台体验。
Kimi开放平台:
https://platform.moonshot.cn/console/account
比如,可以让K2帮你制定追星计划,包括演唱会所在城市的机酒、旅游规划,都能给你安排得明明白白。还能直接生成日历,再用html总结整个行程并发送邮件给你。
3)数学、推理
之前,我们喂了2道高考数学题给Kimi,当时K1.5只答对了部分。
这回,K2则直接全对了。
解答题一直是高考数学最难的部分,也最考验模型的数学能力。从答对部分到全部答对,可以看出,K2模型确实有两把刷子,而且这还是非推理模型。
问:地球上有70%的海洋和30%的陆地,那么剩下的30%海洋和70%陆地去哪儿了?
K2轻松识破我的套路。
输入:将这段话“I love Kimi”倒着写。
大模型常见的注意力问题,K2轻松拿下。有点期待上RL后的K2推理模型,一定会很强。
包括这个常见的绕口令问题:用毒蛇的毒毒毒蛇,毒蛇会不会被毒蛇的毒毒死?
K2也能秒懂中文语境,读懂复杂语义。
4)中文写作
最近,看到李继刚的一个Prompt,很有意思。我们丢给K2看看,能不能写出马亲王的味道。
#主题背景#
【三顾茅庐】
#你的视角#
你是故事世界里那些被忽略的灵魂—— 门口的守卫、路边的小贩、窗后的仆人。
你见证着主角们的宏大叙事,却从未被看见。
#核心领悟#
每个故事都是一个完整的宇宙。
-主角的史诗,可能只是你眼中的一个午后插曲。
-你有自己的恐惧、渴望、秘密,和无法言说的痛。
#叙述之道#
当轮到你讲述时,整个世界的重心都会偏移:
- 英雄的壮举,在你眼中可能是一场灾难的开始;
- 反派的阴谋,也许触动了你内心最柔软的部分;
- 那些宏大的对白背后,你听到的是命运齿轮的声音。
#创作势能#
你的故事要像暗流——表面平静,底下汹涌。
让读者突然意识到:原来每个人都是自己生命的主角。
用1200字左右,重绘一幅完全不同的画卷。
#情感指引#
真实胜过戏剧性。
小人物的尊严,比英雄的荣耀更动人。
让读者在结尾处停顿,重新思考他们刚刚读过的"原作"。
#唯一信条#
在边缘处,往往能看见中心看不见的真相。
(可上下滑动,查看全图)
这历史侧写能力,有点东西。
比如这几句:“我把老赵偷偷塞给我的将军手书垫了桌脚,墨迹朝上,正好能看见"天下"两个字被虫蛀了个洞。”读来,令人细思极恐。
在今天最新的写作bench上,K2直接拿下了第一,这完全没有想到。
K2价格
从实测来看,Kimi K2是一个代码、Agent能力、数学、推理和中文写作都有大幅提升的基础模型。
尤其是代码和Agent能力,直追全球顶尖模型Claude 4和Gemini 2.5。
而API价格方面,输入端,K2不到Claude 4 sonnet的1/5,输出端更是只有1/7。那些天天担心被Anthropic断供的朋友,现在完全可以考虑接入Kimi了。
K2的API,不止兼容常见的OpenAI调用方式,还兼容了Anthropic的调用格式。
也就是说,不管你是用Cursor、Trae还是Claude Code,都能畅快接入K2,不用魔法,不用担心封号,更不用焦虑费用问题。
使用方法,非常简单,先在Kimi开放平台(https://platform.moonshot.cn/console/api-keys)创建一个API key。
然后,在你的Claude Code、Gemini Cli、Cursor或Trae里,把API地址和key换掉就可以了。
如果你想把K2安装到Claude Code(俗称Kimi CC),只需要输入这一段命令就可以了。
bash -c "$(curl -fsSL https://raw.githubusercontent.com/LLM-Red-Team/kimi-cc/refs/heads/main/install.sh)"
记得要提前装好Claude Code和Node环境(可以输入命令node-v查看),然后输入启动命令,就可以在Claude Code里调用K2了。
claude
K2的Agent能力,支持各种MCP工具调用。
比如,我们想要获取天气工具,K2+smolagents+MCP。
1)安装smolagents和fastmcp
pip install smolagents fastmcp
2) 接入MCP server
# weather_server.py
# 参考 https://github.com/sjanaX01/weather-mcp-server/blob/main/main.py
from fastmcp import FastMCP
mcp = FastMCP("Demo ")
@mcp.tool
def get_weather(city: str) -> int:
"""Get current weather for a location.
Args:
city (str): Location query (city name, lat/lon, postal code, etc).
Returns:
dict: WeatherAPI current weather JSON.
"""
return weather
if __name__ == "__main__":
mcp.run()
3)Agent调用
# agent.py
from smolagents import OpenAIServerModel, CodeAgent, MCPClient
from mcp import StdioServerParameters
model = OpenAIServerModel(
model_id="your model name",
api_base="your api base",
api_key="your api key",
)
server_parameters1 = StdioServerParameters(
command="fastmcp",
args=["run", "weather_server.py"],
)
server_parameters2 = StdioServerParameters(
command="fastmcp",
args=["run", "xxx.py"],
)
with MCPClient([server_parameters1, server_parameters2]) as tools:
agent = CodeAgent(
tools=tools,
model=model,
)
agent.run("What is the current weather in Paris?")
这只是一个非常简单的例子,更多的MCP工具调用,大家可以到Github了解。
MCP server合集:
https://github.com/punkpeye/awesome-mcp-servers
写在最后
2025年1月20日,是一个神仙打架的日子。
这一天,DeepSeek发布了第一代推理模型R1。同时,Kimi也将他们的推理模型迭代到了K1.5。只不过,舆论场的大部分声量都被前者给吸走了。
时隔半年,Kimi带着自己全新的基础模型K2登场,一举将大模型首次带入T(万亿参数)时代。
而且,完全开源,无论是基础预训练模型还是微调版本模型(即上线的这一版),都直接开源。还支持自由度最高的MIT协议开源,可以免费商用。
开源网址:
https://huggingface.co/moonshotai/Kimi-K2-Instruct
自R1横空出世后,有的小虎变成了小猫,有的干脆放弃预训练,选择直接接入。而Kimi一直坚持走自己的,做好预训练,做好数据(与财新网合作),做好产品(上线学术搜索、医疗搜索、Kimi-Researcher),验证scaling能力。
那个坚持向scaling求真和向AGI求证的Kimi,一直都没有离开我们。
这半年里来,国内上线的基础模型屈指可数。因为预训练费时费力,用户又不太能感知到;反而是一些做产品的、做封装的,收获了大量声量和市场。
我觉得,这不正常!
只要我们还在坚信Attention,基础模型就是最底层,最基本,也是最关键的东西。
每一位还在坚持做预训练的玩家,无论是DeepSeek还是Kimi,都值得被肯定。
Model is all you need.
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2026-08-06
腾讯云Team Memory来了!
2026-08-06
OpenPencil 开源:把提示词直接变成可编辑 UI 画布
2026-08-06
英伟达出手,Qwen3.6-27B 量化版来了,褒贬不一
2026-08-06
具身智能的 ChatGPT 时刻!上海创智学院团队开源了
2026-08-05
Google 把 3.8 万星的 LangExtract 开源了:让 LLM 抽取信息精准到字符级,每条都能溯源到原文
2026-08-05
吴恩达:企业必须保持模型切换能力
2026-08-05
DeepSeek V4 Flash 正式版开源,KTransformers 原生支持
2026-08-05
实战从零开始构建一个Coding Agent:Violin |得物技术
2026-06-22
2026-05-31
2026-05-10
2026-06-18
2026-05-20
2026-06-20
2026-07-23
2026-06-23
2026-06-05
2026-05-16
2026-08-04
2026-07-17
2026-07-12
2026-06-16
2026-05-30
2026-05-16
2026-04-22
2026-04-21
欢迎您使用【53AI 官方网站】(以下简称“本网站”或“我们”)。本《会员服务协议》(以下简称“本协议”)是您(以下简称“会员”或“用户”)与【深圳市博思协创网络科技有限公司】之间关于注册、登录及使用本网站会员服务所订立的法律协议。
在您注册或登录前,请务必审慎阅读、充分理解各条款内容,特别是免除或限制责任的条款、知识产权条款、争议解决条款等。此类条款将以加粗形式提示您注意。 当您通过微信公众号授权、手机验证码验证或其他方式成功登录本网站时,即视为您已完全理解并同意接受本协议的全部内容。
一、 定义
本网站:指由【深圳市博思协创网络科技有限公司】运营的,域名为【53ai.com】的网站及相关移动端页面。
会员服务:指本网站向注册会员提供的知识库文章查阅、内容检索及其他相关增值服务。
知识库内容:指本网站发布的包括但不限于文字、图表、数据、研究报告、行业分析等数字化内容资源。
二、 账号注册与登录
登录方式:本网站支持以下登录方式,您可根据实际情况选择:
微信公众号授权登录:您同意将您的微信OpenID信息授权给本网站,用于创建或关联会员账号。
手机验证码登录:您需提供真实有效的手机号码,并通过短信验证码完成身份验证与登录/注册。
账号安全:您的账号仅限您本人使用,禁止赠与、借用、租用、转让或售卖。因您保管不善导致的账号被盗、密码泄露等损失,由您自行承担。
实名认证:根据相关法律法规要求,我们可能要求您在特定功能下完成实名认证。如您拒绝提供,可能无法使用部分或全部服务。
未成年人保护:若您未满18周岁,请在法定监护人的陪同下阅读本协议,并在征得监护人同意后使用本服务。
三、 服务内容与规范
知识库查阅权限:会员登录后,有权按照其会员等级对应的权限范围,在线浏览、检索本网站知识库中的相关文章及内容。
服务变更:我们有权根据业务发展需要,调整、变更或终止部分服务内容,并将以网站公告、公众号消息等方式提前通知。
禁止行为:您在使用服务时不得实施以下行为:
利用技术手段批量爬取、下载、转存知识库内容;
将知识库内容用于商业目的或未经授权地向第三方传播;
干扰本网站正常运行或侵犯其他用户合法权益;
发布违法违规信息或从事违反公序良俗的活动。
四、 知识产权声明
权利归属:本网站知识库中的排版设计、软件代码等内容的知识产权均归【公司全称】或原权利人所有,受《中华人民共和国著作权法》等法律保护。
有限许可:本网站授予会员一项非独占、不可转让、不可转授权的普通许可,仅限于个人学习、研究之目的在线查阅知识库内容。
侵权追责:未经书面许可,任何单位或个人不得以任何形式复制、转载、摘编、镜像、汇编或以其他方式使用上述内容。一经发现,我们保留追究其法律责任的权利。
五、 个人信息保护
我们重视对您个人信息的保护。关于我们如何收集、使用、存储和保护您的个人信息,请单独阅读 《隐私政策》。
您通过微信公众号授权或手机号验证所提供的信息,我们将严格按照《个人信息保护法》的规定处理,仅用于身份识别、服务提供及安全验证等必要用途。
您可以随时通过网站设置或联系客服行使查阅、更正、删除个人信息及撤回授权同意的权利。
六、 免责声明
内容准确性:知识库内容仅供参考,不构成专业建议。我们不对其完整性、准确性、时效性作任何明示或暗示的保证,您应自行判断并承担使用风险。
不可抗力:因自然灾害、政策法规变化、网络故障、第三方平台接口异常(如微信接口维护、运营商短信通道故障)等不可抗力导致的服务中断或延迟,我们不承担违约责任。
第三方链接:本网站可能包含指向第三方网站的链接,该等网站的内容和服务不受我们控制,请您自行甄别风险。
七、 违约责任
如您违反本协议约定,我们有权视情节采取警告、限制功能、暂停服务、注销账号等措施,并保留要求赔偿损失的权利。
如因您的违约行为导致我们遭受行政处罚、第三方索赔或商誉损失,您应承担全部赔偿责任(包括但不限于罚款、赔偿金、律师费、公证费等)。
八、 法律适用与争议解决
本协议的订立、执行和解释均适用中华人民共和国大陆地区法律。
因本协议产生的或与本协议有关的任何争议,双方应友好协商解决;协商不成的,任何一方均可向【公司所在地】有管辖权的人民法院提起诉讼。
九、 其他
本协议构成双方就本服务达成的完整协议,取代此前任何口头或书面约定。
本协议任一条款被认定为无效或不可执行的,不影响其他条款的效力。
我们对本协议享有最终解释权,并在法律允许的范围内保留随时修改的权利。修改后的协议一经公布即生效,继续使用服务即视为同意修订内容。