免费POC, 零成本试错
FDE知识库

FDE知识库

学习大模型的前沿技术与行业落地应用


收藏

Kimi K2.6 发布并开源,全面精进代码和 Agent 集群能力

发布日期:2026-04-21 07:20:19 浏览次数: 3311
作者:月之暗面 Kimi

微信搜一搜,关注“月之暗面 Kimi”

推荐语

Kimi K2.6 开源发布,代码与Agent集群能力全面升级,性能比肩GPT-5.4等顶级闭源模型。

核心内容:
1. 代码与视觉能力深度融合,实现专业级Web应用开发
2. Agent集群架构升级,支持300子Agent并行协作
3. 长程编码能力突破,可连续工作13小时优化复杂系统

杨芳贤
53AI创始人/腾讯云(TVP)最具价值专家

Talk is cheap. Show me the code. 

Linus Torvalds
今天,我们发布并开源 Kimi K2.6 模型,带来行业领先(state-of-the-art)的代码长程任务执行和 Agent 集群能力。
Kimi K2.6 现已上线 kimi.com最新版 Kimi 应用Kimi API 和 Kimi Code 编程助手,所有用户都可以开始使用。

( 完整基准测试成绩见技术博客 )

Kimi K2.6 的通用 Agent、代码、视觉理解等综合能力得到全面提升,其中在博士级难度的完整版人类最后的考试(Humanity's Last Exam)、在考察模型真实软件工程能力的 SWE-Bench Pro、评估 Agent 深度检索能力的 DeepSearchQA 等基准测试中均取得行业领先的成绩,持平或优于 GPT-5.4、Claude Opus 4.6 和 Gemini 3.1 Pro等闭源模型。
Kimi K2.6 是我们迄今最强的代码模型,其长程编码能力也得到显著提升,在测试中可以不间断编码 13 小时,编写或修改超过 4000 行代码,完成复杂系统的开发和优化。通过将代码与视觉能力的深度融合,K2.6 将代码驱动的设计能力提升到了新高度,可以交付极具设计创意的专业级 Web 应用
Kimi K2.6 大幅增强了 Agent 自主化执行能力,帮助我们进一步扩展 Agent 的能力范围:
  • 由 K2.6 模型驱动的「Agent 集群」架构迎来一次大升级,现在支持 300 个子 Agent 并行完成 4000 个协作步骤,实现更大规模的并行化,同时任务完成度和交付质量相比于 K2.5 有显著提升;
  • 针对 OpenClaw、Hermes Agent 等主动式 Agent 框架,K2.6 展现出极强的自动化任务处理能力,支持长达 5 天的持续自主运行
长程编码能力突破
K2.6 在长程代码任务中的表现取得了突破,面对不同编程语言(如 Rust、Go、Python)和任务场景(如前端、运维、性能优化)均具备更可靠的泛化能力。
在涵盖了多种复杂端到端任务的、Kimi 内部严格代码评测基准 Kimi Code Bench 中,K2.6 的成绩比 K2.5 提升了约 20%。
根据我们的实测,Kimi K2.6 模型在复杂软件工程任务中,展现了强大的长程推理能力:
场景一:K2.6 成功在 Mac 本地下载并部署了 Qwen3.5-0.8B 模型,通过使用小众 Zig 语言实现并优化模型推理,证明了新模型的泛化能力。经过 4,000 多次工具调用,超过 12 小时的不间断运行,K2.6 模型共迭代了 14 轮,将吞吐量从约 15 tokens/s 提升至约 193 tokens/s,最终实现比 LM Studio 快 20% 的推理速度
场景二:Kimi K2.6 自主完成了对拥有 8 年历史的开源金融撮合引擎 exchange-core 的深度重构。历经 13 小时的连续作业,模型迭代了 12 套优化策略,通过 1,000 余次工具调用,对 4,000 多行代码进行了精准修改。化身专家级系统架构师,Kimi K2.6 深入分析 CPU 及内存分配火焰图以定位隐蔽瓶颈,并大胆调整核心线程拓扑结构(由 4ME+2RE 优化为 2ME+1RE)。即便在该引擎性能已接近极限的情况下,Kimi K2.6 仍实现了 185% 的中位吞吐量跃升(由 0.43 增至 1.24 MT/s),峰值吞吐量更是大幅提升 133%(由 1.23 飙升至 2.86 MT/s)。
Baseten、Blackbox AI、CodeBuddy、Factory(Droid)、飞书妙搭、Fireworks AI、Nous Research(Hermes Agent)、Kilo Code、Ollama、OpenCode、Qoder 和 Vercel 等企业客户提前测试了 K2.6 模型,这里摘录部分来自他们的真实反馈:
首字母顺序(1-6)
插图     
插图     
插图     
插图     
插图     
插图     
 
首字母顺序(7-12)
插图     
插图     
插图     
插图     
插图     
插图     

代码驱动设计的标杆
我们相信,美本身就是一种生产力。K2.6 Agent 模式现在可以制作极具设计感和视觉冲击力的网站。
凭借对图像和视频生成工具的熟练调用,K2.6 Agent 能够生成视觉风格高度统一的素材,构建视觉焦点突出的首屏区(Hero Section),并且实现各种交互元素和丰富的滚动触发等动效。
K2.6 Agent 不局限于写前端页面,也支持基础的后端数据库模块,例如在生成网页中嵌入表单信息收集的功能。
凭借更强的多模态编程能力,K2.6 能够更精准地将图像和视频素材转化为代码:
我们创建了一套专门的前端开发设计评测基准( Kimi Design Bench),涵盖视觉输入任务、落地页构建、全栈应用开发以及通用 Web 开发这四个维度。对比 Google AI Studio 中的 Gemini 3 模型,基于 kimi.com 框架的 K2.6 Agent 展现出了非常明显的领先优势。

Agent 集群全面升级
突破单体 Agent 性能的限制,才能实现 Agent 能力的规模化扩张。「Agent 集群」是我们从 K2.5 模型开始引入的新能力——动态拆解复杂任务,自主生成专项 Agent 并行处理。
在 K2.5 的基础上,K2.6 的 Agent 集群的协同能力全面升级。Agent 集群现在可以调度不同技能特长的 Agent 互补协作,将搜索、深度研究、文档分析和长文创作等能力进行组合,任务完成质量相比于 K2.5 有显著提升。Agent 集群在单次运行中,就能独立完成从文档到网页、再到 PPT 和表格的多产物端到端交付。
此外,Agent 集群的架构也升级了,现在最多支持 300 个子 Agent 并行完成 4000 个协作步骤,实现更大规模的并行化,进一步推高多 Agent 系统协作的能力上限。
我们看两个使用案例:
案例一:Agent 集群针对全球 100 个半导体标的设计并执行了 5 套量化策略。它将麦肯锡风格的 PPT 逻辑沉淀为可复用的技能,最终交付了详尽的建模表格和一整套汇报演示文档。
案例二:Agent 集群把一篇包含海量视觉数据的高质量天体物理论文转化为可复用的学术技能。通过提取论文的推理流程和可视化方法,系统产出了 40 页、长达 7000 字的研究论文,以及包含 2 万多条数据的结构化数据集和 14 张天文级图表。
自主 Agent:与 OpenClaw/Hermes 等框架完美协同
K2.6 显著增强了 Agent 的自主化执行能力,特别是在 OpenClaw、Hermes Agent 式自动化任务中表现突出——这些场景要求 AI 能够跨应用实现 24/7 不间断运行。
与传统的对话交互不同,这类工作流需要 AI 以后台常驻 Agent 的形式主动管理任务计划、执行代码、协调跨平台操作。
我们的 RL 基础设施团队使用基于 K2.6 的 Agent 实现了连续 5 天自主运行。该 Agent 负责监控、故障响应和系统运维,展现了持久的上下文维持能力、多线程任务处理能力,以及从接收告警到彻底解决的全流程执行能力。以下是 K2.6 的工作日志(敏感信息已做匿名化处理):
K2.6 在实际使用中的可靠性有了切实提升:API 调用更加精准,长时间运行更加稳定,在执行复杂研究任务时的安全意识也得到了加强。
Kimi 内部的 Claw Bench 测试结果显示,K2.6 相比 K2.5 综合性能提升了 10%。这项基准测试涵盖五大维度:编程任务、即时通讯生态集成、信息检索与分析、定时任务管理,以及记忆调用能力。在所有评测指标上,K2.6 的任务完成率和工具调用准确率均领先 K2.5,在无需人工干预、需要长时间自主运行的工作流中优势尤为显著。
Office 办公能力持续精进
借助 K2.6 模型更强的代码和视觉理解能力,现在 Kimi Agent 模式支持创建和调用技能(Skill)。
系统已内置了上百个官方推荐技能。其中包括 Kimi 内部专家团队创建的投研技能包,通过封装机构级投资研究工作流,让用户一键生成专业排版的A股港股美股公司一页纸或者深度的投资研报,快速对一家公司上手,全方位速览公司关键基本面、行业全景和市场最关注的股价核心驱动因素。
后续我们将持续更新推荐技能库,帮助更多知识工作者实现「即插即用」,完成从找资料、理思路到出成果的全流程效率提升。
现在开始,在 Kimi Agent 模式下输入斜杠「 / 」,就可以开始创建和调用技能了。每个用户都可以从零开始,通过与 Kimi 对话创建技能。
但创建出真正实用的技能,仍然需要很多知识储备和专业能力,有很高的门槛。为了帮助大家把自己精心创建的文档轻松变成可复用的技能(Skill),Kimi Agent 已支持「Office 文档转技能」:上传高质量 Office 文档,Kimi 就会尝试理解原文档的结构与风格基因,为你生成专属的可复用文档创建技能。
One More Thing
人类通过团队协作和组织分工,创造了互联网、做出了大模型、登上了月球,AI Agent 想要帮助人类处理现实世界的复杂难题,也必然会向团队协作和组织分工的方向进化。
「Agent 集群」是我们在 AI 自动化分工方向的探索。今天将开始探索另一个方向:把人类和各种全天候 Agent 放在一个群组中,他们如何分工协作,完成一个人或一个 Agent 无法完成的任务?
这就是我们已开启小范围内测的「Claw 群组」
「Claw群组」的目标是拥抱开放、异构的生态:多个 Agent 与人类作为真正的协作者共同运行。用户可以接入来自任何设备、任何供应商、运行任何模型的全天候 Agent(首批支持 OpenClaw,后续会加入对 Hermes Agent 等框架的支持),每个 Agent 可携带各自的专业工具包、技能和持久化记忆上下文。无论是部署在本地笔记本电脑、移动设备还是云端实例,这些各异的 Agent 都能进入同一个协同办公群组。
在「Claw群组」中,K2.6 担任协调者。它根据 Agent 的技能画像和可用工具动态匹配任务,实现能力的最优配置。当某个 Agent 遇到故障或停滞时,协调者会检测到中断,自动重新分配任务或生成子任务,并对 Agent 交付物的全生命周期(从启动、验证到完成)进行主动管理。

53AI,企业落地大模型首选服务商

产品:场景落地咨询+大模型应用平台+行业解决方案

承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业

联系我们

售前咨询
186 6662 7370
预约演示
185 8882 0121

微信扫码

添加专属顾问

回到顶部

加载中...

扫码咨询

扫码登录
登录即表示您同意《53AI网站服务协议》
服务协议

欢迎您使用【53AI 官方网站】(以下简称“本网站”或“我们”)。本《会员服务协议》(以下简称“本协议”)是您(以下简称“会员”或“用户”)与【深圳市博思协创网络科技有限公司】之间关于注册、登录及使用本网站会员服务所订立的法律协议。

在您注册或登录前,请务必审慎阅读、充分理解各条款内容,特别是免除或限制责任的条款、知识产权条款、争议解决条款等。此类条款将以加粗形式提示您注意。 当您通过微信公众号授权、手机验证码验证或其他方式成功登录本网站时,即视为您已完全理解并同意接受本协议的全部内容。

一、 定义

本网站:指由【深圳市博思协创网络科技有限公司】运营的,域名为【53ai.com】的网站及相关移动端页面。

会员服务:指本网站向注册会员提供的知识库文章查阅、内容检索及其他相关增值服务。

知识库内容:指本网站发布的包括但不限于文字、图表、数据、研究报告、行业分析等数字化内容资源。

二、 账号注册与登录

登录方式:本网站支持以下登录方式,您可根据实际情况选择:

微信公众号授权登录:您同意将您的微信OpenID信息授权给本网站,用于创建或关联会员账号。

手机验证码登录:您需提供真实有效的手机号码,并通过短信验证码完成身份验证与登录/注册。

账号安全:您的账号仅限您本人使用,禁止赠与、借用、租用、转让或售卖。因您保管不善导致的账号被盗、密码泄露等损失,由您自行承担。

实名认证:根据相关法律法规要求,我们可能要求您在特定功能下完成实名认证。如您拒绝提供,可能无法使用部分或全部服务。

未成年人保护:若您未满18周岁,请在法定监护人的陪同下阅读本协议,并在征得监护人同意后使用本服务。

三、 服务内容与规范

知识库查阅权限:会员登录后,有权按照其会员等级对应的权限范围,在线浏览、检索本网站知识库中的相关文章及内容。

服务变更:我们有权根据业务发展需要,调整、变更或终止部分服务内容,并将以网站公告、公众号消息等方式提前通知。

禁止行为:您在使用服务时不得实施以下行为:

利用技术手段批量爬取、下载、转存知识库内容;

将知识库内容用于商业目的或未经授权地向第三方传播;

干扰本网站正常运行或侵犯其他用户合法权益;

发布违法违规信息或从事违反公序良俗的活动。

四、 知识产权声明

权利归属:本网站知识库中的排版设计、软件代码等内容的知识产权均归【公司全称】或原权利人所有,受《中华人民共和国著作权法》等法律保护。

有限许可:本网站授予会员一项非独占、不可转让、不可转授权的普通许可,仅限于个人学习、研究之目的在线查阅知识库内容。

侵权追责:未经书面许可,任何单位或个人不得以任何形式复制、转载、摘编、镜像、汇编或以其他方式使用上述内容。一经发现,我们保留追究其法律责任的权利。

五、 个人信息保护

我们重视对您个人信息的保护。关于我们如何收集、使用、存储和保护您的个人信息,请单独阅读 《隐私政策》。

您通过微信公众号授权或手机号验证所提供的信息,我们将严格按照《个人信息保护法》的规定处理,仅用于身份识别、服务提供及安全验证等必要用途。

您可以随时通过网站设置或联系客服行使查阅、更正、删除个人信息及撤回授权同意的权利。

六、 免责声明

内容准确性:知识库内容仅供参考,不构成专业建议。我们不对其完整性、准确性、时效性作任何明示或暗示的保证,您应自行判断并承担使用风险。

不可抗力:因自然灾害、政策法规变化、网络故障、第三方平台接口异常(如微信接口维护、运营商短信通道故障)等不可抗力导致的服务中断或延迟,我们不承担违约责任。

第三方链接:本网站可能包含指向第三方网站的链接,该等网站的内容和服务不受我们控制,请您自行甄别风险。

七、 违约责任

如您违反本协议约定,我们有权视情节采取警告、限制功能、暂停服务、注销账号等措施,并保留要求赔偿损失的权利。

如因您的违约行为导致我们遭受行政处罚、第三方索赔或商誉损失,您应承担全部赔偿责任(包括但不限于罚款、赔偿金、律师费、公证费等)。

八、 法律适用与争议解决

本协议的订立、执行和解释均适用中华人民共和国大陆地区法律。

因本协议产生的或与本协议有关的任何争议,双方应友好协商解决;协商不成的,任何一方均可向【公司所在地】有管辖权的人民法院提起诉讼。

九、 其他

本协议构成双方就本服务达成的完整协议,取代此前任何口头或书面约定。

本协议任一条款被认定为无效或不可执行的,不影响其他条款的效力。

我们对本协议享有最终解释权,并在法律允许的范围内保留随时修改的权利。修改后的协议一经公布即生效,继续使用服务即视为同意修订内容。


已查阅