微信扫码
添加专属顾问
我要投稿
小模型也能有大智慧!香港大学与NVIDIA团队开发的8B参数调度模型,在多项测试中超越GPT-5表现。 核心内容: 1. 传统智能体工作流的两大缺陷与性能瓶颈 2. ToolOrchestra框架的强化学习解决方案与三大技术突破 3. 开源项目包含完整训练数据集ToolScale及实际应用效果
香港大学与NVIDIA团队发现搭建智能体工作流的两个关键问题:仅靠提示词工程的工作流存在性能天花板,同时,静态路由策略还会导致资源浪费。
针对于此,他们通过其ToolOrchestra框架强化学习训练了一个8B参数的调度模型(Orchestrator-8B),在三个基准测试中表现突出:
研究团队发现传统工作流存在两个典型缺陷:
而ToolOrchestra的解决的核心在于端到端强化学习训练,方案上:
团队还开源了完整训练数据集ToolScale,覆盖10个领域(金融、体育、电商等),包含4063个多轮工具调用任务。数据生成采用两步流程:先模拟真实环境(数据库schema和API),再生成多样化任务。包含10个领域的数千条多轮工具调用记录。
有开发者尝试部署后反馈,在电影票务系统等需要多步操作的场景中,响应速度比传统方案快2-3倍。
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2026-05-30
企业级 AI Agent 为什么集体转向“基座 + Skills”?
2026-05-25
DeepSeek 要用蜜雪冰城的打法,做中国版 Claude Code
2026-05-25
DeepSeek V4还能更省!新工具缓存命中率高达99.82%,2折稳定到手
2026-05-25
Anthropic开源Claude小企业插件:不用写prompt,15套现成流程顶半个运营团队
2026-05-21
麻省理工团队开源GenCAD,用一张图片生成完整CAD模型与参数化程序
2026-05-21
真Agent框架生态的主语言已经变为TypeScript
2026-05-20
Hermes Agent + Ollama本地安装指南
2026-05-20
Qwen3.7来了,全球排名第13,国内第一
2026-03-30
2026-04-03
2026-04-09
2026-03-23
2026-03-03
2026-03-31
2026-04-01
2026-03-04
2026-03-09
2026-03-30
2026-05-30
2026-05-16
2026-04-22
2026-04-21
2026-04-15
2026-04-09
2026-04-01
2026-03-17