微信扫码
添加专属顾问
我要投稿
字节跳动开源的革命性桌面控制工具,自然语言操作电脑,提升办公效率。 核心内容: 1. UI-TARS Desktop的介绍与开源信息 2. 详细的安装与配置步骤 3. 使用UI-TARS进行自然语言控制电脑的操作示例
❝本文预计阅读时间:2分钟
UI-TARS是bytedance(字节跳动)开源的,基于视觉语言模的 GUI 代理应用程序,允许使用自然语言控制计算机。
❝详情:https://github.com/bytedance/UI-TARS-desktop
访问下载地址:https://github.com/bytedance/UI-TARS-desktop/releases/tag/v0.1.2选择对应的安装程序。安装都是一直下一步,此处省略。
安装完毕后,点击图标打开UI-TARS:
使用UI-TARS需要火山引擎支持,访问https://www.volcengine.com/product/ark:使用手机号登录:
登录到火山引擎界面:
点击“API Key管理”--->“创建API key”:
自定义一个名称,点击“创建”:
创建完毕后,点击小眼睛,可以查看key:
点击“复制”按钮,将key保留备用:
❝参考:https://github.com/bytedance/UI-TARS-desktop/blob/main/docs/quick-start.md#doubao-15-ui-tars-on-volcengine
点击“Settings”,除了API Key之外,其他内容参照如下:因为使用了指定的豆包大模型,需要在火上引擎中开通服务。
在火山引擎中,点击“开通管理”,找到指定的大模型,点击“开通服务”:开通时会提示地区,默认即可:
配置完毕后,可以通过对话框发送任务,比如:此时,UI-TARS会调用浏览器查找内容,返回结果:
❝这个过程它会操作浏览器,将获取到结果返回。
更多妙用,大家可自行摸索。
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2026-01-11
Obsidian CEO 亲自下场!开源 obsidian-skills,4 天狂揽 4.6K Star!
2026-01-10
唐杰、杨植麟、姚顺雨、林俊旸罕见同台分享,这3个小时的信息密度实在太高了。
2026-01-10
阿里巴巴发布全新开源语音交互大模型 :Fun-Audio-Chat
2026-01-10
GitHub 上 2300 人 Star 的 Claude Code 可视化工作流编辑器。
2026-01-10
7.3K Star!港大开源神作,集问答、可视化、出题于一身的 AI 超级导师!
2026-01-10
AI玩法的尽头是Skills!3.6万人收藏的Claude官方SOP,你必须要掌握
2026-01-09
刚刚!Claude Code 官方开源,AI 写的屎山终于有救了!
2026-01-09
阿里开源 Assistant Agent,助力企业快速构建答疑、诊断智能助手
2025-11-19
2025-10-20
2025-10-27
2025-10-27
2025-12-10
2025-11-17
2025-10-29
2025-11-07
2025-12-22
2025-10-21
2026-01-02
2025-12-24
2025-12-22
2025-11-12
2025-11-10
2025-11-03
2025-10-29
2025-10-28