微信扫码
添加专属顾问
我要投稿
百聆是强大的开源 AI 语音对话助手,时延低,功能全。这是小贤看到的关于语音助手最好的推荐,没有之一。 核心内容: 1. 百聆的技术核心与功能亮点 2. 百聆适用的多种应用场景 3. 百聆的主要功能及技术原理
百聆(Bailing)是一款开源的语音对话助手,基于语音识别(ASR)、语音活动检测(VAD)、大语言模型(LLM)和语音合成(TTS)技术,能够与用户进行自然的语音对话。百聆的端到端时延低至800ms,无需GPU即可运行,适用于各种边缘设备和低资源环境。
百聆通过模块化设计,支持记忆功能、工具调用和任务管理,提供高质量的语音对话体验。其核心目标是在低资源环境下实现类GPT-4o的对话效果,适用于智能家居、个人助理、车载系统等多种场景。
git clone https://github.com/wwbin2017/bailing.git
cd bailing
pip install -r requirements.txt
config/config.yaml 文件,配置ASR、LLM等相关参数。SenseVoiceSmall 模型到 models/SenseVoiceSmall 目录。deepseek 的 api_key 并配置到项目中。cd server
python server.py # 启动后端服务
python main.py
启动后,系统会等待语音输入,通过FunASR将语音转为文本,silero-vad进行语音活动检测,deepseek生成回复,最后通过edge-tts将文本转换为语音输出。
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2026-02-11
后发先至,新模型发布,全球进入DeepSeek狂欢周,连珠炮响了!
2026-02-11
Agent “案底”可追溯:前 GitHub CEO 再创业,把思考过程写进 Git
2026-02-11
GitHub 上狂揽 1.3 万 Star!港大开源的轻量版 Clawdbot。
2026-02-11
OpenClaw近一半用户来自中国,大家在FOMO什么?
2026-02-11
从Manus到Clawdbot:被动到主动,满足供给到提供需求
2026-02-11
“AI 女友”也能开源?基于 OpenClaw 的「AI 女友 Clawra」破圈了,还能发自拍!
2026-02-11
Google 悄悄开源了一个「数据提取神器」,3 行代码干掉你 500 行正则
2026-02-11
云上OpenClaw的5种正确打开方式,光联网做日报就落后N个版本了
2025-11-19
2026-01-27
2026-01-29
2026-01-12
2025-12-22
2026-01-30
2025-11-17
2025-12-10
2026-01-28
2025-12-23
2026-02-11
2026-02-05
2026-01-28
2026-01-26
2026-01-21
2026-01-21
2026-01-20
2026-01-16