微信扫码
添加专属顾问
我要投稿
小红书开源的中文语音转文字神器,一键整合包带Web UI和API,方便易用。 核心内容: 1. FireRedASR项目介绍及优势对比 2. Web UI界面和Windows预打包版使用指南 3. 源码安装步骤和API调用方法
FireRedASR 是小红书开源的一个高度精确的中文语音转文字项目,在多个对比维度上都优于 whisper/funasr等。
为此创建了一个带有 webui界面,并兼容 OpenAI SDK格式的封装,同时提供了一个win下的整合包,以方便使用。
开源地址: https://github.com/jianchang512/fireredasr-ui
启动后默认地址: http://127.0.0.1:5078
win10/11 提供了预打包版。
123网盘下载地址: https://www.123684.com/s/03Sxjv-xzTJ3
解压后双击 启动.bat 即可
确保已安装 python3.10 、ffmpeg
进入某个目录下,打开终端
git clone https://github.com/jianchang512/fireredasr-ui.gitcd FireRedASRpython3 -m venv venv. venv/bin/activatepip3 install -r requirements.txt/pretrained_models/FireRedASR-AED-L文件夹内默认地址: http://127.0.0.1:5078/v1
OpenAI SDK中使用
from openai import OpenAI
client = OpenAI(api_key='123456',
base_url='http://127.0.0.1:5078/v1')
audio_file = open("5.wav", "rb")
transcript = client.audio.transcriptions.create(
model="whisper-1",
file=audio_file,
response_format="json",
timeout=86400
)
print(transcript.text)如下图在 OpenAI语音识别及兼容API中填写,然后在语音识别渠道中选择OpenAI语音识别
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2026-02-06
Qwen3-Coder-Next 上线模力方舟:仅 3B 激活参数,媲美主流大模型的 Agent 编码能力
2026-02-06
给自己搭一个 AI 搭档:OpenClaw 安装使用全记录
2026-02-06
Qwen3-TTS:2026年最强开源文本转语音模型完全指南
2026-02-06
OpenClaw 爆火之后,我们看到了这些创业信号
2026-02-05
从Clawdbot到OpenClaw:爆款本地AI Agent的产品逻辑与争议
2026-02-05
Clawdbot 如何实现像人一样的长期记忆?
2026-02-05
全球最多下载中文开源数据集更新|OpenCSG持续打造中文高质量数据集开源底座
2026-02-05
【开源】12.1K Star!用 Markdown 给大模型装上“外挂大脑”,不写后端、不搭平台,这个开源项目让你用 Git 管理 AI 任务流
2025-11-19
2026-01-27
2025-12-22
2026-01-12
2026-01-29
2025-12-10
2025-11-17
2026-01-28
2025-12-23
2026-01-06
2026-02-05
2026-01-28
2026-01-26
2026-01-21
2026-01-21
2026-01-20
2026-01-16
2026-01-02