微信扫码
添加专属顾问
我要投稿
小红书开源的中文语音转文字神器,一键整合包带Web UI和API,方便易用。 核心内容: 1. FireRedASR项目介绍及优势对比 2. Web UI界面和Windows预打包版使用指南 3. 源码安装步骤和API调用方法
FireRedASR 是小红书开源的一个高度精确的中文语音转文字项目,在多个对比维度上都优于 whisper/funasr等。
为此创建了一个带有 webui界面,并兼容 OpenAI SDK格式的封装,同时提供了一个win下的整合包,以方便使用。
开源地址: https://github.com/jianchang512/fireredasr-ui
启动后默认地址: http://127.0.0.1:5078
win10/11 提供了预打包版。
123网盘下载地址: https://www.123684.com/s/03Sxjv-xzTJ3
解压后双击 启动.bat 即可
确保已安装 python3.10 、ffmpeg
进入某个目录下,打开终端
git clone https://github.com/jianchang512/fireredasr-ui.gitcd FireRedASRpython3 -m venv venv. venv/bin/activatepip3 install -r requirements.txt/pretrained_models/FireRedASR-AED-L文件夹内默认地址: http://127.0.0.1:5078/v1
OpenAI SDK中使用
from openai import OpenAI
client = OpenAI(api_key='123456',
base_url='http://127.0.0.1:5078/v1')
audio_file = open("5.wav", "rb")
transcript = client.audio.transcriptions.create(
model="whisper-1",
file=audio_file,
response_format="json",
timeout=86400
)
print(transcript.text)如下图在 OpenAI语音识别及兼容API中填写,然后在语音识别渠道中选择OpenAI语音识别
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2025-10-28
腾讯开源Nano Banana,我总结了15种邪修玩法(附提示语)
2025-10-28
牛逼,DeepSeek-OCR 最新免费,引爆文档处理效率的黑科技模型
2025-10-28
小红书入局AI智能体开源DeepAgent,在计划什么更新?
2025-10-27
锦秋基金被投企业Pokee AI 推 7B 研究智能体 PokeeResearch,RLAIF + 推理脚手架重塑深度研究
2025-10-27
终于有个简单的办公Agent入门教程了,京东云JoyAgent上大分
2025-10-27
发现一个超神的Github开源OCR项目,国产多模态杀疯了
2025-10-27
MiniMax悄悄发布M2,8%价格打出Claude级性能
2025-10-25
Agent从0到1落地实施:以「小智伴」为例,产品需求(一)
2025-08-20
2025-09-07
2025-08-05
2025-08-20
2025-07-31
2025-08-26
2025-08-22
2025-07-31
2025-09-06
2025-08-06
2025-10-28
2025-10-13
2025-09-29
2025-09-17
2025-09-09
2025-09-08
2025-09-07
2025-09-01