# 本地语音识别工具Voice Recognition to Text Tool

*Published:* 2024-01-10
*Author:* 客服001

#### 温馨提醒

如果文章内容或图片资源失效，请留言反馈，我们会及时处理，谢谢

本文最后更新于2024年1月10日，已超过 180天没有更新



这是一个离线运行的本地语音识别转文字工具，基于 fast-whipser 开源模型，可将视频/音频中的人类声音识别并转为文字，可输出json格式、srt字幕带时间戳格式、纯文字格式。可用于自行部署后替代 openai 的语音识别接口或百度语音识别等，准确率基本等同openai官方api接口。

[![](https://www.xarjtc.com/wp-content/uploads/2024/01/94210c8a71f0d58622c6f13566005656.webp)](https://www.xarjtc.com/wp-content/uploads/2024/01/94210c8a71f0d58622c6f13566005656.webp)

 ![](https://www.xarjtc.com/wp-content/themes/ripro-v5/assets/img/logo.png)

 

GitHub地址：https://github.com/jianchang512/stt