软件介绍
CapsWriter-Offline ,一个 PC 端的语音输入、字幕转录工具。
按下键盘上的 大写锁定键,录音开始,当松开 大写锁定键 时,就会识别你的录音,并将识别结果立刻输入
将音视频文件拖动到客户端打开,即可转录生成 srt 字幕
图片预览

特性
- 完全离线、无限时长、低延迟、高准确率、中英混输、自动阿拉伯数字、自动调整中英间隔
- 热词功能:可以在
hot-en.txt hot-zh.txt hot-rule.txt中添加三种热词,客户端动态载入 - 日记功能:默认每次录音识别后,识别结果记录在
年份/月份/日期.md,录音文件保存在年份/月份/assets - 关键词日记:识别结果若以关键词开头,会被记录在
年份/月份/关键词-日期.md,关键词在keywords.txt中定义 - 转录功能:将音视频文件拖动到客户端打开,即可转录生成 srt 字幕
- 服务端、客户端分离,可以服务多台客户端
- 编辑
config.py,可以配置服务端地址、快捷键、录音开关……
懒人包
对 Windows 端:
- 请确保电脑上安装了 Microsoft Visual C++ Redistributable 运行库
- 服务端载入模型所用的 onnxruntime 只能在 Windows 10 及以上版本的系统使用
- 服务端载入模型需要系统内存 4G,只能在 64 位系统上使用
- 额外打包了 32 位系统可用的客户端,在 Windows 7 及以上版本的系统可用
- 模型文件较大,单独打包,解压模型后请放入软件目录的
models文件夹中
其它系统:
- 其它系统,可以下载模型、安装依赖后从 Python 源码运行。
- 由于我没有 Mac 电脑,无法打包 Mac 版本,只能从源码运行,可能会有诸多问题要解决。(由于系统限制,客户端需要 sudo 启动,且默认快捷键为
right shift)
模型说明:
- 由于模型文件太大,为了方便更新,单独打包
- 解压模型后请放入软件目录的
models文件夹中
功能:日记、关键词
默认每次语音识别结束后,会以年、月为分类,保存录音文件和识别结果:
- 录音文件存放在「年/月/assets」文件夹下
- 识别结果存放在「年/月/日.md」Markdown 文件中
功能:转录文件
在服务端运行后,将音视频文件拖动到客户端打开,即可转录生成四个同名文件:
json文件,包含了字级时间戳txt文件,包含了分行结果merge.txt文件,包含了带标点的整段结果srt文件,字幕文件
如果生成的字幕有微小错误,可以在分行的 txt 文件中修改,然后将 txt 文件拖动到客户端打开,客户端检测到输入的是 txt 文件,就会查到同名的 json 文件,结合 json 文件中的字级时间戳和 txt 文件中修正结果,更新 srt 字幕文件。
注意事项
- 当用户安装了
FFmpeg时,会以mp3格式保存录音;当用户没有装FFmpeg时,会以wav格式保存录音 - 音视频文件转录功能依赖于
FFmpeg,打包版本已内置FFmpeg - 默认的快捷键是
caps lock,你可以打开core_client.py进行修改 - MacOS 无法监测到
caps lock按键,可改为right shift按键
修改配置
你可以编辑 config.py ,在开头部分有注释,指导你修改服务端、客户端的:
- 连接的地址和端口,默认是
127.0.0.1和6006 - 键盘快捷键
- 是否要保存录音文件
- 要移除识别结果末尾的哪些标点,(如果你想把句尾的问号也删除掉,可以在这边加上)
软件下载
常见问题
发电或者订阅后怎么下载资源?
未注册直接发电或者注册订阅后,刷新文章,点击立即下载按钮,跳转到下载页面!若还是不行,请直接添加小编QQ处理!
资源支持商用吗?
不支持商用,仅供学习,请下载后24H内删除!
资源为什么不能使用?
资源有时效性及各种方面的兼容性,不保证一直都能用!
有问题如何联系?
1、评论留言 2、用户中心提交工单 3、联系小编QQ:429413218(09:00 -21:00)
免责声明



评论0