windows字幕识别方案:buzz

前言

在之前我介绍了linux字幕识别方案 ,而在windows上选择会更多一点,最早我是使用剪映生成字幕,不过很多国内公司开发的一些剪辑软件都是有字幕识别功能的,不过很多都是导出需要vip,而且在字幕识别的过程中也会把音频上传到云端,导致需要连接网络才可以使用这个功能,这对于一些在没有网络条件的情况下就很不方便,而且这些都是不安全的闭源软件,我是不太信任国内以盈利性为目的的商业闭源软件,这些软件安装在我的电脑上我认为我的电脑一定会被”污染”,数据安全和硬件安全也会受到威胁(个人观点,不认可自动忽略),所以相当于使用处处需要vip的国内剪辑软件,我更偏向于使用国外的pr和ae,这是不可否认的,所以我就需要一个可以免费字幕识别可以导出的软件,最好是开源的软件,所以我在github上找到了一个项目-buzz

buzz是什么

Buzz 可以在你的个人电脑上离线转录和翻译音频。由 OpenAI 的 Whisper 提供技术支持

下载安装

项目链接:
https://github.com/chidiwilliams/buzz
官方网站:
https://chidiwilliams.github.io/buzz/docs
发布页面:
https://github.com/chidiwilliams/buzz/releases

我们打开发布页面,选择最新版本下载Buzz-版本号-windows.exe和Buzz-版本号-windows-1.bin还有Buzz-版本号-windows-2.bin(后两个安装过程中需要),下载完成后按照安装程序的引导安装,记得不要把软件安在系统盘上面

配置

打开软件,我们在使用之前需要下载模型(下载过程需要霍格沃兹网络环境没有的自行解决),打开左上方的帮助,选择偏好设置,选择模型选项你会看见很多模型,需要根据自身电脑硬件来选择这里推荐最低选择small,准确度可接受,不过还是需要人工修改一些(主要是普通话要说的标准点(-:),选择需要的模型点击右下方的下载,等待下载完成后即可使用

使用

点击主界面的加号,选择需要的素材,然后选择模型和语言还有文件格式,模型选择适合电脑性能的,语言选择中文,文件格式选择SRT,然后点击开始执行,不过你可能会发现字幕文件全是繁体中文,如果你是繁体中文爱好者你可以忽略,如果你很在意就在开始执行之前的界面选择高级,在初始提示添加翻译成中国大陆简体中文就可以了

图片演示