以前玩过语音识别模型Whisper,这个可以在本机跑(机器不太差有显卡就行)
但这个Whisper是命令行的,而且你不能直接喂它MP4,必须是WAV或MP3音频文件
同类软件有很多试了几个后发现这个Faster Whisper XXL GUI真不错,把相关的操作都整合一起了
Faster Whisper XXL GUI
![图片[1]-发现一款超好用的AI语音识别软件–喂它MP4,还你SRT字幕-小甘博客](https://pic.2288666.xyz/file/hf:hf_1786341170960_9hzwxc.png)
🔧使用方法:
1. 首次运行会下载相关模型文件,一般选medium就行
2. 拖入你要语音识别的MP4到input
3. 选好MP4中的语言或自动识别(auto),导出选SRT(涉及到后续翻译最好SRT)
4. 点Run等待生成即可,旁边会显示日志
5. 生成的SRT可以丢给大名鼎鼎的沉浸式翻译–>文档翻译
6. 最后拿到翻译好的SRT文件,丢到你原始的MP4下,试试看吧,恭喜你!未来的某某字幕组☺
🚀Github项目地址:
https://github.com/cbro33/Faster-Whisper-XXL-GUI
👇软件下载地址:
© 版权声明
文章版权归作者所有,未经允许请勿转载。
THE END



暂无评论内容