原生M芯片GPU加速自动生成字幕。生成可在FCP中任意调整的FCPXML格式字幕。解决原生SRT导入FCP难以编辑的痛点。用AI结合文案解决音频转字幕后文字有错别字的问题。
做这个工具的初衷其实很简单——我懒得一条条打字幕。 但做着做着发现,很多剪辑师都在忍受同样的事情。FCPX 文件格式晦涩难懂,SRT 与 FCPX 之间存在巨大的功能鸿沟。本地的 AI 模型越来越强,跑在 M 芯片上又快又省电,为什么不利用起来?
音频 → Whisper 语音识别 → 文案对齐校正 → LLM 翻译 → 原生 FCPXML 字幕
补充说明:站长的开发环境为MacBook Pro M4 16+512 2024 Sequoia 15.7.5 在此系统上测试了全流程通过,所以环境仅供参考。由于没有更多系统版本的机器、系统可供测试,拿到软件的,请自行测试。 Final Cut Pro 版本:在 11.2 和 12.3 两个版本中测试通过。 Intel 版的Mac 机器就不要试了,跑不起来的,架构不一样。
安装说明:
1、下载程序安装和模型包,模型包需解压放到任意目录
2、程序第一次打开后,需要激活
3、成功激活后,需要进设置,指定语音识别模型和翻译模型目录并验证
4、成功进入之后,第一步需要指定音频语言、生成字幕的语言
5、第一步导入语音,直接生成。生成后右侧有预览,可以每条进行编辑
6、若您有和语音配套的文案文字,那是极好的,直接再载入文案,程序会自动根据文案自动校正。