Physical Address
304 North Cardinal St.
Dorchester Center, MA 02124
Physical Address
304 North Cardinal St.
Dorchester Center, MA 02124
有趣分享
有趣分享

剪视频不想为了自动字幕购买会员?可以试试开源AI字幕工具 FlyCut Caption。基于Whisper,支持本地语音转字幕、字幕编辑以及SRT、JSON导出,Windows和macOS均可使用。

现在剪视频,自动识别字幕已经成为非常常见的需求。
尤其是做短视频、YouTube、TikTok、B站或者小红书视频时,手动一句一句添加字幕实在太浪费时间。
但如果只是偶尔剪几个视频,又不想为了一个自动字幕功能专门购买会员,其实还有一个比较简单的选择。
最近在 GitHub 上发现了一个开源 AI 字幕工具:
FlyCut Caption。
它基于 Whisper 语音识别模型,可以直接在电脑上生成视频字幕,而且支持可视化编辑和字幕导出。
对于偶尔剪视频、需要快速生成字幕的人来说,还是挺方便的。
FlyCut Caption 是一个基于 Whisper 的 AI 字幕工具,主要解决的是:
把视频里的语音自动转换成字幕。
和传统的视频剪辑软件相比,它更专注于字幕生成和处理。
它最大的特点之一是:
可以进行本地 AI 处理。
也就是说,视频可以直接在自己的电脑上进行处理,不需要把视频内容上传到第三方云端服务器。
对于涉及私人视频、课程素材或者一些不希望上传云端的视频来说,本地处理会更加方便。
项目地址:
GitHub:
https://github.com/x007xyz/flycut-caption
官网:
https://caption.flycut.co/en
FlyCut Caption 使用 Whisper 进行语音识别。
基本工作流程非常简单:
导入视频 → AI 自动识别语音 → 生成字幕 → 检查修改 → 导出
对于普通的视频内容来说,不需要自己从头开始输入字幕。
尤其是:
这类以人声为主的视频,都比较适合使用自动语音识别。
当然,任何 AI 语音识别工具都不可能保证 100% 准确。
如果视频存在背景音乐、多人同时说话、方言、口音或者录音质量较差的情况,生成字幕后最好还是检查一遍。
很多自动字幕工具的问题是:
识别完成以后,还得把字幕文件导出来,再进入其他软件重新编辑。
FlyCut Caption 本身提供了可视化编辑功能。
生成字幕之后,可以直接对字幕内容进行修改,并查看对应的视频效果。
例如:
对于简单的视频字幕制作来说,可以减少在多个软件之间来回切换的麻烦。
这是 FlyCut Caption 比较值得关注的一点。
传统的在线字幕工具通常需要:
上传视频 → 云端处理 → 下载结果
如果视频比较大,不仅上传需要时间,还需要考虑视频内容是否适合上传到第三方服务器。
而本地 AI 字幕工具的思路完全不同。
视频文件直接留在自己的电脑上,由本地环境进行处理。
对于一些比较注重隐私的用户来说,这种方式会更加安心。
尤其是:
使用本地工具可以减少把原始视频上传到第三方平台的需求。
如果你只是想把字幕烧录到视频里,直接使用编辑器处理即可。
但如果你还需要单独保存字幕文件,那么字幕导出功能就很重要。
FlyCut Caption 支持包括 SRT、JSON 等格式。
其中 SRT 是非常常见的字幕格式,可以被很多视频播放器和剪辑软件使用。
这意味着你可以把自动识别出来的字幕保存下来,再用于其他视频制作流程。
例如:
视频 → AI 识别 → 导出 SRT → 导入其他剪辑软件
对于已经有固定剪辑工作流的人来说,会比较方便。
Whisper 是一个非常知名的开源语音识别模型。
它的用途并不只是生成字幕,还可以用于:
因此,基于 Whisper 开发的字幕工具一直比较受欢迎。
它最大的优势之一,就是可以让开发者把成熟的语音识别能力整合到自己的桌面工具或者工作流中。
FlyCut Caption 就属于这种应用。
你不需要自己研究 Whisper 的命令行参数,也不需要从头搭建语音识别环境。
直接使用图形化工具完成字幕生成即可。
如果你是专业视频团队,每天需要处理大量素材,那么可能会有更加完整的视频后期工作流。
但如果你属于下面这些情况:
一个月只剪几个视频。
偶尔做 YouTube 视频。
偶尔做小红书、B站或者 TikTok。
只是需要自动生成字幕。
那么为了一个自动字幕功能购买完整的视频剪辑会员,确实不一定划算。
这种情况下,本地免费的 AI 字幕工具反而更加直接。
尤其是已经有其他剪辑软件的人,可以把 FlyCut Caption 当成一个独立的字幕生成工具。
一个比较简单的工作流是:
把需要添加字幕的视频准备好。
最好保证录音比较清晰,背景噪音不要太大。
将视频导入工具。
让 Whisper 对视频中的语音进行识别。
等待字幕生成。
AI 自动生成的内容建议人工快速检查一次。
重点检查:
根据自己的视频风格调整字体、颜色和位置。
需要字幕文件时,可以导出 SRT、JSON 等格式。
需要成片时,也可以直接使用编辑功能完成后续处理。
简单来说,可以这样理解:
| 功能 | FlyCut Caption |
|---|---|
| AI 自动字幕 | ✅ |
| Whisper | ✅ |
| 本地处理 | ✅ |
| 可视化字幕编辑 | ✅ |
| 字体调整 | ✅ |
| 颜色调整 | ✅ |
| 字幕位置调整 | ✅ |
| SRT 导出 | ✅ |
| JSON 导出 | ✅ |
| Windows | 支持 |
| macOS | 支持 |
它并不是要完全取代专业的视频剪辑软件。
它更像是:
一个专门解决 AI 自动字幕问题的轻量工具。
如果你搜索这类工具,可能最先想到的是剪映、Premiere Pro、CapCut 等完整的视频编辑软件。
但实际上,“自动生成字幕”本身就是一个独立需求。
很多时候,你并不需要一个拥有几十种特效的视频编辑器。
你只是想:
把一个视频快速变成带字幕的视频。
这种情况下,一个专门负责 AI 语音识别和字幕处理的工具可能反而更加简单。
特别是已经习惯使用其他剪辑软件的人,可以把自动字幕和视频剪辑分开处理。
FlyCut Caption 是一个可以关注的开源 AI 字幕项目。
如果你想自己研究项目代码,可以直接访问 GitHub:
项目地址:
https://github.com/x007xyz/flycut-caption
如果只是想直接体验,可以访问:
官方网站:
https://caption.flycut.co/en
建议根据项目页面提供的最新版本和系统要求进行安装。
由于开源项目会持续更新,具体功能、安装方式和系统支持情况也可能随着版本变化。
自动字幕已经是 AI 视频工具里非常成熟的一类功能。
但对于普通用户来说,真正需要的可能并不是一套复杂的视频制作平台,而只是:
把视频丢进去 → 自动识别语音 → 修改几个错误 → 导出字幕。
FlyCut Caption 的思路就是把这件事情尽量简单化。
它基于 Whisper,支持本地 AI 处理,同时提供字幕编辑以及 SRT、JSON 等格式导出。
如果你平时只是偶尔剪视频,又希望寻找一个免费、本地化、开源的 AI 字幕工具,可以把 FlyCut Caption 收藏起来。
GitHub 上还有很多类似的 AI 视频、音频和字幕开源项目,很多工具其实并不需要订阅会员才能体验。
有时候,一个小型开源项目,反而刚好能解决你最需要的那个问题。