关于这个工具
这个免费的字幕制作工具会听取你的视频内容、替你写好字幕,并让你在发布之前先改一遍。之后你可以下载 .srt 文件——每个播放器和平台都认识的标准字幕格式——或者把字幕压进画面里,让它无论发到哪儿都跟着视频走。
一切都在你的浏览器中运行:语音识别、编辑和视频编码都是。你的视频绝不会上传,无需注册,没有水印,也不限时长。
功能
- 在你自己设备上完成的、带时间轴的自动转写
- 可编辑的字幕表 —— 改文字、调时间、增删行
- 播放时叠加在视频上的实时预览
- 压进画面 —— 字幕成为画面的一部分
- 或下载 .srt / .vtt,让视频文件保持原样
- 三种字幕样式,可放在顶部或底部
- 支持 MP4、MOV、WebM、M4V 和 MKV
压进画面,还是单独的 .srt 文件?
这是唯一一个真正需要做的选择,而正确答案取决于视频要发到哪里。
.srt 文件与视频并存,由播放器实时绘制字幕,也就是说视频文件本身没有被改动——不用重新编码,没有画质损失,生成只需一瞬间。观众可以关掉字幕,搜索引擎和平台也能读到文字。YouTube、Vimeo、Facebook 以及大多数电视播放器都直接接受 .srt。如果你的视频是发到这些地方,上传 .srt 就够了。
压进画面会把字幕永久绘制到每一帧上。好处是它们丢不了、也关不掉——在字幕无法随视频传递的场合是必需的:Instagram、TikTok、嵌入式播放器、演示文稿、WhatsApp,以及任何人们静音观看的场景。代价也是实实在在的:视频必须重新编码,耗时大约与视频时长相当,会损失一点画质,而且无法撤销。
实用原则是:社交视频就压进画面,其他一律用 .srt。
关于准确率
转写由一个在你自己机器上运行的小型语音模型完成——这正是它既私密又免费的原因。它在清晰的英语语音上表现确实不错,但人名、专业术语和生僻词一定会出错。这也是字幕表就摆在播放器旁边的原因:修改只需一分钟,而不是一小时。
它最适合录音干净、一次只有一个人说话、背景音乐很少的情况。浓重的口音、多人抢话、底下压着响亮的音乐,都会拉低准确率。这个模型是用英语训练的;其他语言可能效果不佳,或者被翻译成英文输出。发布前请务必通读所有字幕。
常见用途
- 给社交平台的视频加字幕,让它在静音状态下也看得懂
- 为教程、讲座或访谈添加字幕
- 让听障观众也能看懂视频
- 生成 .srt,与 YouTube 视频一起上传
- 先拿到一份粗略的文字稿,再整理成文章
使用方法
- 上传视频 —— 点击上传区域,或把文件拖进来
- 点击"转写语音" —— 首次运行会一次性下载语音引擎
- 检查右侧的字幕,改掉识别错的词并调整时间
- 设置大小、样式和位置,边播放边看它们在画面上的效果
- 下载 .srt —— 或者点击"把字幕压进视频"然后耐心等待
需要了解
- 不会上传任何内容。 音频、文字稿和编码过程全都留在你的设备上
- 第一次转写会下载语音模型(约 40 MB),仅一次,之后会被缓存
- 压制很慢,大约是实时速度,并且相当占内存。在手机上请只处理短片,或者直接用 .srt
- 压制时首次会获取一个字体 —— 拉丁文字用小字体,韩文、日文或中文字幕则需要较大的字体,因为视频引擎本身不带任何字体
- 编辑器中的时间显示为 MM:SS,文件里则是完整精度 —— 点击某一行的播放图标可直接跳到该处
- 即使压制失败,.srt 依然可用 —— 它是独立生成的,完全不需要编码
- 压制后的视频是 H.264 的 MP4,到哪儿都能播放;音频原样复制,不做改动
- 每条字幕请控制在一到两行短句 —— 这才是观众在正常语速下真正能读完的量