工作流 约 6 分钟
视频字幕翻译流程:识别、翻译与回挂
出海内容的第一道门槛是字幕。好消息是整条链路都能在本地完成:语音识别生成带时间轴的字幕、翻译只动文本不动时间、最后按需烧进画面或外挂发布。
第一步:生成源语言字幕
用本地语音识别把视频转成 SRT:模型选 Base(约 78MB,中英文识别最稳),语言明确时不要选自动检测——显式指定能显著减少把"嗯、呃"误判成实词的情况。识别完成后先通读一遍稿子,专有名词、品牌名、数字的错认在这一步修,成本最低。
SRT 是最通用的中间格式:每条字幕由序号、时间轴、文本构成,任何翻译工具和字幕软件都认识。导出后保留一份原始文件作为底稿,后面所有改动都基于副本。
第二步:翻译时只动文本
翻译的核心纪律是时间轴一个字符都不要动。SRT 的时间行格式是固定的(00:00:01,000 --> 00:00:03,500),翻译工具或人工处理时一旦破坏这个结构,整个文件作废。安全做法是把文本逐条抽出来翻,翻完按原序号填回去;用机器翻译时选择"逐句短文本"模式,不要把整个文件丢进去。
翻译质量的两个要点:一是长度——中英文字符宽度差异大,中文一句话翻成英文可能超出画面宽度,宁可口语化缩写也不要让字幕折两行;二是断句——英文按意群断句,别按中文原文的标点硬切,否则节奏感会碎掉。
第三步:回挂与发布
双语文案的常见排布是中文在上、译文在下,或者做成两条独立字幕轨。发布方式按平台选:上传平台支持字幕文件的(B 站、YouTube),外挂 SRT/VTT 最灵活,观众可开关,还能做多语言切换;需要保证任何设备都显示的(微信、部分老平台),把字幕烧进画面——字号和底部安全区要按目标平台调。
格式之间转换用字幕工具批量处理:SRT 转 VTT 供网页播放器,转 ASS 做样式化的烧录。全部流程在浏览器本地完成,未发布的成片不出电脑。