自动生成字幕
识别视频或音频中的语音,生成带时间轴的字幕文件,可下载 SRT 或 VTT。
模型与文件均不离开设备,识别精度以 Base 模型为推荐
完全免费
所有功能免费开放,不限制次数、时长与文件数量,导出无水印。
隐私安全
处理全程在你的浏览器本地完成,文件不会被上传到任何服务器。
在线预览
处理完成后直接在页面里预览效果,确认满意再下载保存。
在线工具
无需下载安装任何软件或插件,打开网页即可使用,手机电脑都支持。
简单易用
界面直观、步骤清晰,不需要任何专业的视频编辑经验。
格式支持丰富
覆盖 MP4、MOV、MKV、WebM、AVI 等常见封装与编码,少见格式也能处理。
为什么要自动生成字幕
识别视频或音频中的语音,生成带时间轴的字幕文件,可下载 SRT 或 VTT。
与「视频转文字」共用同一条本地推理链路,区别在于输出:识别结果按时间分段序列化为字幕文件,可下载 SRT(通用)或 VTT(Web 播放器)。
生成后建议抽查时间轴:语速极快或停顿极少的段落分句可能偏长,可用「字幕时间轴校正」微调,或在剪辑软件中继续编辑。
转录基于 OpenAI Whisper 模型的 ONNX 移植版,在浏览器内通过 WebAssembly 推理:先由本地 FFmpeg 提取 16kHz 单声道音频,再按 30 秒分块送入模型生成带时间戳的文本。模型与音视频数据均不离开设备,首次使用需下载模型权重(tiny 约 40MB,base 约 78MB)。
处理全程在浏览器本地完成,文件不上传服务器。
如何在线使用自动生成字幕
有疑问?查看常见问题
点击选择或拖入本地文件,文件不上传服务器。
按需调整选项,默认值适用于大多数场景。
处理在浏览器本地完成,首次使用需加载处理引擎。
处理完成后可在线预览,确认后保存到设备。
常见问题
准备好使用自动生成字幕了吗?
无需注册、免费无水印,全程在你的浏览器本地完成。
相关指南
给视频加字幕的三种方式:软字幕轨、硬字幕与外挂文件
工作流 · 约 8 分钟
本地处理与上传处理:在线视频工具的两种架构
技术原理 · 约 7 分钟
自动字幕的准确率:影响因素与提升技巧
参数调优 · 约 6 分钟
会议纪要:录音转文字并导出文稿的本地做法
工作流 · 约 6 分钟
会议软件录像怎么导出:钉钉/腾讯会议/飞书的文件与转码
平台规则 · 约 6 分钟
视频声音有杂音怎么消除:风噪、底噪与降噪参数
参数调优 · 约 6 分钟
多段录音怎么合并成一条
工作流 · 约 5 分钟
视频转播客:提取音频做播客节目的完整链路
工作流 · 约 7 分钟
剪掉冷场:自动删除视频里的静音段
工作流 · 约 6 分钟
视频字幕翻译流程:识别、翻译与回挂
工作流 · 约 6 分钟
口播视频后期:剪口误、上字幕到发布
工作流 · 约 4 分钟
视频转字幕:语音识别生成 SRT 的完整链路
工作流 · 约 5 分钟
语言学习素材:截取、慢放与双语字幕的本地做法
工作流 · 约 5 分钟