工具 · 全在浏览器里跑 · 更新于 2026-09-06

字幕格式转换:SRT、VTT、纯文本 — 文件不离开这个标签页。

选一个字幕文件或直接粘文本,选输出格式,按转换。它读 SRT 和 WebVTT,写 SRT、WebVTT 或去掉时间的纯文本;字幕整体快了或慢了几秒,填个偏移就能把每一句一起挪。它还管大多数转换器会弄坏的那一种:第一行原文、第二行译文的双语字幕 — 两行原样保留,或者拆成两个文件,一个语言一个。不上传:文件由浏览器自己读、在这个标签页里转、不发往任何地方。不用注册,没有大小限制(除了你自己的内存),输出不带水印。

SRT 或 WebVTT。粘进来,或选一个文件 — 都只在这个标签页里。

 

文件用浏览器自带的 FileReader 读,不上传、不存盘、不记日志。

双语两行:要么都留,要么拆成两个文件

会议、课、演讲的字幕很多是双语的:第一行原文,第二行译文。这个形状很脆。把一句当成「一串字」处理的转换器会把两行压成一行,有些直接丢掉换行后的内容 — 得到一个看上去转成功、实际上少了一半的文件。

这一页按原样保留行结构。在此之上,保留哪几行这个选项做了一件搜索首页那些转换器都不做的事:只要第一行写出单语言的原文,只要第二行把译文单独写成一个文件,时间轴一样。一份双语存档变成两份干净的交付物 — 一份给视频平台,一份给只读译文的人。

选中的那一行为空的句子会被丢掉,而不是写成空行;SRT 的编号重新生成,所以输出是一个合法文件,不是一个带洞的文件。

字幕和声音对不上的时候

最常见的是整体偏移:有人把录像开头剪掉了三秒,或者字幕开晚了。把偏移量填进去 — 负数把字幕往前拉,正数往后推 — 所有时间戳跟格式转换一起完成。

另一种是越到后面偏得越多(拉伸),那不是加法能解决的,得对着音频重新对时,这一页不做。

它不做的事

不翻译。不从音频转写。不处理 ASS/SSA 样式,不把字幕烧进视频,没有云端队列要等。它读 SRT 和 WebVTT,WebVTT 的样式块和时间戳后面的 cue 参数会被忽略而不是搬过去。

如果你缺的其实是那份速记本身 — 一场会边开边变成双语字幕、完了存下来 — 那是另一种工具:Voice Translator 在 Mac 上给英文会议出双语字幕,存档正是这一页乐意转的那种文件;它的实测延迟在数据页

常见问题

SRT 和 VTT 差在哪?+

都是纯文本字幕,思路一样:开始时间、结束时间、要显示的行。SRT 给每句编号,毫秒用逗号(00:00:01,000);WebVTT 文件头是 WEBVTT,毫秒用句点(00:00:01.000),不用编号,是 HTML5 video 直接认的格式。互转主要是标点的事,所以在浏览器里就能做完。

文件会上传到服务器吗?+

不会。选文件是交给浏览器的 FileReader 在本地读,转换是这个标签页里的 JavaScript 在做。什么都不发出去,关上页也不剩。字幕这件事上这比平时重要:一份会议速记,往往是一个人手里最敏感的文件。

能顺便把字幕翻译了吗?+

不能,也不装。这一页只转格式、只挪时间。如果你的文件本来就是双语(第一行原文、第二行译文),它会把两行都留着,选「只要第二行」就把译文单独导成一个文件。这种文件是实时字幕工具(比如 Voice Translator)产出的,不是这一页产出的。

字幕比声音慢两秒,能在这里修吗?+

能。平移填 -2 再转换,每一句的起止时间都往前挪两秒,挪到负数的归零;字幕快了就填正数。平移和格式转换一趟做完,不用转两次。

相关:讲稿要讲多久 · Mac 即时字幕怎么开 · 字幕延迟实测