字幕拼接
自动找出字幕条的字幕拼接工具
每一帧都框一次字幕区,是拼字幕里最枯燥的一半。这一个先对比所有帧,算出真正在变的那一条,只保留它。
字幕拼接工具是做什么的
字幕拼接工具把同一部电影、同一集剧或同一段视频的多张截图拼成一张长图。首图保留完整画面,让图本身还能读懂;之后的每一帧只保留字幕条,于是成品是一列台词,而不是一摞几乎一样的静帧。
输出是普通 PNG,直接发出去就行,不用再裁一遍。
时间到底花在哪一步
把图拼起来很简单。难的是决定保留哪一块 —— 每一部片的字幕条位置都不一样。手工做法的答案是给一个固定比例的默认切片,再让你拖。十张截图就是十次校正,而第十次通常就忘了。
字幕条不是一个设置项,它是一个测量结果。
它怎么找到那一条
每张截图先缩小并转成灰度,然后工具逐行对比所有帧,给每一行的变化程度打分。得分最高的那一段连续行就是字幕条。分数来自你自己的帧,所以整个过程里没有固定百分比 —— 双行字幕和单行字幕不需要不同的设置。
之后你仍然可以微调。区别在于:你是在修正一个测量结果,而不是替它做测量。
也可以直接给视频文件
QuoteStitch 也能吃视频本身。拖入 MP4、MOV 或 WEBM,它在整段里最多采样 320 个点,然后每一句台词保留一帧。最慢的那一步 —— 暂停播放器、手动截图 —— 就这样省掉了。
整个过程不读文字。它找的是「横向边缘特别密集」的行,因为烧进画面的字幕是密集而锐利的近竖笔画。镜头移动不会干扰它:两句不同的台词亮度分布相似但笔画形状不同,所以由笔画的形状判断哪一句结束、下一句开始。
- 视频输入MP4、MOV、WEBM —— 浏览器能播的都行
- 图片输入PNG、JPG、WEBP
- 长图输出PNG,1x 或 2x,原始宽度或 720 / 1080 / 1440 px
- 采样整段最多采样 320 个点,保证定位耗时可控
- 张数限制没有固定上限,实际限制来自设备内存
- 前提字幕要烧在画面里,不是独立的 .srt 文件
字幕拼接工具不是字幕文件工具
搜「字幕拼接」,你也会搜到一堆合并、转换、校正 .srt、.vtt 文件的工具。那些处理的是字幕文件,这里处理的是图片和视频帧。如果你的字幕是独立文件,你要的是字幕文件工具,这一页帮不上忙。
常见问题
什么是字幕拼接工具?
字幕拼接工具把同一部电影或视频的多张截图拼成一张长图。首图保留完整画面提供语境,之后的每一帧只保留字幕条,成品读起来是一条台词带,而不是一摞几乎一样的图。
有没有不用手动裁切的字幕拼接工具?
有。QuoteStitch 就是围绕这一点做的。它不要求你在每一帧上拖一个把手去框字幕区,而是对比所有帧、找出真正有差异的那一条,只保留它。如果你想要更紧的裁切,之后仍然可以微调。
能配合独立的 .srt 字幕文件使用吗?
不能。QuoteStitch 处理的是图片,以及视频里已经烧进画面的字幕,它从不读取字幕文件。如果你要合并、转换或校正 SRT、VTT 文件,请用字幕文件工具。
一次能拼多少张截图?
没有固定上限,实际限制来自设备内存。几十张全分辨率截图,现在的笔记本或手机都跑得动。特别长的成品建议用 1x 导出。
截图会被上传吗?
不会。识别、裁切、拼接全部在你的浏览器里用 Canvas API 完成。图片不会离开你的设备。