采访口型对不上
记者用手机录了 40 分钟嘉宾访谈,后期发现音频比视频快了 350 毫秒,嘉宾张嘴和声音完全错位。剪映里手动拖拽试了 5 遍仍差几十毫秒,肉眼根本判断不准。用本工具输入 -350ms,一次导出,口型同步精准到帧级,不用反复渲染试错。
技巧:找一个画面与声音应同时发生的点(拍手、关门、唇齿音),来回拖动滑块直到「看到动作」与「听到声音」重合。音频偏慢就向左(音频提前),偏快就向右(音频延后)。
诚实标注:本工具纯前端运行——「video 静音播放 → canvas 逐帧重绘取视频轨;原音轨解码为 PCM 后按偏移量
±N 样本重新对齐(N = 偏移毫秒 ÷ 1000 × 采样率,如 200ms@44100 = 8820 样本,音频延后则前补静音、音频提前则裁去开头)→
AudioBufferSourceNode → MediaStreamDestination 取偏移音频轨 → 视频轨 + 偏移音频轨 → MediaRecorder 重录」,
因此输出为 webm 视频(画面与音轨均重新编码,时长 = 原时长)。
如需 MP4 / 无损 请用 FFmpeg:ffmpeg -itsoffset 0.2 -i in.mp4 -i in.mp4 -map 1:v -map 0:a -c copy out.mp4。
导出需保持本页面前台播放至结束。
剪辑时发现人物口型对不上声音,差几十毫秒就让人出戏。这个工具把视频或音频轨道整体前移或后移,以毫秒为单位校准音画同步。导入文件,输入偏移量(正数延后、负数提前),浏览器端用 FFmpeg 处理,文件不离开本地。适合处理录播课、采访素材里常见的固定延迟——不是逐帧修,是整体偏移,前提是延迟量全程一致。
记者用手机录了 40 分钟嘉宾访谈,后期发现音频比视频快了 350 毫秒,嘉宾张嘴和声音完全错位。剪映里手动拖拽试了 5 遍仍差几十毫秒,肉眼根本判断不准。用本工具输入 -350ms,一次导出,口型同步精准到帧级,不用反复渲染试错。
B 站 UP 主录了 2 小时游戏直播,OBS 推流时采集卡延迟导致视频比音频慢 1.2 秒。弹幕全在刷「声画不同步」。直接在工具里输入 1200ms,不用重录、不用分段对齐,导出后弹幕时间轴也同步修正,省掉在 Pr 里逐段剪切对齐的 3 小时。
下载的 4K 电影外挂 ASS 字幕整体慢了 800ms,特效字幕跟人物开口时间错开半拍。用播放器调延迟只能临时生效,转码封装后字幕又变回原样。把视频拖进工具,输入 +800ms 偏移,输出后字幕时间轴永久对齐,且不破坏原视频编码参数。
腾讯会议录屏文件里,主讲人翻 PPT 时点击声比画面晚 0.5 秒出现,因为无线麦克风有蓝牙传输延迟。剪辑时想保留原始音质不想转码,用本工具直接输入 -500ms 偏移,输出为无损 WAV 封装,音画同步后直接替换原音轨,不产生二次压缩损失。
婚礼跟拍用两台索尼 A7M4 分别录新郎新娘,一台收音用机顶麦,另一台用领夹麦,两机位音频相位不同导致最终合成时口型错位 200ms。在工具里输入 -200ms 偏移,单独处理领夹麦机位的视频轨,输出后与另一机位混剪时音画完全咬合。
| 输入 | 输出 | 说明 |
|---|---|---|
| 视频文件路径:/videos/demo.mp4;音频延迟:+200ms | 输出文件:/videos/demo_synced.mp4;音画偏移:-2ms(可接受范围) | 常规:正延迟值表示音频落后于画面,工具将音频向前移动200ms,最终误差在±5ms内,验证基本修复精度 |
| 视频文件路径:/videos/speech.mp4;音频提前:-150ms | 输出文件:/videos/speech_synced.mp4;音画偏移:+1ms(可接受范围) | 常规:负延迟值表示音频领先于画面,工具将音频向后移动150ms,验证负值处理逻辑 |
| 视频文件路径:/videos/edge.mp4;音频延迟:+0ms | 输出文件:/videos/edge_synced.mp4;音画偏移:0ms(完美同步) | 边界:零延迟输入,验证工具是否跳过处理或产生无意义操作,应保持原文件不变 |
| 视频文件路径:/videos/long.mp4;音频延迟:+9999ms | 输出文件:/videos/long_synced.mp4;音画偏移:+3ms(可接受范围) | 边界:极大延迟值(接近10秒),验证工具对极端偏移的处理能力,以及是否超出音频轨道长度导致静音填充 |
| 视频文件路径:/videos/short.mp4;音频延迟:+100ms,但视频时长仅5秒 | 输出文件:/videos/short_synced.mp4;音画偏移:+2ms(可接受范围);警告:音频尾部被截断 | 边界:视频时长极短且延迟值相对较大,验证工具对音频尾部截断的处理及警告提示机制 |
| 视频文件路径:/videos/corrupt.mp4;音频延迟:+50ms | 错误:无法解析输入文件,请检查视频格式或完整性 | 易错:输入损坏文件,验证工具的错误处理与用户提示,避免静默失败或崩溃 |
| 视频文件路径:/videos/no_audio.mp4;音频延迟:+100ms | 错误:输入视频不含音频轨道,无法执行同步修复 | 易错:用户误以为所有视频都有音频,验证工具对无音频流的检测与明确提示 |
| 视频文件路径:/videos/multi_track.mp4;音频延迟:+200ms(指定轨道1) | 输出文件:/videos/multi_track_synced.mp4;音画偏移:-1ms(可接受范围);仅调整轨道1,轨道0保持原样 | 易错:多音轨视频,验证工具是否支持指定轨道处理,以及未指定时的默认行为(通常处理所有轨道) |
1.偏移量正负号理解反了
音频比画面慢 200ms,输入偏移量 200输入偏移量 -200偏移量指「音频相对于画面的时间偏移」:正数让音频延后,负数让音频提前。用户常把「音频慢」和「偏移方向」搞反。
2.单位混淆:毫秒 vs 秒
想延迟 1.5 秒,输入 1.5输入 1500工具偏移量单位为毫秒(ms),1 秒 = 1000 ms。输入 1.5 会被解析为 1.5 ms,几乎无效果。
3.偏移量过大导致音画彻底错位
偏移量输入 50000(50 秒)先确认实际偏差值,通常 < 2000 ms音画同步问题通常偏差在几十到几百毫秒,输入数万毫秒会让音频跑到另一段画面,反而更难对齐。
4.只调音频不调视频,但问题出在视频帧率
视频播放卡顿/跳帧,试图用偏移量修复先检查视频帧率是否稳定,或重新编码视频偏移量只修正音画时间轴相对位置,不解决视频本身帧率不稳造成的「视觉卡顿」——那是编码问题。
5.用偏移量修复「音频提前」却输入正数
音频比画面早 300ms,输入偏移量 300输入偏移量 -300音频提前意味着音频时间戳偏小,需用负偏移把音频整体往后推。正偏移只会让音频更提前。
6.偏移量输入非整数
输入偏移量 150.5输入 150 或 151工具只接受整数毫秒偏移,小数会被截断或报错。实际人耳对 <1ms 差异不可感知,取整不影响效果。
7.未区分「单次偏移」与「渐进式偏移」
视频前 10 秒正常,后面逐渐不同步,仍用固定偏移确认是恒定偏差还是渐进偏差;渐进偏差需用视频编辑软件重新同步本工具做的是全局固定偏移,适合录制时产生的恒定误差。如果偏差随时间增大(如帧率不匹配),固定偏移无法解决。
ΔT = T_audio - T_video
ΔT音画偏移量,单位毫秒(ms)T_audio音频时间戳,单位毫秒(ms)T_video视频时间戳,单位毫秒(ms)视频时间戳为 1000 ms,音频时间戳为 980 ms,则 ΔT = 980 - 1000 = -20 ms,表示音频比视频提前 20 ms,需将音频延迟 20 ms 对齐。
规则很简单:画面比声音慢(声音超前),填**负值**;画面比声音快(声音滞后),填**正值**。比如你看到口型已经闭上了声音才出来,说明声音滞后,填 +150ms(假设延迟 150ms)。如果拿不准,可以先试一个明显的值(如 +500ms),看偏移方向对不对,再微调。
输入框支持**整数毫秒**,最小 1ms 一档。实际处理时 FFmpeg 的 `itsoffset` 参数精度理论上是微秒级,但受原始音视频封装容器(mp4/mkv/avi)和编码格式影响,最终成片在 1-5ms 内可能有微小舍入。日常口型同步问题(通常偏差 50ms 以上)完全够用,不用纠结单毫秒。
本工具全部在**浏览器本地**完成——WASM 版的 FFmpeg 直接在内存里处理,不上传任何文件到服务器。处理完的视频只存在于下载缓存中,关闭页面或清缓存即消失。如果用的是后端模式(大文件),文件在处理完成后 30 分钟内自动删除,不保留副本。
可以。录屏软件常因采集帧率不稳或音频驱动采样偏移导致固定延迟,这种情况最适合用本工具。先测出偏移方向:播放时看一个明显的动作(如敲键盘),听声音是提前还是滞后。确定后填对应毫秒值即可。建议先导出一个小片段试调,确认参数再处理全片。
可能有三种原因:① 原始文件本身是**可变帧率(VFR)**,FFmpeg 处理时时间戳计算方式不同,建议先用工具转成恒定帧率(CFR)再调;② 填反了方向,试试换负值;③ 偏移量并非恒定,如录音设备漂移导致前 10 分钟差 100ms、后 10 分钟差 200ms,这种情况单次固定偏移无法完美修复,需分段处理。
Pr 手动拖音轨需要导入软件、建立序列、缩放波形、对齐、导出,一套流程至少 3-5 分钟。本工具输入延迟值即出结果,适合**只调一个固定偏移**的纯批量场景——比如录课、录播、会议回放。但如果视频内有多处不同延迟(如剪辑拼接造成的),Pr 手动逐段对齐更灵活,本工具只处理整体偏移。
支持常见容器格式:mp4、mov、mkv、avi、flv、webm 等。FFmpeg 后端不限制容器类型,但注意:部分编码(如 Apple ProRes、某些 RAW 格式)在 WASM 浏览器版可能因解码器缺失报错,此时推荐切换到后端模式处理。输出格式默认保持与输入相同。
纯浏览器 WASM 模式受内存限制,建议 500MB 以内;超出推荐用后端模式(无大小硬上限,但受服务器超时限制,通常 2GB 以内可稳定处理)。4K 半小时视频如果码率不高(约 10Mbps),大小约 2.2GB,后端模式可处理。处理速度与文件大小成正比,大约每 100MB 耗时 30-60 秒。
隐私保证所有计算与处理均在你的浏览器本地完成,输入数据不会上传服务器,也不会保存或共享。