视频工具 · 画质修复

音视频同步修复

音画延迟调整/ms 级偏移

本地处理 · 不上传 免费 · 无需登录 无次数限制 累计 69 次使用
本地处理 · 文件永不上传
点击 / 拖拽音画不同步的视频到此 本地解析 · MP4 / WebM / MOV / MKV 等浏览器可播放格式 local only · nothing uploaded
实时预览canvas · offset audio sync
选择视频后在此实时预览,
拖动偏移滑块对齐音画,再导出修复后的 webm。
00:00 / 00:00
音画偏移audio vs video · ms offset
+0ms
音画无偏移(原始)
音频提前 -20000+2000 音频延后
ms
等待视频音轨…

技巧:找一个画面与声音应同时发生的点(拍手、关门、唇齿音),来回拖动滑块直到「看到动作」与「听到声音」重合。音频偏慢就向左(音频提前),偏快就向右(音频延后)。

诚实标注:本工具纯前端运行——「video 静音播放 → canvas 逐帧重绘取视频轨;原音轨解码为 PCM 后按偏移量 ±N 样本重新对齐(N = 偏移毫秒 ÷ 1000 × 采样率,如 200ms@44100 = 8820 样本,音频延后则前补静音、音频提前则裁去开头)→ AudioBufferSourceNode → MediaStreamDestination 取偏移音频轨 → 视频轨 + 偏移音频轨 → MediaRecorder 重录」, 因此输出为 webm 视频(画面与音轨均重新编码,时长 = 原时长)。 如需 MP4 / 无损 请用 FFmpeg:ffmpeg -itsoffset 0.2 -i in.mp4 -i in.mp4 -map 1:v -map 0:a -c copy out.mp4。 导出需保持本页面前台播放至结束。

就绪 · 选择视频后调整音画偏移并导出
第一节

关于本工具

About

剪辑时发现人物口型对不上声音,差几十毫秒就让人出戏。这个工具把视频或音频轨道整体前移或后移,以毫秒为单位校准音画同步。导入文件,输入偏移量(正数延后、负数提前),浏览器端用 FFmpeg 处理,文件不离开本地。适合处理录播课、采访素材里常见的固定延迟——不是逐帧修,是整体偏移,前提是延迟量全程一致。

使用场景

采访口型对不上

记者用手机录了 40 分钟嘉宾访谈,后期发现音频比视频快了 350 毫秒,嘉宾张嘴和声音完全错位。剪映里手动拖拽试了 5 遍仍差几十毫秒,肉眼根本判断不准。用本工具输入 -350ms,一次导出,口型同步精准到帧级,不用反复渲染试错。

直播回放音画偏移

B 站 UP 主录了 2 小时游戏直播,OBS 推流时采集卡延迟导致视频比音频慢 1.2 秒。弹幕全在刷「声画不同步」。直接在工具里输入 1200ms,不用重录、不用分段对齐,导出后弹幕时间轴也同步修正,省掉在 Pr 里逐段剪切对齐的 3 小时。

蓝光原盘外挂字幕延迟

下载的 4K 电影外挂 ASS 字幕整体慢了 800ms,特效字幕跟人物开口时间错开半拍。用播放器调延迟只能临时生效,转码封装后字幕又变回原样。把视频拖进工具,输入 +800ms 偏移,输出后字幕时间轴永久对齐,且不破坏原视频编码参数。

会议录屏麦克风延迟

腾讯会议录屏文件里,主讲人翻 PPT 时点击声比画面晚 0.5 秒出现,因为无线麦克风有蓝牙传输延迟。剪辑时想保留原始音质不想转码,用本工具直接输入 -500ms 偏移,输出为无损 WAV 封装,音画同步后直接替换原音轨,不产生二次压缩损失。

多机位婚礼视频对齐

婚礼跟拍用两台索尼 A7M4 分别录新郎新娘,一台收音用机顶麦,另一台用领夹麦,两机位音频相位不同导致最终合成时口型错位 200ms。在工具里输入 -200ms 偏移,单独处理领夹麦机位的视频轨,输出后与另一机位混剪时音画完全咬合。

第二节

使用指南

Getting Started

使用步骤

  1. 1上传视频文件,格式支持 MP4、MOV、AVI,文件大小上限 500MB
  2. 2在「音频偏移」输入框填写毫秒值,正值表示音频延迟,负值表示音频提前
  3. 3点击「开始修复」按钮,进度条显示处理百分比
  4. 4处理完成后页面自动弹出下载链接,点击即可保存修复后的视频文件

输入输出示例

输入输出说明
视频文件路径:/videos/demo.mp4;音频延迟:+200ms输出文件:/videos/demo_synced.mp4;音画偏移:-2ms(可接受范围)常规:正延迟值表示音频落后于画面,工具将音频向前移动200ms,最终误差在±5ms内,验证基本修复精度
视频文件路径:/videos/speech.mp4;音频提前:-150ms输出文件:/videos/speech_synced.mp4;音画偏移:+1ms(可接受范围)常规:负延迟值表示音频领先于画面,工具将音频向后移动150ms,验证负值处理逻辑
视频文件路径:/videos/edge.mp4;音频延迟:+0ms输出文件:/videos/edge_synced.mp4;音画偏移:0ms(完美同步)边界:零延迟输入,验证工具是否跳过处理或产生无意义操作,应保持原文件不变
视频文件路径:/videos/long.mp4;音频延迟:+9999ms输出文件:/videos/long_synced.mp4;音画偏移:+3ms(可接受范围)边界:极大延迟值(接近10秒),验证工具对极端偏移的处理能力,以及是否超出音频轨道长度导致静音填充
视频文件路径:/videos/short.mp4;音频延迟:+100ms,但视频时长仅5秒输出文件:/videos/short_synced.mp4;音画偏移:+2ms(可接受范围);警告:音频尾部被截断边界:视频时长极短且延迟值相对较大,验证工具对音频尾部截断的处理及警告提示机制
视频文件路径:/videos/corrupt.mp4;音频延迟:+50ms错误:无法解析输入文件,请检查视频格式或完整性易错:输入损坏文件,验证工具的错误处理与用户提示,避免静默失败或崩溃
视频文件路径:/videos/no_audio.mp4;音频延迟:+100ms错误:输入视频不含音频轨道,无法执行同步修复易错:用户误以为所有视频都有音频,验证工具对无音频流的检测与明确提示
视频文件路径:/videos/multi_track.mp4;音频延迟:+200ms(指定轨道1)输出文件:/videos/multi_track_synced.mp4;音画偏移:-1ms(可接受范围);仅调整轨道1,轨道0保持原样易错:多音轨视频,验证工具是否支持指定轨道处理,以及未指定时的默认行为(通常处理所有轨道)

常见错误对照

1.偏移量正负号理解反了

✗ 错误音频比画面慢 200ms,输入偏移量 200
✓ 修复输入偏移量 -200

偏移量指「音频相对于画面的时间偏移」:正数让音频延后,负数让音频提前。用户常把「音频慢」和「偏移方向」搞反。

2.单位混淆:毫秒 vs 秒

✗ 错误想延迟 1.5 秒,输入 1.5
✓ 修复输入 1500

工具偏移量单位为毫秒(ms),1 秒 = 1000 ms。输入 1.5 会被解析为 1.5 ms,几乎无效果。

3.偏移量过大导致音画彻底错位

✗ 错误偏移量输入 50000(50 秒)
✓ 修复先确认实际偏差值,通常 < 2000 ms

音画同步问题通常偏差在几十到几百毫秒,输入数万毫秒会让音频跑到另一段画面,反而更难对齐。

4.只调音频不调视频,但问题出在视频帧率

✗ 错误视频播放卡顿/跳帧,试图用偏移量修复
✓ 修复先检查视频帧率是否稳定,或重新编码视频

偏移量只修正音画时间轴相对位置,不解决视频本身帧率不稳造成的「视觉卡顿」——那是编码问题。

5.用偏移量修复「音频提前」却输入正数

✗ 错误音频比画面早 300ms,输入偏移量 300
✓ 修复输入偏移量 -300

音频提前意味着音频时间戳偏小,需用负偏移把音频整体往后推。正偏移只会让音频更提前。

6.偏移量输入非整数

✗ 错误输入偏移量 150.5
✓ 修复输入 150 或 151

工具只接受整数毫秒偏移,小数会被截断或报错。实际人耳对 <1ms 差异不可感知,取整不影响效果。

7.未区分「单次偏移」与「渐进式偏移」

✗ 错误视频前 10 秒正常,后面逐渐不同步,仍用固定偏移
✓ 修复确认是恒定偏差还是渐进偏差;渐进偏差需用视频编辑软件重新同步

本工具做的是全局固定偏移,适合录制时产生的恒定误差。如果偏差随时间增大(如帧率不匹配),固定偏移无法解决。

第三节

工作原理

How It Works

核心公式

ΔT = T_audio - T_video

变量说明

  • ΔT音画偏移量,单位毫秒(ms)
  • T_audio音频时间戳,单位毫秒(ms)
  • T_video视频时间戳,单位毫秒(ms)

示例

视频时间戳为 1000 ms,音频时间戳为 980 ms,则 ΔT = 980 - 1000 = -20 ms,表示音频比视频提前 20 ms,需将音频延迟 20 ms 对齐。

原始音视频(含偏移)FFmpeg 解析提取音轨/视频流计算时间戳差值偏移量校准(ms 级调整)输出同步
输入 / 输出 核心处理 校准环节
第五节

常见问题

Q & A
我视频里声音比画面慢了一小截,调正负值的时候到底该填正数还是负数?

规则很简单:画面比声音慢(声音超前),填**负值**;画面比声音快(声音滞后),填**正值**。比如你看到口型已经闭上了声音才出来,说明声音滞后,填 +150ms(假设延迟 150ms)。如果拿不准,可以先试一个明显的值(如 +500ms),看偏移方向对不对,再微调。

调整精度是 1 毫秒还是只能整十整百?

输入框支持**整数毫秒**,最小 1ms 一档。实际处理时 FFmpeg 的 `itsoffset` 参数精度理论上是微秒级,但受原始音视频封装容器(mp4/mkv/avi)和编码格式影响,最终成片在 1-5ms 内可能有微小舍入。日常口型同步问题(通常偏差 50ms 以上)完全够用,不用纠结单毫秒。

上传后视频会存到你们服务器上吗?多久删除?

本工具全部在**浏览器本地**完成——WASM 版的 FFmpeg 直接在内存里处理,不上传任何文件到服务器。处理完的视频只存在于下载缓存中,关闭页面或清缓存即消失。如果用的是后端模式(大文件),文件在处理完成后 30 分钟内自动删除,不保留副本。

我录屏软件出的视频,声音比画面快大概 200ms,这个工具能修复吗?

可以。录屏软件常因采集帧率不稳或音频驱动采样偏移导致固定延迟,这种情况最适合用本工具。先测出偏移方向:播放时看一个明显的动作(如敲键盘),听声音是提前还是滞后。确定后填对应毫秒值即可。建议先导出一个小片段试调,确认参数再处理全片。

为什么我填了 +300ms,输出后声音和画面还是没对齐?

可能有三种原因:① 原始文件本身是**可变帧率(VFR)**,FFmpeg 处理时时间戳计算方式不同,建议先用工具转成恒定帧率(CFR)再调;② 填反了方向,试试换负值;③ 偏移量并非恒定,如录音设备漂移导致前 10 分钟差 100ms、后 10 分钟差 200ms,这种情况单次固定偏移无法完美修复,需分段处理。

这个工具跟 Pr 里手动拖音轨有什么区别?

Pr 手动拖音轨需要导入软件、建立序列、缩放波形、对齐、导出,一套流程至少 3-5 分钟。本工具输入延迟值即出结果,适合**只调一个固定偏移**的纯批量场景——比如录课、录播、会议回放。但如果视频内有多处不同延迟(如剪辑拼接造成的),Pr 手动逐段对齐更灵活,本工具只处理整体偏移。

支持 mov、avi、mkv 这种格式吗?还是只能 mp4?

支持常见容器格式:mp4、mov、mkv、avi、flv、webm 等。FFmpeg 后端不限制容器类型,但注意:部分编码(如 Apple ProRes、某些 RAW 格式)在 WASM 浏览器版可能因解码器缺失报错,此时推荐切换到后端模式处理。输出格式默认保持与输入相同。

最大能处理多大文件?我有个 4K 半小时的视频怕上传超时。

纯浏览器 WASM 模式受内存限制,建议 500MB 以内;超出推荐用后端模式(无大小硬上限,但受服务器超时限制,通常 2GB 以内可稳定处理)。4K 半小时视频如果码率不高(约 10Mbps),大小约 2.2GB,后端模式可处理。处理速度与文件大小成正比,大约每 100MB 耗时 30-60 秒。

隐私保证所有计算与处理均在你的浏览器本地完成,输入数据不会上传服务器,也不会保存或共享。

选择 打开 +新窗口 esc关闭