采访录音备份
记者在外采访两小时,手机存储告急,视频文件太大传不回编辑部。现场用本工具把视频里的音频单独抽出来,文件从 2GB 缩到 120MB,直接微信发回后方。音频保持 320kbps 码率,人声清晰度足够后期剪辑,不用等回酒店连电脑。
诚实说明:浏览器 decodeAudioData 直接从视频容器解码音频轨(MP4/AAC、WebM/Opus 等大多数浏览器支持的编码),
本工具将其导出为 WAV(无损 PCM),不二次有损压缩;如需 MP3 / AAC / OGG 等有损格式,请用专门的音频编码工具。
少数容器或编码(如部分 AVI / WMV / MKV)浏览器无法解码,会给出友好错误提示——可先转码为 MP4 再提取。文件永不上传。
录完会议视频想只留音频,拖进播放器再找转换软件,中间能卡掉两分钟。这个工具把 FFmpeg 的音频抽取逻辑封装成一个上传框:丢进视频,选好输出格式(MP3、AAC 或 WAV),点一下就能拿到和原视频同码率的音频文件。文件经后端处理,适合大体积长视频;纯浏览器端无法处理的格式也会回退到服务端,不丢帧不降质。
记者在外采访两小时,手机存储告急,视频文件太大传不回编辑部。现场用本工具把视频里的音频单独抽出来,文件从 2GB 缩到 120MB,直接微信发回后方。音频保持 320kbps 码率,人声清晰度足够后期剪辑,不用等回酒店连电脑。
考研党攒了 40 节录播课,每节 1 小时视频,想转成音频塞进手机通勤听。视频转音频后文件大小从 800MB 降到 50MB,手机存储压力骤减。音频采样率锁定 44100Hz,语速不变、音调不飘,跟原视频听觉一致,做笔记时能准确定位时间点。
项目经理开完 3 小时跨部门评审会,视频回放长达 4GB,没法直接丢进语音转文字软件。先用本工具把视频音轨单独导出为 MP3,文件压缩到 280MB,再拖进讯飞听见识别。识别准确率比直接处理视频高 5%,因为去掉了视频编码干扰。
车机只认音频格式,视频文件播不了。从 B 站下载了 50 个音乐现场视频,每个 200MB 左右,U 盘根本塞不下几个。用本工具批量转成 192kbps MP3,单个文件缩到 15MB,50 首歌只占 750MB,音质在车载音响上听不出底噪。
独立播客主收到嘉宾发来的 4K 视频素材,画面不需要,只要人声轨道。视频文件 6GB,传输和存储都浪费。用本工具抽取出 48kHz/16bit WAV 文件,体积 1.2GB,保留原始录音动态范围,后期降噪、压缩时不会出现量化失真。
| 输入 | 输出 | 说明 |
|---|---|---|
| 上传一个 1080p、时长 2 分 30 秒的 MP4 视频文件 | 输出一个 320kbps CBR MP3 音频文件,时长 2 分 30 秒,文件大小约 6.2 MB | 常规:典型高清视频转高质量音频,验证基本提取流程与音质保持 |
| 上传一个 4K、时长 10 分钟的 MOV 视频文件 | 输出一个 192kbps AAC 音频文件,时长 10 分钟,文件大小约 14.4 MB | 常规:高分辨率视频,验证工具对长视频和大文件的处理稳定性 |
| 上传一个仅包含单声道音频、时长 5 秒的 AVI 视频文件 | 输出一个 128kbps MP3 音频文件,时长 5 秒,文件大小约 80 KB | 边界:极短视频(5 秒),验证工具对超短时长输入的处理,不产生空文件或报错 |
| 上传一个无音频轨道的静音视频文件(如纯黑屏、无音轨的 MP4) | 输出一个 0 字节的音频文件或提示“输入视频中未检测到音频轨道” | 边界:无音频轨道,验证工具能否正确识别并给出明确提示,而非生成静音文件 |
| 上传一个 720p、时长 1 小时的 MKV 视频文件(文件大小 4.5 GB) | 输出一个 320kbps MP3 音频文件,时长 1 小时,文件大小约 144 MB | 边界:超大文件(接近 5 GB),验证工具对浏览器端 WASM 处理的内存限制或后端上传超时处理 |
| 上传一个文件名含中文和特殊字符的 MP4 视频(如“测试_视频(2024).mp4”) | 输出一个名为“测试_视频(2024).mp3”的音频文件 | 易错:特殊字符文件名,验证工具是否保留原文件名并正确编码,避免乱码或下载失败 |
| 上传一个 480p、时长 3 分钟的 FLV 视频文件(旧格式) | 输出一个 128kbps MP3 音频文件,时长 3 分钟,文件大小约 2.9 MB | 易错:老旧视频格式(FLV),验证工具对 FFmpeg 支持的格式兼容性,避免格式不支持报错 |
1.输出格式选了不支持的无损格式
从 MP4 视频提取音频,输出格式选 FLAC从 MP4 视频提取音频,输出格式选 MP3 或 AACFLAC 是无损压缩格式,但多数视频音轨本身是 AAC/MP3 有损编码,转 FLAC 不会提升音质,反而文件体积暴增。工具后端 FFmpeg 支持所有常见格式,但用户应选与源音轨编码匹配的格式。
2.采样率设得过高,文件无谓增大
提取一段人声播客音频,采样率设为 192000 Hz提取一段人声播客音频,采样率设为 44100 Hz人声播客的原始采样率通常为 44100 Hz,设为 192000 Hz 不会增加可听频率范围(人耳上限 20kHz),只会让文件体积翻 4 倍。奈奎斯特采样定理:采样率 ≥ 信号最高频率的 2 倍即可。
3.比特率设得太低,音质严重劣化
提取音乐视频的音频,比特率设为 32 kbps提取音乐视频的音频,比特率设为 192 kbps 或 320 kbps32 kbps 只能保留电话语音质量,音乐中的高频乐器、和声会被严重压缩丢失。MP3 编码在 128 kbps 以下音质下降明显,音乐类建议 192 kbps 以上。
4.输入文件路径包含空格或中文未加引号
ffmpeg -i C:\My Videos\song.mp4 output.mp3ffmpeg -i "C:\My Videos\song.mp4" output.mp3命令行中空格会拆分参数,导致 FFmpeg 把 'C:\My' 当输入、'Videos\song.mp4' 当第二个参数,报错 'No such file or directory'。中文路径同理,必须用双引号包裹。
5.提取时没指定起始时间,截取整段视频
只想提取视频第 1 分钟到第 2 分钟的音频,直接执行 ffmpeg -i video.mp4 output.mp3ffmpeg -i video.mp4 -ss 00:01:00 -to 00:02:00 output.mp3不加 -ss 和 -to 参数时,FFmpeg 默认处理整个视频流。用户以为只截取片段,实际得到完整音频,浪费处理时间和存储空间。
6.用 -c copy 复制音轨,但输出格式不兼容
ffmpeg -i video.mp4 -c copy output.wavffmpeg -i video.mp4 -c:a pcm_s16le output.wav-c copy 直接复制原始编码流,但 WAV 容器只接受 PCM 编码。如果源视频音轨是 AAC 编码,复制后 WAV 文件无法播放。WAV 必须用 pcm_s16le 等 PCM 编码器重新编码。
7.输出文件名后缀与编码不匹配
ffmpeg -i video.mp4 output.aacffmpeg -i video.mp4 -c:a aac output.m4a.aac 后缀通常对应原始 AAC 流(ADTS 格式),多数播放器无法识别。M4A 容器(MP4 的音频版)才是 AAC 编码的标准封装。FFmpeg 默认根据后缀选容器,但用户需知道 .aac 是裸流。
音频比特率(kbps) = 采样率(Hz) × 位深度(bit) × 声道数 ÷ 1000
音频比特率每秒音频数据量,单位 kbps采样率每秒采样次数,如 44100 Hz位深度每次采样的数据位数,如 16 bit声道数音频通道数,如 2(立体声)从 48 kHz 视频提取 16-bit 立体声音频:比特率 = 48000 × 16 × 2 ÷ 1000 = 1536 kbps。FFmpeg 默认使用此无损值,确保与原视频音频质量一致。
可以。本工具基于 FFmpeg,支持将视频中的音频流提取为 MP3、AAC、WAV、FLAC、OGG 等常见格式。输出默认是 MP3(320kbps 高质量),也可以在界面上选择其他格式。如果原视频没有音频轨道(如无声监控录像),工具会提示「未检测到音频流」,不会生成空文件。
本工具是直接复制音频流(codec copy),不重新编码,因此音质理论上与原视频中的音频完全一致。如果原视频是 320kbps AAC,输出 MP3 选 320kbps 时人耳几乎无法分辨差异;但如果原视频音质本身就差(如 64kbps 单声道),提取后也不会变好。工具默认保持原始采样率和比特率,用户也可手动设置更高码率(但不会超过原视频源质量)。
正常情况下一模一样。如果发现时长偏差,通常是原视频本身存在音画不同步(如录屏软件生成的 VFR 视频)。FFmpeg 在处理 VFR 时可能截断尾部空白帧,导致音频比视频短 0.1-1 秒。解决方案:在工具输出设置中勾选「强制同步修正」,工具会重新分析时间基并补全静音帧,确保音频时长与视频完全对齐。
本工具支持绝大多数容器格式(MP4、AVI、MOV、MKV、FLV、WEBM、TS 等)。如果提示「不支持」,通常有两个原因:一是文件扩展名被误改(如把 .mp4 改成 .avi 但实际编码仍是 H.264),工具会检测实际编码;二是文件已损坏(下载中断或传输错误)。建议先用播放器打开确认能否正常播放,如果能播但工具报错,可尝试重命名回原始扩展名再上传。
可以。在输出设置中降低比特率即可缩小文件体积。例如 320kbps 的 5 分钟 MP3 约 12MB,降到 128kbps 约 5MB,音质对大部分播客、听力材料来说足够。如果原视频音频已经是低码率(如 128kbps AAC),再压缩会明显损失细节。工具也支持输出 AAC 格式(同等码率下比 MP3 体积小约 30%),适合存储空间有限的情况。
如果原视频本身没有音频轨道(如某些 GIF 转视频、无声监控片段),工具会直接提示「未检测到音频流」,不会生成文件。建议先用播放器查看视频文件属性:Windows 右键属性 → 详细信息 → 音频;Mac 用 QuickTime 播放器 → 显示影片检查器。如果确实有音频但工具检测不到,可能是音频编码太冷门(如 DTS、AC-3 未授权),可尝试先用格式工厂转成 MP4(AAC 音频)再上传。
本工具使用纯浏览器端 FFmpeg(WASM)处理,视频文件完全在本地电脑上运算,不上传任何数据到服务器。关闭网页后处理记录即刻清除。如果你用的是后端处理模式(服务器版),文件会在转换完成后 1 小时内自动删除,且不保留备份。建议敏感内容优先使用浏览器端模式,地址栏会显示「wasm」标识。
核心区别:网页工具无需安装、不占存储、跨平台(Windows/Mac/Linux 浏览器都能用)。手机 App 通常依赖系统解码器,对某些格式(如 .ts 或 .m2ts)支持更好,但往往有广告或限制提取时长。本工具无文件大小限制(浏览器端受内存影响,建议 2GB 以内),且输出参数可调(码率、采样率、声道)。缺点是需要网络才能加载 FFmpeg 引擎(首次约 5-10 秒),且不支持批量处理(需逐个上传)。
隐私保证所有计算与处理均在你的浏览器本地完成,输入数据不会上传服务器,也不会保存或共享。