音频工具 · 剪辑 / 合并

音频分割

等长分割/静音分割

本地处理 · 不上传 免费 · 无需登录 无次数限制 累计 50 次使用
等长 / 静音 / 手动 · Web Audio 本地切片 · 不上传
拖入或点击选择音频 MP3 / WAV / FLAC / M4A / OGG 等 · 浏览器本地解码切片
等长分割 equal

按固定时长(每 N 秒)或固定段数(分成 N 段)均匀切分

静音分割 silence

检测静音间隔作分割点,按句 / 按曲拆分

手动标记 manual

在波形上点击添加分割点,再次点击附近可删除

 
30 s/段
5 段
-40 dB
0.50 s
1.00 s
在下方波形上点击添加分割点;点击已有分割点附近可删除它。当前 0 个分割点。
波形 / 分割点 朱砂竖线 = 分割点 · 交替底色 = 片段 · 灰条 = 静音
片段列表
就绪 · 选择音频后即可分割并导出
第一节

关于本工具

About

一段录音要剪成等长片段,或一键剔除所有静默间隙,手动拖拽时间轴太慢。音频分割让这两类操作在浏览器里完成:设好分钟数或静音阈值,后端 FFmpeg 按参数切分,不修改音质。文件不上传服务器,处理完后本地清理,适合播客粗剪、会议录音快速分段或上课笔记去空白。

使用场景

播客粗剪去空白

录音师小陈录完一期 60 分钟的访谈节目,发现嘉宾每段回答之间有 2-5 秒的沉默和换气声。手动剪掉这些间隙要逐帧查看波形,1 小时素材得花 2 小时修。用静音分割功能设定阈值 -30dB、最短静音 1.5 秒,工具自动把 43 段有效发言切出来,空白段直接剔除,输出 12 个独立音频文件,导入剪辑软件后直接拼合,省掉手动定位的重复劳动。

会议录音分段归档

项目经理老赵每周开 2 小时跨部门会议,会后需要把每个议题的讨论片段单独发给对应负责人。之前用录音笔录完是整段 WAV,用播放器手动拖动找议题切换点,经常漏掉 30 秒关键内容。用等长分割按 15 分钟一段切出 8 个文件,文件名加上时间戳,各负责人按时间段认领自己那部分,无需二次编辑。

网课音频拆小节

高三学生小林下载了 3 节 45 分钟的英语听力课音频,想每天只练 10 分钟。手动在手机备忘录记时间点太慢,且每次听完要回拉进度条。用等长分割把每段音频切成 10 分钟一段,共 13 个文件,按顺序编号存入播放器列表,每天随机听 1-2 段,听完自动跳到下一段,不用盯着进度条找位置。

有声书分章节提取

听书用户阿杰下载了一本 8 小时的有声书,但文件是一整段,没有章节标记。每次听到一半退出后,要凭记忆在播放器里拖动进度条找上次停下的位置,误差常常在 5 分钟以上。用等长分割按 30 分钟一段切成 16 个文件,每段时长一致,文件名标注段号,听完一段记下段号即可精准续听,无需依赖播放器书签功能。

语音备忘录清空长空白

记者小王在采访现场录了 40 分钟对话,但中间有 3 次被旁人打断,每次停顿 20-40 秒。这些空白段既占存储又影响后续听写效率。用静音分割设定最短静音 5 秒,工具自动识别并切掉 3 段空白,输出 4 段有效对话,总时长从 40 分钟缩减到 37 分钟,直接导入听写软件,减少无效等待。

第二节

使用指南

Getting Started

使用步骤

  1. 1在「分割模式」下拉框中选择「等长分割」或「静音分割」,模式切换后参数区同步更新
  2. 2点击「选择文件」按钮上传音频文件,支持 mp3、wav、flac 格式,文件大小上限 200 MB
  3. 3等长模式:在「每段时长」输入框填入秒数(1–3600),系统按该时长切分;静音模式:在「静音阈值」输入框填入 dB 值(-60–0),低于该值视为静音断点
  4. 4点击「开始分割」按钮,进度条显示处理百分比,完成后每段音频下方出现「下载」按钮
  5. 5点击任意段落的「下载」按钮保存该段,或点击顶部「全部下载」打包为 zip 文件

输入输出示例

输入输出说明
音频时长 3 分 20 秒,等长分割每段 60 秒输出 4 段:0-60s, 60-120s, 120-180s, 180-200s(最后一段 20 秒)常规:等长分割,最后一段不足整段时长,验证工具是否保留尾段而非丢弃
音频时长 5 分钟,静音分割阈值 -40dB,静音时长 0.5 秒输出 3 段:0-45s, 45s-2m10s, 2m10s-5m(根据实际静音位置)常规:静音分割典型场景,验证阈值和静音时长参数能否正确识别非连续静音
音频时长 2 秒,等长分割每段 10 秒输出 1 段:0-2s(整段音频)边界:输入音频时长小于分割段长,验证工具是否返回整段而非报错或空结果
音频时长 0 秒(空文件)输出空列表,提示“音频无有效内容”边界:空音频输入,验证工具是否优雅处理零时长文件而非崩溃
音频时长 1 小时,等长分割每段 3600 秒输出 1 段:0-3600s边界:分割段长等于总时长,验证工具是否输出单段而非因整除问题多出一段
音频含连续 10 秒静音,静音分割阈值 -30dB,静音时长 2 秒输出 2 段:静音前内容, 静音后内容(静音部分被切除)易错:用户可能误以为静音分割会保留静音段,实际是切除静音,需明确说明
音频采样率 8kHz,等长分割每段 1 秒输出每段时长精确为 1 秒(8000 采样点)易错:低采样率音频分割时,部分工具可能因帧对齐问题导致时长偏差,验证精度

常见错误对照

1.静音分割时,静音阈值设置过高,导致音频被过度切割

✗ 错误静音阈值设为 -20 dB,结果一段正常说话也被切开了
✓ 修复静音阈值设为 -40 dB,只切割真正的静音段落

阈值过高(接近说话音量)会把微弱呼吸、停顿都识别为静音,导致分割出大量无意义片段。一般建议 -35 dB 到 -45 dB 之间,视录音环境噪声调整。

2.等长分割时,分割时长与音频总时长不成整数倍,末尾片段被丢弃

✗ 错误音频总长 3 分 20 秒,设置每段 1 分钟,只得到 3 段,最后 20 秒丢失
✓ 修复音频总长 3 分 20 秒,设置每段 40 秒,正好 5 段

等长分割按固定时长切分,末尾不足一段的音频默认不输出。FFmpeg 的 segment 模式不会自动补零或截断,需用户自行计算总时长与段长倍数关系。

3.静音分割时,最小静音时长设置太短,把正常停顿也切开了

✗ 错误最小静音时长设为 0.1 秒,结果一句话里的换气声都被识别为分割点
✓ 修复最小静音时长设为 0.5 秒,只切割明显停顿

人说话时自然停顿约 0.2~0.4 秒,设置过短会把语流中断。建议 0.3~0.8 秒,具体取决于语速和内容类型(如播客 vs 会议录音)。

4.输入音频格式包含可变比特率(VBR),导致分割点时间戳不准确

✗ 错误上传一个 VBR 编码的 MP3 文件,分割后片段开头有杂音或时间偏移
✓ 修复先将音频转为恒定比特率(CBR)格式(如 WAV 或 CBR MP3),再上传分割

VBR 的帧时长不固定,FFmpeg 按时间戳切割时可能落在非关键帧上,造成解码错误。CBR 每帧时长固定,切割更精确。

5.静音分割时,忽略音频首尾的静音,导致输出空片段

✗ 错误音频开头有 2 秒静音,分割后第一个片段全是静音
✓ 修复勾选「跳过首尾静音」选项,或手动裁剪掉开头静音后再分割

FFmpeg 的静音检测默认从音频起始点开始,如果开头就有静音,会被当作第一个有效片段输出。跳过首尾静音可避免生成无内容片段。

6.等长分割时,使用非整数秒的时长,导致部分浏览器或播放器无法正确识别

✗ 错误设置每段 1.5 分钟(90 秒),结果某些播放器显示时长异常
✓ 修复设置每段 90 秒(整数秒),或使用 1 分 30 秒的整数秒表示

FFmpeg 内部以秒为单位处理时间,非整数秒可能产生浮点精度误差。部分播放器对非整数时长片段支持不佳,建议用整数秒或毫秒级精确值。

7.静音分割时,噪声门限与静音阈值混淆,导致分割失效

✗ 错误设置噪声门限 -50 dB、静音阈值 -30 dB,结果说话声也被当作静音
✓ 修复噪声门限应低于静音阈值(如噪声门限 -50 dB、静音阈值 -35 dB),或仅使用静音阈值

噪声门限用于过滤背景噪声,静音阈值才是分割判断标准。若门限高于阈值,系统会认为所有声音都是噪声,导致无分割。

第三节

工作原理

How It Works

核心公式

N = ⌈T / L⌉

变量说明

  • N分割后音频段数
  • T音频总时长(秒)
  • L每段目标时长(秒)

示例

一段 3 分 20 秒(200 秒)的播客,每段 45 秒:N = ⌈200 / 45⌉ = ⌈4.444...⌉ = 5 段。最后一段时长 200 - 4×45 = 20 秒,不足 45 秒但保留为独立段。

上传音频文件(MP3 / WAV / FLAC)选择分割模式等长 / 静音检测FFmpeg 解析波形 / 时长 / 编码输出片段ZIP 下载静音分割关键判断• 检测静音阈值(-50dB ~ -30dB)• 静音段长度 ≥ 设定值(0.5s ~ 3s)• 非静音段 → 独立输出片段
用户输入 本地处理 输出结果
第五节

常见问题

Q & A
等长分割和静音分割有什么区别?我该选哪个?

等长分割是按固定时长(比如每 10 分钟一刀)将音频切成等长片段,适合播客、课程录音或长语音的批量处理。静音分割则是检测音频中的静音段落(默认 -50dB 以下持续 0.5 秒以上),在静音处自动切分,适合去除访谈中的空白、会议录音的自然断句。如果音频内容连续无静音,静音分割可能只输出一个文件;如果静音阈值设置太低,可能把说话间隙也切掉。建议先试默认参数,再根据输出调整静音阈值和最小静音时长。

为什么我上传的音频分割后有些片段是空白的?

空白片段通常出现在静音分割模式下,当音频末尾或开头有一段静音被单独切出来。本工具在静音分割时会把静音段落本身当作一个片段输出。解决办法:在静音分割参数中勾选「忽略首尾静音」或提高「最小静音时长」(如从 0.5 秒改为 1 秒),这样短于阈值的静音就不会被切分。如果仍然出现,可以手动拼接或删除空白片段。

支持哪些音频格式?MP3 和 WAV 都能分割吗?

本工具使用 FFmpeg 底层处理,支持几乎所有常见音频格式:MP3、WAV、FLAC、AAC、OGG、M4A、WMA、APE 等。输入格式不影响分割逻辑,但输出格式默认与原文件一致。如果原文件是 MP3,输出也是 MP3;如果需要统一输出为 WAV,可在分割前勾选「输出格式」选项。注意:采样率和声道数会保留原文件参数,不会因分割而改变。

分割后的文件质量会下降吗?码率会不会变?

本工具采用 FFmpeg 的流复制模式(copy),即不重新编码,直接按时间点切割。这意味着音频的码率、采样率、声道数完全保留原样,不会引入额外压缩损失。唯一的例外是:如果输出格式选择与原文件不同(比如 MP3 转 WAV),则会重新编码,此时可以手动指定码率(默认与原文件相同)。建议不需要换格式时直接使用默认的「与原文件相同」选项。

最大能分割多大的文件?有长度限制吗?

本工具在浏览器端运行,文件大小受浏览器内存和 FFmpeg WASM 版本限制。实测单文件最大约 2GB(约 4 小时 320kbps MP3)。超过此大小建议先转成更低码率或先用桌面工具分割。另外,等长分割模式下片段数无上限,但静音分割模式受音频总时长影响(处理大文件时静音检测可能较慢)。如果文件超过 500MB,建议耐心等待进度条。

分割后文件名太乱,能批量重命名吗?

本工具目前不支持自动重命名。分割后的文件名默认格式为「原文件名_序号.扩展名」(如 lecture_001.mp3)。如果希望有规律的文件名,可以在分割前将原文件命名为有意义的名称(如「2025-03-21_会议录音.mp3」),分割后的序号会保持时间顺序。如果需要批量重命名,建议下载后用 Windows 的「重命名」功能(选中所有文件按 F2)或 Mac 的「给项目重新命名」功能。

我的音频里有人说话也有背景音乐,静音分割能准确切分吗?

静音分割依赖检测静音段落,如果背景音乐持续不断(如播客背景垫乐、视频 BGM),则整段音频可能不存在真正的静音,导致静音分割失败(只输出一个文件)。解决方案:① 使用等长分割代替静音分割,按固定时长切分;② 如果背景音乐有间歇性停顿,可以降低静音阈值(如从 -50dB 改为 -35dB),但可能误将说话间隙也切掉。建议对带持续背景音的音频优先用等长分割。

分割后音频时长和原文件对不上,差了几秒怎么回事?

这是 FFmpeg 分割时的常见现象,原因是音频帧边界对齐问题。等长分割时,如果设置的片段时长不是音频帧长度的整数倍(如 MP3 每帧 26ms),最后一个片段可能会比设定时长多或少一帧。静音分割则可能因静音检测的起始/结束点落在帧边界上,导致片段首尾有毫秒级误差。本工具默认按最近帧对齐,误差通常 < 50ms。如果对精确性要求极高(如音乐节拍分割),建议使用专业的音频编辑软件。

隐私保证所有计算与处理均在你的浏览器本地完成,输入数据不会上传服务器,也不会保存或共享。

选择 打开 +新窗口 esc关闭