音频工具 · 音乐处理

音频混响回声

大厅/教堂/自定义参数

本地处理 · 不上传 免费 · 无需登录 无次数限制 累计 56 次使用
ConvolverNode 混响 · DelayNode 回声 · Web Audio 本地处理 · 不上传
拖入或点击选择音频 MP3 / WAV / FLAC / M4A / OGG 等 · 浏览器本地解码处理
原始 / 处理后波形 waveform · dry vs wet · 混响拖尾延长波形
混响 REVERBconvolver
2.0s
60%
20ms
40%
回声 ECHOdelay
300ms
40%
35%
就绪 · 选择音频后即可加混响/回声并导出
第一节

关于本工具

About

录完一段语音,想加点教堂回响让声音更厚重——但多数工具要么预设效果太生硬,要么参数多到不知从何下手。这个工具直接给你“大厅”“教堂”两个经典空间预设,点一下就能听效果;觉得不够准,还能手动调混响时间、延迟和干湿比。所有处理在浏览器里完成,音频不上传服务器。

使用场景

教堂婚礼试音

策划师在 200 座的石砌教堂调试音响,发现混响时间过长,人声尾音拖沓 1.5 秒,导致誓言模糊。用本工具将原始干声直接导入,预设「教堂」参数(混响时间 2.8s、预延迟 50ms),3 秒生成对比音频,现场播放后确认混响衰减曲线与空间容积匹配,省去搬调音台和租借测量仪的费用。

播客片头氛围化

独立播客制作人录完一期访谈,想给片头 15 秒人声加「空旷大厅」的沉浸感,但宿主软件自带混响插件干涩刺耳。把干声上传本工具,选「大厅」预设(混响时间 2.0s、扩散 80%),调整干湿比至 40:60,导出后直接替换原音轨,无需在 DAW 里挂第三方 VST 或调 EQ 补偿。

游戏角色配音测试

独立游戏配音演员需要在 3 小时内提交 5 段角色台词,甲方要求「山洞回音」效果。用本工具的自定义参数:混响时间 3.5s、高频衰减 0.6、预延迟 30ms,直接处理干声,对比 A/B 播放后确认空间感符合「地下矿洞」设定,比用卷积混响加载 IR 文件快 20 分钟。

短视频旁白去干涩

美食博主在厨房用手机录旁白,房间吸音差导致人声发闷。把音频导入本工具,选「大厅」预设(混响时间 1.2s、混响电平 -12dB),干湿比调至 70:30,导出后旁白边缘变圆润,背景锅铲声未被过度掩盖,直接替换原视频音轨,省去在剪辑软件里手动画包络线的时间。

广播剧环境声模拟

广播剧后期需要 3 秒「废弃工厂」脚步声混响,但现场录制的干声只有踩碎石声。用本工具自定义参数:混响时间 2.5s、扩散 90%、预延迟 40ms,将干声处理 3 遍并叠加不同衰减曲线,得到 5 层空间感,直接嵌入工程,无需搭建卷积混响的脉冲响应文件库。

第二节

使用指南

Getting Started

使用步骤

  1. 1在「混响类型」下拉菜单选择「大厅」或「教堂」,预览区即时切换对应的空间混响波形
  2. 2拖动「混响时间」滑块(0.1–10.0 秒),右侧频谱图同步显示衰减曲线变化
  3. 3调整「干湿比」旋钮(0%–100%),波形叠加区实时更新原始音与混响音的混合比例
  4. 4点击「试听」按钮播放当前参数下的混响效果,进度条显示播放位置
  5. 5确认效果后点击「导出」按钮,浏览器自动下载处理后的音频文件

输入输出示例

输入输出说明
混响强度: 0.8, 房间大小: 50, 衰减时间: 2.0, 干湿比: 70:30输出音频文件(WAV/MP3,带大厅混响效果)常规:典型大厅混响参数,验证基础混响效果是否可听
混响强度: 0.0, 房间大小: 10, 衰减时间: 0.5, 干湿比: 100:0输出音频文件(与原音频无差异)边界:混响强度为0时,输出应与输入完全一致,验证无混响处理逻辑
混响强度: 1.0, 房间大小: 100, 衰减时间: 10.0, 干湿比: 0:100输出音频文件(强混响,仅混响信号,无干声)边界:极端参数(最大房间、最长衰减、纯湿声),验证工具是否崩溃或产生削波
混响强度: 0.5, 房间大小: -5, 衰减时间: 1.0, 干湿比: 50:50提示错误:房间大小必须为1-100之间的整数易错:负值房间大小被拒绝,验证输入校验逻辑
混响强度: 0.5, 房间大小: 30, 衰减时间: 0.0, 干湿比: 50:50输出音频文件(无混响,等同于干声)边界:衰减时间为0时,混响效果应消失,验证衰减时间下限处理
混响强度: 0.3, 房间大小: 20, 衰减时间: 1.5, 干湿比: 80:20输出音频文件(轻微教堂混响效果)常规:小房间、短衰减、低强度,模拟教堂混响的典型参数组合
混响强度: 0.9, 房间大小: 80, 衰减时间: 5.0, 干湿比: 60:40输出音频文件(强混响,可能产生回声感)易错:大房间+长衰减可能导致明显回声而非平滑混响,提示用户参数间相互作用

常见错误对照

1.混响时间与房间大小不匹配

✗ 错误选择「大厅」预设后,输入混响时间 0.3 秒
✓ 修复选择「大厅」预设时,混响时间设置在 1.5-3.0 秒之间

「大厅」预设模拟的是大空间声学环境,0.3 秒属于小房间(如浴室)的混响时长,两者搭配会产生「在空旷大厅里说话却像在厕所里」的听觉矛盾。

2.预延时参数设为负值

✗ 错误预延时(Predelay)输入 -50ms
✓ 修复预延时输入 0-200ms 之间的正值

预延时表示直达声与首次反射声之间的时间间隔,负值在物理上无意义,FFmpeg 的 aecho 滤波器会将其截断为 0 或引发异常行为。

3.干湿比之和超过 100% 导致削波

✗ 错误干声 80% + 湿声 60%
✓ 修复干声 50% + 湿声 50%,或干声 70% + 湿声 30%

干湿比是混音比例,总和超过 100% 会使输出信号峰值超过 0dBFS,产生数字削波失真,表现为刺耳爆音。

4.衰减因子大于 1 引发自激

✗ 错误衰减因子(Decay)设为 1.5
✓ 修复衰减因子设置在 0.1-0.9 之间

衰减因子 > 1 意味着每次反射能量不降反升,在数字信号处理中会形成正反馈回路,导致输出信号指数级增长直至削波或静音。

5.采样率不匹配导致混响效果异常

✗ 错误上传 44.1kHz 音频,但自定义参数中混响采样率设为 48kHz
✓ 修复混响采样率与输入音频采样率保持一致,或留空让工具自动匹配

FFmpeg 的混响滤波器默认使用输入音频的采样率,手动指定不同采样率会造成时域缩放,使混响听起来音高偏移或节奏错位。

6.立体声文件只处理单声道

✗ 错误对立体声文件只设置一个声道参数
✓ 修复使用 pan 滤镜或明确指定左右声道分别处理

FFmpeg 的混响滤波器默认作用于所有声道,但若只给单声道参数,立体声文件会丢失声道分离度,输出变成单声道混响。

7.混响时间过长导致尾音重叠

✗ 错误在语速较快的播客片段中使用 5 秒混响
✓ 修复语速快的内容使用 0.5-1.2 秒混响,慢速人声可用 1.5-3 秒

混响时间超过音节间隔时,前一个音节的尾音会覆盖后一个音节,造成「糊成一片」的听觉效果,尤其影响语音清晰度。

8.未区分早期反射与后期混响参数

✗ 错误用同一个衰减参数控制所有反射
✓ 修复分别设置早期反射(0-50ms)和后期混响(50ms+)的衰减曲线

真实声学中早期反射决定空间感,后期混响决定氛围感。FFmpeg 的 aecho 滤波器支持分段设置,混为一谈会使声音缺乏层次。

第三节

工作原理

How It Works

核心公式

y(t) = x(t) * g + α * x(t - τ) + α² * x(t - 2τ) + ... + αⁿ * x(t - nτ)

变量说明

  • y(t)输出信号在时刻 t 的幅值
  • x(t)原始输入信号在时刻 t 的幅值
  • g干声增益,控制原始信号音量
  • α衰减因子,0<α<1,控制回声衰减速度
  • τ延迟时间(秒),相邻回声间隔
  • n回声次数,由衰减阈值决定

示例

输入一段 0.5 秒的短音,设 g=0.8, α=0.6, τ=0.1 秒,衰减阈值 -60 dB(αⁿ<0.001 时停止)。 第 0 次回声:0.8 * x(t) 第 1 次回声:0.6 * x(t-0.1) 第 2 次回声:0.36 * x(t-0.2) 第 3 次回声:0.216 * x(t-0.3) 第 4 次回声:0.1296 * x(t-0.4) 第 5 次回声:0.07776 * x(t-0.5) 第 6 次回声:0.046656 * x(t-0.6) 第 7 次回声:0.0279936 * x(t-0.7) 第 8 次回声:0.01679616 * x(t-0.8) 第 9 次回声:0.010077696 * x(t-0.9) 第 10 次回声:0.006046618 * x(t-1.0)(已低于阈值,停止) 最终输出为原始信号与 10 次衰减回声的叠加,模拟大厅中声音逐渐消散的效果。

原始音频预设/自定义参数解析FFmpeg混响滤镜输出
用户输入 本地处理 输出结果
第五节

常见问题

Q & A
我上传的音频没声音了,是不是出bug了?

大概率不是bug。混响效果会降低原始干声的音量比例,尤其当混响强度(decay)设得很大时,原始声会被「淹没」在回声里,听起来像没声音。建议先试一个短片段(5-10秒),把干湿混合比例(wet/dry mix)从50%开始调,听清楚原始声还在,再逐步增加混响强度。如果完全静音,检查一下浏览器是否禁用了音频播放。

大厅和教堂到底有什么区别?

核心区别是混响尾音的衰减速度和频率反射特性。大厅模拟的是空旷平顶空间,声音反射次数多、衰减慢(decay time通常在1.5-3秒),中高频反射更明显,听起来空旷悠长。教堂模拟的是高穹顶石壁空间,早期反射更密集、低频混响更重,衰减时间可达3-5秒,听起来更「庄严」。本工具的「大厅」和「教堂」预设分别固定了decay time和房间尺寸参数,如果追求更精准的效果,用自定义模式手动调。

为什么我调了参数但效果没变化?

最常见的原因是参数改了之后没有点「应用」或「生成」按钮——本工具是参数提交后由FFmpeg重新渲染,不是实时预览。另外,部分浏览器对音频标签的缓存有延迟,建议生成后刷新一下播放器。如果参数跨度太小(比如decay time从2.0秒改到2.1秒),人耳可能听不出差异,尝试把decay time从1秒跳到3秒,或把房间大小从10米改到50米。

这个工具处理后的音频会保存到你们服务器吗?

不会。工具基于FFmpeg在浏览器端(WASM)或后端处理,处理过程中音频文件仅暂存于服务器内存用于转换,转换完成后立即删除。最终输出文件直接通过浏览器下载到本地,服务器不保留任何副本。如果对隐私极度敏感,可以上传后断网处理(WASM模式无需联网,但需首次加载时联网下载FFmpeg内核)。

上传的音频文件大小有限制吗?

浏览器端处理(WASM)受限于浏览器内存,建议文件不超过50MB、时长不超过10分钟。后端处理支持更大文件,但单次上传上限设为200MB。如果文件过大,建议先用其他工具截取片段测试参数,确定效果后再处理全长文件。音频格式方面,支持常见的MP3、WAV、FLAC、AAC、OGG,不支持的格式会提示转换失败。

自定义参数里的「房间大小」「衰减时间」「早反射」分别控制什么?

房间大小(room size)决定虚拟空间的体积,值越大(如50米)声音反射路径越长,混响越「空旷」。衰减时间(decay time)控制混响尾音的持续时间,以秒为单位,2秒以上会明显感觉回声「拖尾」。早反射(early reflections)是声音到达听众前第一次反射的密度和强度,值越高声音越「清晰有空间感」,过低会让混响听起来像单纯的延迟回声。建议先调房间大小和衰减时间,早反射作为微调。

为什么处理后的音频比原文件大很多?

混响效果本质上是叠加多个延迟和衰减后的音频信号,FFmpeg在处理时默认输出为无损WAV格式(采样率与原文件一致),体积自然会膨胀。如果原文件是MP3(有损压缩),转成WAV后体积可能增大5-10倍。可以在下载前选择输出格式为MP3(320kbps)或AAC,体积会大幅缩小,同时混响效果保留得很好。

我想让声音听起来像在小房间里说话,该怎么调?

把「房间大小」调到3-8米(小房间范围),「衰减时间」调到0.3-0.8秒(短尾音),「早反射」设为中等偏高(让第一次反射明显但不刺耳)。如果觉得声音太「干」,可以适当增加干湿混合比例中的湿声(wet)到30%-40%。这样模拟的是卧室或小型录音棚的效果,人声清晰但有环境包围感。

隐私保证所有计算与处理均在你的浏览器本地完成,输入数据不会上传服务器,也不会保存或共享。

选择 打开 +新窗口 esc关闭