什么是 DSP 特效?
DSP(数字信号处理)特效是实时应用于你声音的音频转换。与改变你声音身份的 AI 语音转换不同,DSP 特效塑造你音频的音调、动态和空间特性。把 DSP 想象成音频领域的照片滤镜——它们增强和提炼原始信号。在 Echo 中,DSP 特效在 AI 语音转换之后应用,让你能将输出润色到录音室级别。
噪声门——消除背景噪音
噪声门是效果链中的第一个效果。它的工作原理像一个自动静音开关:当你的声音低于设定的阈值(通常是 -40dB 到 -30dB)时,门会关闭,没有音频通过。当你说话时,门会打开。这能消除键盘敲击声、风扇噪音、房间嗡嗡声以及任何否则会被传输的环境声音。为了达到最佳效果,将阈值设置得略高于你房间的噪音底噪。如果设置得太高,门会切掉安静词语的开头部分。
均衡器 (EQ)——塑造你的音色
均衡器让你能够增强或削减特定的频率范围。对于人声,关键范围是:80-250 Hz(温暖和厚度),250-500 Hz(浑浊感——通常需要削减),1-4 kHz(临场感和清晰度),以及 4-8 kHz(空气感和齿音)。一个常见的人声 EQ 配方:在 300 Hz 附近削减 2-3dB 以减少浑浊感,在 3 kHz 附近增强 2dB 以增加清晰度,并在 80 Hz 应用一个温和的高通滤波器以去除隆隆声。Echo 包含一个 10 段图形均衡器,并为常见声音类型提供了预设。
压缩器——保持音量一致
压缩器减小你声音的动态范围,使安静的部分更响,响亮的部分更安静。这对于游戏和直播至关重要,因为你可能前一秒在低声报点,下一秒就大喊大叫。关键参数:阈值(压缩开始生效的电平),比率(信号被压缩的程度),启动时间(压缩多快开始),和释放时间(多快停止)。对于人声,可以从以下参数开始:阈值 -20dB,比率 3:1,启动时间 10ms,释放时间 100ms。
混响——增加空间感和深度
混响模拟物理空间的声学反射。少量的混响能让声音听起来更自然,不那么“干”。太多的混响会使语音难以听清。对于游戏和直播,使用一个衰减时间低于 0.5 秒的短房间混响,并且混合度低于 15%。对于创意效果(播音员声音、洞穴回声、大教堂),增加衰减时间和混合度。Echo 包含房间、大厅、板式和大教堂的预设混响。
效果链顺序
效果的顺序很重要。标准的效果链是:输入 → 噪声门 → EQ → 压缩器 → AI 语音转换 → 混响 → 输出。噪声门放在最前面,以防止噪音被后续效果处理。EQ 在压缩前塑造音色。压缩器平衡动态。AI 转换改变声音身份。混响放在最后,为最终输出增加自然的空间感。
- ●1. 噪声门——清理输入
- ●2. 高通滤波器——去除 80 Hz 以下的隆隆声
- ●3. 均衡器——塑造音色和清晰度
- ●4. 压缩器——平衡动态
- ●5. AI 语音转换——改变声音身份
- ●6. 去齿音器——抑制刺耳的齿音(可选)
- ●7. 混响——增加空间深度
- ●8. 限制器——防止削波