• ESP-Audio-Effects

    专业的高性能音频效果处理库

ESP-Audio-Effects 是乐鑫面向 ESP32 系列 SoC 推出的专业音频处理库,覆盖格式转换、动态控制、音效处理等核心能力,广泛适用于智能音箱、耳机、语音交互等嵌入式音频产品。各模块资源占用极低,接口风格一致,可单独集成也可串联组合,开发者可根据产品需求灵活搭建音频处理链路。

功能介绍

  • 格式转换
  • 数据路由
  • 动态调节
  • 音频效果
Input Channels LRC LR
  • 采样率转换
  • 位深转换
  • 声道转换

采样率转换

将音频信号的采样率转换为目标采样率,支持 4 kHz 至 192 kHz 范围内的采样率转换,针对 4 kHz 与 11.025 kHz 的整数倍采样率提供高效互转,适配各类设备与编解码链路的格式需求。

详情参数

  • 多声道
  • 支持 4 kHz 或 11.025 kHz 整数倍的采样率,最高至 192 kHz
  • s16、s24、s32 位深
  • 支持 3 种复杂度等级

位深转换

将音频每采样位数在 u8、s16、s24、s32 之间相互转换,用于对接位深不同的音频源、编解码器或输出设备。

详情参数

  • 多声道
  • 任意采样率
  • u8、s16、s24、s32 位深
  • 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局

声道转换

将音频信号的声道数转换为目标声道数,各声道的混合比例通过权重矩阵灵活配置,适应不同的声道布局需求。

详情参数

  • 多声道
  • 任意采样率
  • u8、s16、s24、s32 位深
  • 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局
Ch A Ch B Interleave Deinterleave
Audio 1 Audio 2 Audio 3
  • 数据交织器
  • 混音器

数据交织器

用于多声道数据的格式整理,支持将各声道独立缓冲区的数据交织合并为连续输出,也可将交织数据拆分还原为各声道的独立缓冲区。

详情参数

  • 多声道
  • 任意采样率
  • s16、s24、s32 位深

混音器

将多路音频信号按各自权重叠加为一路输出,各路权重可独立配置,并支持带过渡时间的淡入淡出切换,适用于背景音混合、多路音源合并输出等场景。

详情参数

  • 多声道
  • 任意采样率
  • s16、s24、s32 位深
  • 支持设置两组稳定权重
  • 支持在两组权重之间平滑切换
  • 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局
普通增加音量 ALC
LowLow MidHigh MidHigh
  • 自动电平控制
  • 动态范围控制
  • 多频段压缩器

自动电平控制

压缩波峰,消掉过高凸起,防止波形顶部消平,避免音量突增或突降带来的不适。增益可按声道独立设置,适用于麦克风拾音电平不稳定、多场景切换等场合。

详情参数

  • 多声道
  • 任意采样率
  • s16、s24、s32 位深
  • 增益范围(−64, 63] dB
  • 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局

动态范围控制

通过自定义增益曲线对音频动态范围进行调节。支持压缩、限幅、扩展、噪声门等多种处理场景。曲线最多支持 6 个分段点,攻击、释放与保持时间均可独立配置,阈值过渡方式支持硬膝与软膝两种模式。

详情参数

  • 多声道
  • 任意采样率
  • s16、s24、s32 位深
  • 最多 6 个分段点的动态范围曲线配置
  • 补偿增益范围:−10.0 至 10.0 dB
  • 攻击时间范围:0 至 500 ms
  • 释放时间范围:0 至 500 ms
  • 保持时间范围:0 至 100 ms
  • 膝宽范围:0.0 至 10.0 dB,用于平滑阈值过渡
  • 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局

多频段压缩器

将音频频谱划分为四个频带,各频带独立进行压缩处理,分频点与每个频带的压缩参数均可单独配置。相比单段压缩,多段结构可针对不同频率范围分别控制动态,处理更精细,各频带还支持独奏与旁路切换。

详情参数

  • 多声道
  • 任意采样率
  • s16、s24、s32 位深
  • 四分频结构,分频点可配置
  • 各频带独立压缩参数
  • 阈值范围:−100 至 0 dB(不含端点)
  • 压缩比范围:1:1 至 ∞:1
  • 补偿增益范围:−10 至 10 dB
  • 攻击时间范围:0 至 500 ms
  • 释放时间范围:0 至 500 ms
  • 保持时间范围:0 至 100 ms
  • 膝宽范围:0 至 10 dB,用于平滑阈值过渡
  • 各频带独奏与旁路
  • 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局
Fade InFull LevelFade Out
Howl
Input Waveform Feedback Delay Tail
  • 均衡器
  • 淡入淡出
  • 变速/变调
  • 啸叫抑制
  • 混响
  • 延迟

均衡器

支持高通、低通、高搁架、低搁架、峰值五种滤波器类型,可多个滤波器组合使用,对不同频率范围进行独立的增益调整。中心频率、Q 值与增益均支持运行时动态更新,无需重新初始化。

详情参数

  • 多声道
  • 任意采样率
  • s16、s24、s32 位深
  • 支持单个或多个滤波器组合使用
  • 支持滤波器类型:高通 (High Pass)、低通 (Low Pass)、高搁架 (High Shelf)、低搁架 (Low Shelf)、峰值 (Peak)
  • 支持滤波器参数运行时更新
  • 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局

淡入淡出

通过逐步增减音量实现音频的平滑淡入或淡出,支持线性与曲线两种过渡方式,适用于音频流切换、开关静音等场景。

详情参数

  • 多声道
  • 任意采样率
  • s16、s24、s32 位深
  • 支持模式:淡入 (Fade-In)、淡出 (Fade-Out)
  • 支持曲线:线性 (line)、二次 (quadratic)、平方根 (sqrt)
  • 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局

变速/变调

速度与音高可独立或同时调整,调节范围均为 0.5 至 2.0 倍。变速不改变音高,变调不影响播放速度,也可同时设置两者得到不同的速度与音高组合。

详情参数

  • 多声道
  • 任意采样率
  • s16、s24、s32 位深
  • 速度调节范围:0.5× 至 2.0×
  • 音高调节范围:0.5× 至 2.0×

啸叫抑制

实时检测麦克风与扬声器之间声学回路中产生的啸叫,自动识别啸叫频点并加以抑制,检测阈值可配置,支持多声道独立处理。

详情参数

  • 支持采样率:8 kHz、16 kHz、32 kHz、44.1 kHz、48 kHz
  • s16、s24、s32 位深
  • 支持多声道独立处理
  • 可配置检测阈值
  • 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局

混响

支持混响 (Reverb) 音频效果,模拟真实环境中的声音反射与空间扩散,增强音频的空间感和临场感。基于 Freeverb (Schroeder–Moorer) 算法实现,通过梳状滤波器与全通滤波器组合构建自然混响效果,兼顾音质与资源占用。

详情参数

  • 多声道
  • 任意采样率
  • s16、s24、s32 位深
  • 房间大小因子[0.0, 1.0]
  • 高频阻尼因子[0.0, 1.0]
  • 湿信号(混响)电平 [96.0, 0.01] dB
  • 干信号(原始)电平 [96.0, 0.01] dB
  • 混响前置延迟时间[0, 200] ms
  • 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局

延迟

支持延迟 (Delay) 音频效果,通过生成输入信号的延迟副本,实现自然的回声效果。采用基于反馈延迟线的轻量级实现,可调节反馈系数控制回声次数及衰减速度,适用于回声增强、空间感营造等场景。

详情参数

  • 多声道
  • 任意采样率
  • s16、s24、s32 位深
  • 可配置最大延迟时间:[0, 1000] ms
  • 延迟时间范围:[0, max_delay_ms] ms
  • 反馈系数范围:[0.0, 0.95]
  • 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局

方案优势

极低资源占用

多数模块在 ESP32-S3 (240 MHz) 上 CPU 占用低于 1%,内存消耗以 KB 为量级;在计算量最高的多段压缩器下,CPU 占用能控制在 5% 以内,完美适配嵌入式平台。

参数配置灵活

支持运行时动态调整。均衡器可独立配置滤波器、频率与增益;动态范围控制与多段压缩器同时支持自定义增益曲线及攻击、释放、保持时间。

接口统一简洁

14 个模块调用方式一致,一套模式即可上手所有模块,便于快速替换与流程扩展。

灵活按需组合

各模块相互独立,可单独使用也可串联组合,兼容多种采样率与声道配置,满足从语音到高保真音乐的全场景需求。

全系列芯片支持

覆盖乐鑫 ESP32 全系列 SoC,无缝集成 ESP-IDF 与 ESP-GMF 等项目工程。