ESP-Audio-Effects 是乐鑫面向 ESP32 系列 SoC 推出的专业音频处理库,覆盖格式转换、动态控制、音效处理等核心能力,广泛适用于智能音箱、耳机、语音交互等嵌入式音频产品。各模块资源占用极低,接口风格一致,可单独集成也可串联组合,开发者可根据产品需求灵活搭建音频处理链路。
功能介绍
- 格式转换
- 数据路由
- 动态调节
- 音频效果
- 采样率转换
- 位深转换
- 声道转换
采样率转换
将音频信号的采样率转换为目标采样率,支持 4 kHz 至 192 kHz 范围内的采样率转换,针对 4 kHz 与 11.025 kHz 的整数倍采样率提供高效互转,适配各类设备与编解码链路的格式需求。
详情参数
- 多声道
- 支持 4 kHz 或 11.025 kHz 整数倍的采样率,最高至 192 kHz
- s16、s24、s32 位深
- 支持 3 种复杂度等级
详情参数
- 多声道
- 任意采样率
- u8、s16、s24、s32 位深
- 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局
详情参数
- 多声道
- 任意采样率
- u8、s16、s24、s32 位深
- 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局
- 自动电平控制
- 动态范围控制
- 多频段压缩器
详情参数
- 多声道
- 任意采样率
- s16、s24、s32 位深
- 增益范围(−64, 63] dB
- 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局
动态范围控制
通过自定义增益曲线对音频动态范围进行调节。支持压缩、限幅、扩展、噪声门等多种处理场景。曲线最多支持 6 个分段点,攻击、释放与保持时间均可独立配置,阈值过渡方式支持硬膝与软膝两种模式。
详情参数
- 多声道
- 任意采样率
- s16、s24、s32 位深
- 最多 6 个分段点的动态范围曲线配置
- 补偿增益范围:−10.0 至 10.0 dB
- 攻击时间范围:0 至 500 ms
- 释放时间范围:0 至 500 ms
- 保持时间范围:0 至 100 ms
- 膝宽范围:0.0 至 10.0 dB,用于平滑阈值过渡
- 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局
多频段压缩器
将音频频谱划分为四个频带,各频带独立进行压缩处理,分频点与每个频带的压缩参数均可单独配置。相比单段压缩,多段结构可针对不同频率范围分别控制动态,处理更精细,各频带还支持独奏与旁路切换。
详情参数
- 多声道
- 任意采样率
- s16、s24、s32 位深
- 四分频结构,分频点可配置
- 各频带独立压缩参数
- 阈值范围:−100 至 0 dB(不含端点)
- 压缩比范围:1:1 至 ∞:1
- 补偿增益范围:−10 至 10 dB
- 攻击时间范围:0 至 500 ms
- 释放时间范围:0 至 500 ms
- 保持时间范围:0 至 100 ms
- 膝宽范围:0 至 10 dB,用于平滑阈值过渡
- 各频带独奏与旁路
- 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局
- 均衡器
- 淡入淡出
- 变速/变调
- 啸叫抑制
- 混响
- 延迟
详情参数
- 多声道
- 任意采样率
- s16、s24、s32 位深
- 支持单个或多个滤波器组合使用
- 支持滤波器类型:高通 (High Pass)、低通 (Low Pass)、高搁架 (High Shelf)、低搁架 (Low Shelf)、峰值 (Peak)
- 支持滤波器参数运行时更新
- 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局
详情参数
- 多声道
- 任意采样率
- s16、s24、s32 位深
- 支持模式:淡入 (Fade-In)、淡出 (Fade-Out)
- 支持曲线:线性 (line)、二次 (quadratic)、平方根 (sqrt)
- 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局
详情参数
- 多声道
- 任意采样率
- s16、s24、s32 位深
- 速度调节范围:0.5× 至 2.0×
- 音高调节范围:0.5× 至 2.0×
详情参数
- 支持采样率:8 kHz、16 kHz、32 kHz、44.1 kHz、48 kHz
- s16、s24、s32 位深
- 支持多声道独立处理
- 可配置检测阈值
- 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局
混响
支持混响 (Reverb) 音频效果,模拟真实环境中的声音反射与空间扩散,增强音频的空间感和临场感。基于 Freeverb (Schroeder–Moorer) 算法实现,通过梳状滤波器与全通滤波器组合构建自然混响效果,兼顾音质与资源占用。
详情参数
- 多声道
- 任意采样率
- s16、s24、s32 位深
- 房间大小因子[0.0, 1.0]
- 高频阻尼因子[0.0, 1.0]
- 湿信号(混响)电平 [96.0, 0.01] dB
- 干信号(原始)电平 [96.0, 0.01] dB
- 混响前置延迟时间[0, 200] ms
- 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局
延迟
支持延迟 (Delay) 音频效果,通过生成输入信号的延迟副本,实现自然的回声效果。采用基于反馈延迟线的轻量级实现,可调节反馈系数控制回声次数及衰减速度,适用于回声增强、空间感营造等场景。
详情参数
- 多声道
- 任意采样率
- s16、s24、s32 位深
- 可配置最大延迟时间:[0, 1000] ms
- 延迟时间范围:[0, max_delay_ms] ms
- 反馈系数范围:[0.0, 0.95]
- 支持交织 (interleaved) 与非交织 (non-interleaved) 数据布局
方案优势
极低资源占用
多数模块在 ESP32-S3 (240 MHz) 上 CPU 占用低于 1%,内存消耗以 KB 为量级;在计算量最高的多段压缩器下,CPU 占用能控制在 5% 以内,完美适配嵌入式平台。
参数配置灵活
支持运行时动态调整。均衡器可独立配置滤波器、频率与增益;动态范围控制与多段压缩器同时支持自定义增益曲线及攻击、释放、保持时间。
接口统一简洁
14 个模块调用方式一致,一套模式即可上手所有模块,便于快速替换与流程扩展。
灵活按需组合
各模块相互独立,可单独使用也可串联组合,兼容多种采样率与声道配置,满足从语音到高保真音乐的全场景需求。
全系列芯片支持
覆盖乐鑫 ESP32 全系列 SoC,无缝集成 ESP-IDF 与 ESP-GMF 等项目工程。

