让终端在真实空间里听清、听懂、听自然

蓝源视讯前端音频算法面向会议协作、机器人、玩具和消费电子终端,覆盖远场拾音、AI降噪、AI去混响、回声消除、声源定位、AI智能音幕、ASR增强、自动增益和全双工通话。

32kHz高采样率拾音 AI NR非稳态噪声抑制 DOA声源方向输出 60°/90°/120°智能音幕拾音 ASR+转写准确率增强

从麦克风阵列到清晰语音输出

算法不是单点功能,而是一条围绕真实声学空间构建的处理链路:先稳定拾音,再压低干扰,最后把更自然的人声送到远端。

01

AI 降噪

滤除风扇、空调、背景声等稳态噪声,也能压低键盘、敲击、拍手、音乐等非稳态噪声,保留人声主体。

02

AI 去混响

削弱玻璃房、硬质墙面和空旷空间里的语音拖尾,让远端听到更靠前、更清楚的直达声。

03

AI 回声消除

在扬声器播放远端声音时抑制回采到麦克风的回声,减少啸叫、回音和双讲打断感。

04

32kHz 高采样率拾音

保留更多人声细节与高频信息,相比低采样率声音更清晰、更自然,适合远场会议和语音交互。

05

DOA 声源定位

结合麦克风阵列估计讲话方向,可输出角度数据,用于发言人跟踪、摄像头联动和多设备协同。

06

AI 智能音幕

可按60度、90度或120度扇形范围限定拾音区域,突出目标方向人声,降低范围外干扰。

07

ASR 增强算法

面向会议转写、实时字幕和语音交互优化前端音频输入,提升噪声与远场场景下的ASR识别准确率。

08

3A 与全双工通话

AEC、ANS、AGC 与全双工能力共同降低断续感,让双方同时说话时也能保持自然沟通。

面向产品集成的音频处理链路

输入

多麦阵列拾音

支持4麦、8麦和更高阵列配置,采集远场人声、环境噪声、扬声器回采和空间混响信息。

理解

AI 语音建模

识别人声主体、噪声类型、回声路径、讲话方向和目标拾音区域,为后续增强、定位和联动提供判断依据。

增强

降噪、去混响、回声消除

降低复杂声学环境中的干扰,控制音量稳定性,保留更完整的人声细节。

输出

清晰语音与方向数据

输出更稳定的语音信号、ASR友好音频,并可向摄像头或系统侧提供DOA角度、音幕范围、讲话状态等联动数据。

算法录音对比

建议使用耳机或高保真扬声器试听差异。

AI 降噪

含噪语音进入算法后,背景噪声被压低,人声主体更突出。

AI 去混响

降低玻璃房、硬质空间中的语音拖尾,提升语音可懂度。

AI 回声消除

分离远端播放声和本地拾音,减少远端听到自己声音的回声。

高采样率拾音

32kHz拾音保留更多人声细节,声音更自然、更清晰。

可集成的核心能力矩阵

能力 解决的问题 产品价值
AI 降噪 稳态噪声与非稳态噪声干扰人声 远端听感更干净,会议和语音交互更稳定
AI 去混响 玻璃房、开放空间中的语音拖尾和模糊感 讲话主体更靠前,可懂度更高
AI 回声消除 扬声器声音回采导致远端听到自己 双讲更自然,减少回声和通话打断
DOA / 波束成形 多人会议中讲话方向和主体不清晰 支持发言人跟踪、摄像头联动和阵列增强
AI 智能音幕 开放会议、前台咨询和多人协作中范围外声音干扰拾音 支持60度、90度、120度扇形拾音,让设备聚焦指定方向
ASR 增强 噪声、混响、远场拾音和音量波动降低语音转写准确率 为ASR引擎提供更清晰稳定的前端语音,提高会议纪要和字幕转写准确率
32kHz 拾音 低采样率导致声音发闷、细节不足 保留更多语音细节,提升自然度和清晰度

让AI音频算法进入你的下一款终端

蓝源视讯可根据产品形态、麦克风阵列、扬声器结构和目标场景,提供算法集成与整机调试支持。

联系我们