摘要
本发明涉及语音处理技术领域,具体涉及一种智能音箱及音频信号处理方法,包括:在智能音箱的麦克风阵列中,根据每一帧长下不同方位角度上的麦克风的音频信号以及音频信号中不同频率下的能量值,结合用户的纯净语音信号中的基音频率,确定每一帧长下每个麦克风的音量特征值,从而筛选出目标帧长,再确定目标帧长下每个麦克风的声纹特征值,从而确定语音信号权重向量,对目标帧长下所有麦克风的音频信号构建音频信号矩阵进行加权,确定目标帧长下的用户语音信号。本发明通过提取麦克风阵列的音频信号的音量特征与声纹特征,增强面向用户声源方向处麦克风采集的音频信号的作用,提高对用户语音信号的捕捉能力。