摘要
本发明涉及智能语音交互技术领域,公开了一种基于3D虚拟的语音交互方法及系统,包括:接收用户的实时语音并进行预处理,建立语音识别模型,分析用户的发音特征和清晰度;基于用户的发音特征和清晰度,对语音识别模型进行优化;结合用户的历史命令和当前3D环境上下文,利用优化后的语音识别模型生成用户下一步的候选预测指令集合;所述候选预测指令集合包括多个候选指令;识别每个候选指令的优先级,将优先级最高的候选指令作为用户下一步的预测指令,优先加载预测指令的相关资源,快速响应用户需求。在复杂场景中更精确地预测用户需求,并且显著提升了语音交互的准确性和实时响应能力。