摘要
本申请提供了一种基于大模型和RAG的语音交互智能知识检索方法,涉及智能知识检索技术领域,包括:将原始数据进行清洗,并分割成多个知识片段,通过文本嵌入模型将每个知识片段转换成向量,以构成向量数据库;基于预设的唤醒词触发音频采集,以将用户语音输入保存为音频片段,通过语音识别算法将音频片段转换为文本信息;通过文本嵌入模型将文本信息转换成问题向量,使用BM25算法在向量数据库中检索与问题向量相关的知识片段,根据相似度得分对检索到的知识片段进行排序,选择前N个知识片段;将前N个知识片段与文本信息合并,形成上下文信息,将上下文信息输入到大语言模型,得到答案文本,基于语音合成算法,将答案文本转换为语音输出。