摘要
本发明实施例公开了一种基于多模态融合的动态意图理解方法,包括:获取用户在本次对话中的多模态行为数据;根据本次对话是否为首次对话,对本次对话文本进行改写;将改写后的对话文本和其它多模态行为数据共同提供至大模型,提示大模型识别本次对话的意图;具体的,提示语中指定大模型的角色为用户对话意图理解专家,指定典型对话模式下的理解技巧,指定待识别的多种意图类型及其描述,并指示大模型根据指定的角色和信息对所述改写后的对话和其它多模态行为数据进行理解,判断本次对话属于所述多种意图类型中的哪一种;根据意图识别结果调用对应的业务流程,为本次对话提供有用信息。本实施例能够提高在线学习场景下的用户意图识别效果。