本公开涉及车辆,特别涉及一种基于语音识别的交互方法、装置、电子设备、存储介质和车辆。
背景技术:
1、目前,随着人工智能、自然语言处理等技术的发展,语音交互技术在车载终端、业务办理、手机等场景中得到了广泛的应用,方便了人们的生活。比如,车载终端场景下,乘客可说“我想唱xx”,车载终端可通过点歌应用来播放音乐,不需要乘客手动开启点歌应用,并搜索歌曲。然而,相关技术中,智能设备存在无法响应用户的语音交互的情况,即相关技术中的语音交互方法的响应性较差。
技术实现思路
1、本公开旨在至少在一定程度上解决上述技术中的技术问题之一。
2、为此,本公开的第一个目的在于提出一种基于语音识别的交互方法。
3、本公开的第二个目的在于提出一种基于语音识别的交互装置。
4、本公开的第三个目的在于提出一种电子设备。
5、本公开的第四个目的在于提出一种计算机可读存储介质。
6、本公开的第五个目的在于提出一种车辆。
7、本公开第一方面实施例提出了一种基于语音识别的交互方法,包括:接收语音控制指令,并根据所述语音控制指令确定智能设备的语音交互场景;响应于所述语音交互场景为多媒体信息交互场景,获取所述智能设备的语音交互界面的展示信息;根据所述智能设备的多媒体设备状态信息,判断所述多媒体设备是否处于目标状态,得到判断结果;根据所述语音交互界面的展示信息,和/或所述判断结果,识别所述智能设备是否满足进入多人模式的条件;若所述智能设备满足进入多人模式的条件,控制所述智能设备进入多人模式。
8、另外,根据本公开上述实施例提出的基于语音识别的交互方法还可以具有如下附加的技术特征:
9、在本公开的一个实施例中,所述多媒体信息包括音频、视频、图像、信息中的至少一种;所述根据所述语音交互界面的展示信息,和/或所述判断结果,识别所述智能设备是否满足进入多人模式的条件,包括:若所述语音交互界面的展示信息包括所述多媒体信息交互场景的关联信息,且所述多媒体设备处于目标状态,识别所述智能设备满足进入多人模式的条件;或者,若所述语音交互界面展示信息未包括所述多媒体信息交互场景的关联信息,和/或所述多媒体设备未处于目标状态,识别所述智能设备未满足进入多人模式的条件。
10、在本公开的一个实施例中,所述控制所述智能设备进入多人模式之后,还包括:采集多个用户的语音信息,并基于多个所述用户的语音信息分别确定对应的用户的身份信息,基于所述用户的身份信息与语音交互界面之间的对应关系,得到所述用户的身份信息对应的语音交互界面;对所述用户的语音信息进行语义分析,生成所述用户对应的第一语音交互指令,并控制所述智能设备在所述用户对应的语音交互界面上执行所述用户对应的第一语音交互指令。
11、在本公开的一个实施例中,所述基于多个所述用户的语音信息分别确定对应的用户的身份信息,包括:获取多个所述用户的语音信息的来源信息;从多个所述来源信息中分别提取出对应的用户的身份信息。
12、在本公开的一个实施例中,所述控制所述智能设备在所述用户对应的语音交互界面上执行所述用户对应的第一语音交互指令,包括:判断所述用户对应的语音交互界面的展示信息是否包括所述多媒体信息交互场景的关联信息;若所述用户对应的语音交互界面的展示信息包括所述多媒体信息交互场景的关联信息,控制所述智能设备在所述用户对应的语音交互界面上执行所述用户对应的第一语音交互指令。
13、在本公开的一个实施例中,多个所述用户的语音信息包括第二用户的语音信息,还包括:若所述第二用户对应的语音交互界面的展示信息未包括所述多媒体信息交互场景的关联信息,判断第三用户对应的语音交互界面的展示信息是否包括所述多媒体信息交互场景的关联信息,其中,所述第二用户、所述第三用户为不同的用户;若所述第三用户对应的语音交互界面的展示信息包括所述多媒体信息交互场景的关联信息,控制所述智能设备在所述第三用户对应的语音交互界面上执行所述第二用户对应的第一语音交互指令。
14、在本公开的一个实施例中,所述控制所述智能设备在所述第三用户对应的语音交互界面上执行所述第二用户对应的第一语音交互指令,包括:判断所述第二用户对应的第一语音交互指令是否为目标类别的指令;若所述第二用户对应的第一语音交互指令非所述目标类别的指令,控制所述智能设备在所述第三用户对应的语音交互界面上执行所述第二用户对应的第一语音交互指令。
15、在本公开的一个实施例中,所述对所述用户的语音信息进行语义分析,生成所述用户对应的第一语音交互指令,包括:对所述用户的语音信息进行语音识别,得到所述用户对应的识别文本;获取所述多媒体信息交互场景的模板文本库;获取所述用户对应的识别文本与所述模板文本库中的模板文本之间的相似度;若所述相似度大于或者等于设定阈值,对所述用户的语音信息进行语义分析,生成所述用户对应的第一语音交互指令。
16、本公开第二方面实施例提出了一种基于语音识别的交互装置,包括:确定模块,用于接收语音控制指令,并根据所述语音控制指令确定智能设备的语音交互场景;获取模块,用于响应于所述语音交互场景为多媒体信息交互场景,获取所述智能设备的语音交互界面的展示信息;判断模块,用于根据所述智能设备的多媒体设备状态信息,判断所述多媒体设备是否处于目标状态,得到判断结果;识别模块,用于根据所述语音交互界面的展示信息,和/或所述判断结果,识别所述智能设备是否满足进入多人模式的条件;控制模块,用于若所述智能设备满足进入多人模式的条件,控制所述智能设备进入多人模式。
17、本公开第三方面实施例提出了一种电子设备,包括:存储器、处理器及存储在存储器上并可在处理器上运行的计算机程序,所述处理器执行所述程序时,实现如本公开第一方面实施例所述的基于语音识别的交互方法。
18、本申请第四方面实施例提出了一种计算机可读存储介质,其上存储有计算机程序,该程序被处理器执行时,实现如本公开第一方面实施例所述的基于语音识别的交互方法。
19、本申请第五方面实施例提出了一种车辆,包括如本公开第二方面实施例所述的基于语音识别的交互装置;或者如本公开第三方面实施例所述的电子设备;或者如本公开第四方面实施例所述的计算机可读存储介质。
20、本公开实施例提供的技术方案至少带来以下有益效果:在智能设备的语音交互场景为多媒体信息交互场景时,可获取智能设备的语音交互界面的展示信息,并判断多媒体设备是否处于目标状态,可综合考虑到语音交互界面的展示信息和判断结果,来识别智能设备是否满足进入多人模式的条件,并在智能设备满足进入多人模式的条件时,控制智能设备进入多人模式,可有效避免在智能设备不满足进入多人模式的条件时,控制智能设备进入多人模式,导致语音交互的响应性差的问题,提高了智能设备进入多人模式的可靠性,进而提高了语音交互的响应性。
21、应当理解的是,以上的一般描述和后文的细节描述仅是示例性和解释性的,并不能限制本公开。
1.一种基于语音识别的交互方法,其特征在于,包括:
2.根据权利要求1所述的方法,其特征在于,所述多媒体信息包括音频、视频、图像、信息中的至少一种;
3.根据权利要求1所述的方法,其特征在于,所述控制所述智能设备进入多人模式之后,还包括:
4.根据权利要求3所述的方法,其特征在于,所述基于多个所述用户的语音信息分别确定对应的用户的身份信息,包括:
5.根据权利要求3所述的方法,其特征在于,所述控制所述智能设备在所述用户对应的语音交互界面上执行所述用户对应的第一语音交互指令,包括:
6.根据权利要求5所述的方法,其特征在于,多个所述用户的语音信息包括第二用户的语音信息,还包括:
7.根据权利要求6所述的方法,其特征在于,所述控制所述智能设备在所述第三用户对应的语音交互界面上执行所述第二用户对应的第一语音交互指令,包括:
8.根据权利要求3所述的方法,其特征在于,所述对所述用户的语音信息进行语义分析,生成所述用户对应的第一语音交互指令,包括:
9.一种基于语音识别的交互装置,其特征在于,包括:
10.一种电子设备,其特征在于,包括:存储器、处理器及存储在存储器上并可在处理器上运行的计算机程序,所述处理器执行所述程序时,实现如权利要求1-8中任一项所述的基于语音识别的交互方法。
11.一种计算机可读存储介质,其上存储有计算机程序,其特征在于,该程序被处理器执行时实现如权利要求1-8中任一项所述的基于语音识别的交互方法。
12.一种车辆,其特征在于,包括:如权利要求9所述的基于语音识别的交互装置;或者如权利要求10所述的电子设备;或者如权利要求11所述的计算机可读存储介质。
