本公开涉及车辆,特别涉及一种智能设备的语音交互方法、装置、电子设备、存储介质和车辆。
背景技术:
1、目前,随着人工智能、自然语言处理等技术的发展,语音交互技术在车载终端、业务办理、手机等场景中得到了广泛的应用,方便了人们的生活。比如,车载终端场景下,乘客可说“打开空调”,车载终端可通过车控应用来打开空调,不需要乘客手动开启空调。然而,相关技术中,会因为其他用户的干扰,比如,其他用户在闲聊、打电话等,无法实现真正有语音交互意图的用户的语音交互,即相关技术中的语音交互方法的响应性较差。
技术实现思路
1、本公开旨在至少在一定程度上解决上述技术中的技术问题之一。
2、为此,本公开的第一个目的在于提出一种智能设备的语音交互方法。
3、本公开的第二个目的在于提出一种智能设备的语音交互装置。
4、本公开的第三个目的在于提出一种电子设备。
5、本公开的第四个目的在于提出一种计算机可读存储介质。
6、本公开的第五个目的在于提出一种车辆。
7、本公开第一方面实施例提出了一种智能设备的语音交互方法,包括:接收唤醒指令,控制智能设备进入唤醒状态,并从所述唤醒指令的来源信息中提取出第一用户的身份标识;采集所述第一用户的语音信息,并对所述第一用户的语音信息进行语义分析,确定所述智能设备的语音交互场景;基于所述语音交互场景与语音交互模式之间的对应关系,得到所述语音交互场景对应的语音交互模式,响应于所述语音交互模式为多人模式,控制所述智能设备进入多人模式;采集多个用户的语音信息,并基于多个所述用户的语音信息和所述语音交互场景,对多个所述用户的语音信息进行筛选,得到至少一个第二用户的语音信息;对至少一个所述第二用户的语音信息进行语义分析,生成第一语音交互指令,并控制所述智能设备执行所述第一语音交互指令。
8、另外,根据本公开上述实施例提出的智能设备的语音交互方法还可以具有如下附加的技术特征:
9、在本公开的一个实施例中,所述第二用户包括第三用户、第四用户,所述第三用户、所述第四用户为同一空间内的不同的用户,所述对至少一个所述第二用户的语音信息进行语义分析,生成第一语音交互指令,包括:对所述第三用户的语音信息进行语义分析,得到所述第三用户的语音交互意图为控制目标类别的车载设备,并基于所述目标类别的车载设备和所述第三用户的身份标识,生成第一交互指令,其中,所述第一交互指令携带所述第三用户的身份标识;对所述第四用户的语音信息进行语义分析,得到所述第四用户的语音交互意图为控制所述目标类别的车载设备,将所述第一交互指令中的所述第三用户的身份标识替换为所述第四用户的身份标识,生成第二交互指令;其中,所述第一语音交互指令包括所述第一交互指令和所述第二交互指令。
10、在本公开的一个实施例中,所述对所述第四用户的语音信息进行语义分析,得到所述第四用户的语音交互意图为控制所述目标类别的车载设备,包括:对所述第四用户的语音信息进行语音识别,得到所述第四用户对应的识别文本;判断所述第四用户对应的识别文本是否包括设定关键词;若所述第四用户对应的识别文本包括所述设定关键词,则确定所述第四用户的语音交互意图为控制所述目标类别的车载设备。
11、在本公开的一个实施例中,所述对至少一个所述第二用户的语音信息进行语义分析,生成第一语音交互指令,包括:对每个所述第二用户的语音信息进行语义分析,得到每个所述第二用户的语音交互意图;判断多个所述第二用户的语音交互意图是否关联;若多个所述第二用户的语音交互意图关联,对多个所述第二用户的语音交互意图进行融合,得到融合交互意图;基于所述融合交互意图,生成所述第一语音交互指令。
12、在本公开的一个实施例中,所述基于多个所述用户的语音信息和所述语音交互场景,对多个所述用户的语音信息进行筛选,得到至少一个第二用户的语音信息,包括:对所述用户的语音信息进行语音识别,得到所述用户对应的识别文本;获取所述语音交互场景的模板文本库;获取所述用户对应的识别文本与所述模板文本库中的模板文本之间的相似度;将所述相似度大于或者等于设定阈值的用户的语音信息,确定为所述第二用户的语音信息。
13、在本公开的一个实施例中,多个所述用户的语音信息包括所述第一用户的语音信息,所述方法还包括:判断所述第一用户对应的识别文本与所述模板文本库中的模板文本之间的相似度是否大于或者等于所述设定阈值;若所述第一用户对应的相似度小于所述设定阈值,控制所述智能设备从多人模式切换到单人模式;对所述第一用户的语音信息进行语义分析,生成第二语音交互指令,并控制所述智能设备执行所述第二语音交互指令。
14、在本公开的一个实施例中,所述控制所述智能设备进入多人模式,包括:判断所述智能设备的显示界面上是否显示所述语音交互场景关联的应用程序的页面,和/或所述智能设备是否处于全双工模式;若所述智能设备的显示界面上显示所述语音交互场景关联的应用程序的页面,和/或所述智能设备处于全双工模式,识别所述智能设备满足进入多人模式的条件,并控制所述智能设备进入多人模式。
15、在本公开的一个实施例中,还包括:若所述智能设备的显示界面上未显示所述语音交互场景关联的应用程序的页面,和/或所述智能设备处于单工模式,识别所述智能设备未满足进入多人模式的条件,并控制所述智能设备进入单人模式;对所述第一用户的语音信息进行语义分析,生成第二语音交互指令,并控制所述智能设备执行所述第二语音交互指令。
16、在本公开的一个实施例中,还包括:响应于所述语音交互模式为单人模式,控制所述智能设备进入单人模式;对所述第一用户的语音信息进行语义分析,生成第二语音交互指令,并控制所述智能设备执行所述第二语音交互指令。
17、本公开第二方面实施例提出了一种智能设备的语音交互装置,包括:唤醒模块,用于接收唤醒指令,控制智能设备进入唤醒状态,并从所述唤醒指令的来源信息中提取出第一用户的身份标识;确定模块,用于采集所述第一用户的语音信息,并对所述第一用户的语音信息进行语义分析,确定所述智能设备的语音交互场景;控制模块,用于基于所述语音交互场景与语音交互模式之间的对应关系,得到所述语音交互场景对应的语音交互模式,响应于所述语音交互模式为多人模式,控制所述智能设备进入多人模式;筛选模块,用于采集多个用户的语音信息,并基于多个所述用户的语音信息和所述语音交互场景,对多个所述用户的语音信息进行筛选,得到至少一个第二用户的语音信息;执行模块,用于对至少一个所述第二用户的语音信息进行语义分析,生成第一语音交互指令,并控制所述智能设备执行所述第一语音交互指令。
18、本公开第三方面实施例提出了一种电子设备,包括:存储器、处理器及存储在存储器上并可在处理器上运行的计算机程序,所述处理器执行所述程序时,实现如本公开第一方面实施例所述的智能设备的语音交互方法。
19、本技术第四方面实施例提出了一种计算机可读存储介质,其上存储有计算机程序,该程序被处理器执行时,实现如本公开第一方面实施例所述的智能设备的语音交互方法。
20、本技术第五方面实施例提出了一种车辆,包括如本公开第二方面实施例所述的智能设备的语音交互装置;或者如本公开第三方面实施例所述的电子设备;或者如本公开第四方面实施例所述的计算机可读存储介质。
21、本公开实施例提供的技术方案至少带来以下有益效果:可考虑到语音交互场景与语音交互模式之间的对应关系,来确定智能设备的语音交互场景,并在语音交互模式为多人模式时,控制智能设备进入多人模式,可综合考虑到多个用户的语音信息和语音交互场景,从多个用户的语音信息中筛选出至少一个第二用户的语音信息,以生成第一语音交互指令,并控制智能设备执行第一语音交互指令,有助于实现真正有语音交互意图的用户的语音交互,提高了语音交互的响应性,并可实现智能设备与至少一个第二用户的语音交互,特别适用于车载终端的语音交互场景,可实现车载终端的语音交互的全车覆盖。
22、应当理解的是,以上的一般描述和后文的细节描述仅是示例性和解释性的,并不能限制本公开。
1.一种智能设备的语音交互方法,其特征在于,包括:
2.根据权利要求1所述的方法,其特征在于,所述第二用户包括第三用户、第四用户,所述第三用户、所述第四用户为同一空间内的不同的用户,所述对至少一个所述第二用户的语音信息进行语义分析,生成第一语音交互指令,包括:
3.根据权利要求2所述的方法,其特征在于,所述对所述第四用户的语音信息进行语义分析,得到所述第四用户的语音交互意图为控制所述目标类别的车载设备,包括:
4.根据权利要求1所述的方法,其特征在于,所述对至少一个所述第二用户的语音信息进行语义分析,生成第一语音交互指令,包括:
5.根据权利要求1所述的方法,其特征在于,所述基于多个所述用户的语音信息和所述语音交互场景,对多个所述用户的语音信息进行筛选,得到至少一个第二用户的语音信息,包括:
6.根据权利要求5所述的方法,其特征在于,多个所述用户的语音信息包括所述第一用户的语音信息,所述方法还包括:
7.根据权利要求1-6中任一项所述的方法,其特征在于,所述控制所述智能设备进入多人模式,包括:
8.根据权利要求7所述的方法,其特征在于,还包括:
9.根据权利要求1-6中任一项所述的方法,其特征在于,还包括:
10.一种智能设备的语音交互装置,其特征在于,包括:
11.一种电子设备,其特征在于,包括:存储器、处理器及存储在存储器上并可在处理器上运行的计算机程序,所述处理器执行所述程序时,实现如权利要求1-9中任一项所述的智能设备的语音交互方法。
12.一种计算机可读存储介质,其上存储有计算机程序,其特征在于,该程序被处理器执行时实现如权利要求1-9中任一项所述的智能设备的语音交互方法。
13.一种车辆,其特征在于,包括:如权利要求10所述的智能设备的语音交互装置;或者如权利要求11所述的电子设备;或者如权利要求12所述的计算机可读存储介质。
