声纹漂移检测和更新的制作方法

    技术2026-07-03  17


    本公开涉及更新适合与语音生物测定引擎一起使用的类型的声纹,例如但不一定限于更新声纹以计及检测到的声音漂移。


    背景技术:

    1、可以生成声纹来表征相关联个人的多个声音特性,声纹也可以被称为声音签名或声音生物测定。因为声纹对于相关联个人来说可能是唯一的,所以它可以与声音生物测定引擎一起采用,以将一个个人与另一个个人区分开和/或便于语音识别相关的活动。随着个人年龄增长、身体变化、经历健康问题或其他自然发展,个人的声纹可能会相应地改变。在个人声音特性中的变化、变异等可以称为漂移。个人的声音特性可以随着时间相应地演变,使得在较早时间点的声音特性可以不同于该个人在较晚时间段的声音特性,即声音特性可能漂移。

    2、声音生物测定引擎识别语音的能力可以依赖于使用准确反映相关联个人的当前或实时声音特性的声纹。在过去,声音生物测定引擎试图通过周期性地请求个人重建他们的声纹,即创建全新的声纹,来克服由声音漂移导致的不准确性。重建声纹所花费的时间和精力对于个人来说可能是有问题的和繁重的,因为这可能需要个人重复进行耗时的声音识别过程。


    技术实现思路

    1、本公开的一个非限制性方面涉及一种声纹模块,其被配置用于更新声纹以计及声音漂移,例如但不一定限于实时更新声纹以计及漂移,或者在要求个人进行耗时的声音识别过程之前更新声纹。

    2、本公开的一个非限制性方面涉及一种用于载具内声纹漂移检测的方法。该方法可包括:确定载具操作者的存档声纹;根据操作者在操作载具时做出的载具内话语为操作者生成实时声纹;以及生成声纹偏差以概率地量化实时声纹和存档声纹之间的漂移。漂移可以反映与实时声纹和存档声纹中的每一个相关联的一个或多个概率密度函数之间的统计距离。该方法还可以包括:响应于声纹偏差超过重建阈值而生成经重建声纹;以及响应于声纹偏差超过更新阈值而生成经更新声纹。更新阈值可以小于重建阈值。

    3、该方法可包括执行更新过程以生成经更新声纹,该更新过程根据对存档声纹做出的一个或多个调整来生成经更新声纹。

    4、该方法可包括执行更新过程以通过统计地改变存档声纹来生成经更新声纹。

    5、该方法可包括执行更新过程,以通过改变存档声纹的一个或多个声音特性来生成经更新声纹。

    6、该方法可包括声音特性包括音调、强度、振幅、共振峰、声谱图、梅尔倒谱系数(mfcc)、定时、音色、口音、方言和语调中的一个或多个。

    7、该方法可包括执行重建过程,以根据作为口头测试的一部分由操作者做出的测试话语来生成经重建声纹。

    8、该方法可包括执行重建过程,以根据操作者说出的并用载具上的声学模块记录的单词组合来生成经重建声纹。

    9、本公开的一个非限制性方面涉及一种用于载具内声纹漂移检测的系统。该系统可以包括声学模块,该声学模块被配置用于根据操作者在操作载具时做出的载具内话语来控制载具的一个或多个操作。该系统还可以包括声纹模块,该声纹模块被配置用于:根据载具内话语生成实时声纹;生成声纹偏差以概率地量化实时声纹和先前为操作者生成的存档声纹之间的漂移;以及响应于声纹偏差超过更新阈值,更新存档声纹的一个或多个声音特性以生成经更新声纹。

    10、声纹模块可被配置用于根据统计过程来更新声音特性,由此通过与声纹偏差成比例地统计地改变存档声纹来生成经更新声纹。

    11、声音特性可以包括音调、强度、振幅、共振峰、声谱图、梅尔倒谱系数(mfcc)、定时、音色、口音、方言和语调中的一个或多个。

    12、声纹模块可被配置用于:生成存档概率分布以对存档声纹的声道频谱进行建模;生成实时概率分布以对实时声纹的声道频谱进行建模;以及根据存档概率分布和实时概率分布之间的差异生成声纹偏差。

    13、漂移可以反映与实时声纹和存档声纹中的每一个相关联的一个或多个概率密度函数之间的统计距离。

    14、声学模块可以在载具上,并且声纹模块可以在载具外在后台控制器处。

    15、声纹模块可被配置用于响应于声纹偏差超过重建阈值,用经重建声纹替换存档声纹。

    16、声纹模块可以被配置用于根据操作者响应多个口头测试问题而做出的测试话语来生成经重建声纹。

    17、本公开的一个非限制性方面涉及一种用于载具内声纹漂移检测的声纹模块。该模块可被配置用于:确定载具操作者的存档声纹;根据操作者在操作载具时做出的载具内话语生成第一实时声纹;生成第一声纹偏差以量化与第一实时声纹和存档声纹中的每一个相关联的一个或多个概率密度函数之间的统计距离;以及响应于第一声纹偏差超过更新阈值,更新存档声纹的一个或多个声音特性以生成经更新声纹。

    18、声纹模块可被配置用于根据统计过程来更新声音特性,由此通过与第一声纹偏差成比例地统计地改变存档声纹来生成经更新声纹。

    19、声纹模块可被配置用于:根据操作者在操作载具时做出的另外的载具内话语生成第二实时声纹;生成第二声纹偏差以量化与经更新声纹和第二实时声纹中的每一个相关联的一个或多个概率密度函数之间的统计距离;以及响应于第二声纹偏差超过重建阈值生成经重建声纹,重建阈值大于更新阈值。

    20、声纹模块可以被配置用于根据操作者响应多个口头测试问题而做出的测试话语来生成经重建声纹。

    21、声纹模块可被配置用于在不执行口头测试的情况下生成经更新声纹。

    22、本公开提供了以下方案:

    23、1.一种用于载具内声纹漂移检测的方法,包括

    24、确定载具操作者的存档声纹;

    25、根据操作者在操作载具时做出的载具内话语为操作者生成实时声纹;

    26、生成声纹偏差以概率地量化实时声纹和存档声纹之间的漂移,所述漂移反映与实时声纹和存档声纹中的每一个相关联的一个或多个概率密度函数之间的统计距离;

    27、响应于声纹偏差超过重建阈值,生成经重建声纹;以及

    28、响应于声纹偏差超过更新阈值,生成经更新声纹,更新阈值小于重建阈值。

    29、2.根据方案1所述的方法,还包括:

    30、执行更新过程以生成经更新声纹,更新过程根据对存档声纹做出的一个或多个调整来生成经更新声纹。

    31、3.根据方案1所述的方法,还包括:

    32、执行更新过程以通过统计地改变存档声纹来生成经更新声纹。

    33、4.根据方案1所述的方法,还包括:

    34、执行更新过程以通过改变存档声纹的一个或多个声音特性来生成经更新声纹。

    35、5.根据方案4所述的方法,还包括:

    36、声音特性包括音调、强度、振幅、共振峰、声谱图、梅尔倒谱系数(mfcc)、定时、音色、口音、方言和语调中的一个或多个。

    37、6.根据方案1所述的方法,还包括:

    38、执行重建过程,以根据作为口头测试的一部分由操作者做出的测试话语来生成经重建声纹。

    39、7.根据方案1所述的方法,还包括:

    40、执行重建过程,以根据操作者说出的并用载具上的声学模块记录的单词组合来生成经重建声纹。

    41、8.一种用于载具内声纹漂移检测的系统,包括

    42、声学模块,被配置用于:

    43、根据操作者在操作载具时做出的载具内话语来控制载具的一个或多个操作;以及

    44、声纹模块,被配置用于:

    45、根据载具内话语生成实时声纹;

    46、生成声纹偏差以概率地量化实时声纹和先前为操作者生成的存档声纹之间的漂移;以及

    47、响应于声纹偏差超过更新阈值,更新存档声纹的一个或多个声音特性以生成经更新声纹。

    48、9.根据方案8所述的系统,其中:

    49、声纹模块被配置用于:

    50、根据统计过程更新声音特性,由此通过与声纹偏差成比例地统计地改变存档声纹来生成经更新声纹。

    51、10.根据方案9所述的系统,其中:

    52、声音特性包括音调、强度、振幅、共振峰、声谱图、梅尔倒谱系数(mfcc)、定时、音色、口音、方言和语调中的一个或多个。

    53、11.根据方案8所述的系统,其中:

    54、声纹模块被配置用于:

    55、生成存档概率分布以对存档声纹的声道频谱进行建模;

    56、生成实时概率分布以对实时声纹的声道频谱进行建模;以及根据存档概率分布和实时概率分布之间的差异生成声纹偏差。

    57、12.根据方案8所述的系统,其中:

    58、所述漂移反映与实时声纹和存档声纹中的每一个相关联的一个或多个概率密度函数之间的统计距离。

    59、13.根据方案8所述的系统,其中:

    60、声学模块在载具上;并且

    61、声纹模块在载具外在后台控制器处。

    62、14.根据方案8所述的系统,其中:

    63、声纹模块被配置用于响应于声纹偏差超过重建阈值,用经重建声纹替换存档声纹。

    64、15.根据方案14所述的系统,其中:

    65、声纹模块被配置用于根据操作者响应多个口头测试问题而做出的测试话语来生成经重建声纹。

    66、16.一种用于载具内声纹漂移检测的声纹模块,所述声纹模块被配置用于:

    67、确定载具操作者的存档声纹;

    68、根据操作者在操作载具时做出的载具内话语生成第一实时声纹;

    69、生成第一声纹偏差,以量化与第一实时声纹和存档声纹中的每一个相关联的一个或多个概率密度函数之间的统计距离;以及

    70、响应于第一声纹偏差超过更新阈值,更新存档声纹的一个或多个声音特性以生成经更新声纹。

    71、17.根据方案16所述的声纹模块,还被配置用于:

    72、根据统计过程更新声音特性,由此通过与第一声纹偏差成比例地统计地改变存档声纹来生成经更新声纹。

    73、18.根据方案16所述的声纹模块,还被配置用于:

    74、根据操作者在操作载具时做出的另外的载具内话语生成第二实时声纹;

    75、生成第二声纹偏差,以量化与经更新声纹和第二实时声纹中的每一个相关联的一个或多个概率密度函数之间的统计距离;以及

    76、响应于第二声纹偏差超过重建阈值而生成经重建声纹,重建阈值大于更新阈值。

    77、19.根据方案18所述的声纹模块,还被配置用于:

    78、根据操作者响应多个口头测试问题而做出的测试话语来生成经重建声纹。

    79、20.根据方案19所述的声纹模块,还被配置用于:

    80、在不执行口头测试的情况下生成经更新声纹。

    81、当结合附图时,根据下面对施行本教导的模式的详细描述,这些特征和优点连同本教导的其他特征和优点是容易清楚的。应该理解的是,尽管下面的附图和实施例可能是分开描述的,但是它们的单个特征可以组合成另外的实施例。


    技术特征:

    1.一种用于载具内声纹漂移检测的方法,包括

    2.根据权利要求1所述的方法,还包括:

    3.根据权利要求1所述的方法,还包括:

    4.根据权利要求1所述的方法,还包括:

    5.根据权利要求4所述的方法,还包括:

    6.根据权利要求1所述的方法,还包括:

    7.根据权利要求1所述的方法,还包括:

    8.一种用于载具内声纹漂移检测的系统,包括

    9.根据权利要求8所述的系统,其中:

    10.根据权利要求9所述的系统,其中:


    技术总结
    提供了声纹漂移检测和更新。声纹模块用于载具内声纹漂移检测。该模块可被配置用于:确定载具操作者的存档声纹;根据操作者在操作载具时做出的载具内话语生成第一实时声纹;生成第一声纹偏差以量化与第一实时声纹和存档声纹中的每一个相关联的一个或多个概率密度函数之间的统计距离;以及响应于第一声纹偏差超过更新阈值,更新存档声纹的一个或多个声音特性以生成经更新声纹。

    技术研发人员:G·塔尔瓦,A·M·哈米斯,X·F·赵,K·R·布克
    受保护的技术使用者:通用汽车环球科技运作有限责任公司
    技术研发日:
    技术公布日:2024/10/24
    转载请注明原文地址:https://symbian.8miu.com/read-44601.html

    最新回复(0)