音响处理方法、音响处理系统及程序与流程

专利检索2026-08-29  12


本发明涉及一种音响处理。


背景技术:

1、以往提出有生成希望的声音(以下称为“目标音”)的各种技术。例如在非专利文献1中,公开了利用训练好的生成模型而生成目标音的波形信号的技术。非专利文献1的技术的生成模型生成频域的目标音的音响特征量。音响特征量变换为时域的波形信号。另外,生成模型生成的音响特征量被反馈至该生成模型的输入侧。即,对于由生成模型进行的当前的音响特征量的生成,利用过去生成的音响特征量。

2、非专利文献1:blaauw,merlijn,and jordi bonada."a neural parametricsinging synthesizer."arxiv preprint arxiv:1704.03809v3(2017)

3、


技术实现思路

1、对于根据音响特征量而生成波形信号的处理,伴随着各种变动要因。例如,在通过利用了随机数的概率性处理而生成波形信号的方式中,波形信号的音响特性与随机数相对应地发生变动。另外,例如在与来自利用者的指示相对应地调整音响特征量的结构中,与来自利用者的指示相对应地波形信号的音响特性发生变动。在非专利文献1的技术中,如前述那样,生成模型刚生成后的音响特征量被反馈至该生成模型的输入侧。即,未反映出以上例示的变动要因的音响特征量被反馈至生成模型。因此,对于生成听觉上自然的印象的目标音存在极限。考虑到以上情况,本发明的一个方式的目的在于,生成听觉上自然的目标音的波形信号。

2、为了解决以上课题,本发明的一个方式涉及的音响处理方法,通过利用训练好的生成模型依次处理包含条件数据在内的输入数据,从而依次生成目标音的第1音响特征量,该条件数据表示应生成的所述目标音的条件,根据所述第1音响特征量而生成表示所述目标音的波形的时域的波形信号,根据所述波形信号而生成第2音响特征量,第1时间点的输入数据包含相比于所述第1时间点在过去生成的所述第2音响特征量。

3、本发明的一个方式涉及的音响处理系统具有:第1生成部,其通过利用训练好的生成模型依次处理包含条件数据在内的输入数据,从而依次生成目标音的第1音响特征量,该条件数据表示应生成的所述目标音的条件;信号生成部,其根据所述第1音响特征量而生成表示所述目标音的波形的时域的波形信号;以及第2生成部,其根据所述波形信号而生成第2音响特征量,第1时间点的输入数据包含相比于所述第1时间点在过去生成的所述第2音响特征量。

4、本发明的一个方式涉及的程序使计算机系统作为如下功能部起作用:第1生成部,其通过利用训练好的生成模型依次处理包含条件数据在内的输入数据,从而依次生成目标音的第1音响特征量,该条件数据表示应生成的所述目标音的条件;信号生成部,其根据所述第1音响特征量而生成表示所述目标音的波形的时域的波形信号;以及

5、第2生成部,其根据所述波形信号而生成第2音响特征量,在所述程序中,第1时间点的输入数据包含相比于所述第1时间点在过去生成的所述第2音响特征量。



技术特征:

1.一种音响处理方法,其是由计算机系统实现的,

2.根据权利要求1所述的音响处理方法,其中,

3.根据权利要求2所述的音响处理方法,其中,

4.根据权利要求3所述的音响处理方法,其中,

5.根据权利要求2至4中任一项所述的音响处理方法,其中,

6.根据权利要求3或4所述的音响处理方法,其中,

7.根据权利要求5或6所述的音响处理方法,其中,

8.根据权利要求7所述的音响处理方法,其中,

9.根据权利要求5至8中任一项所述的音响处理方法,其中,

10.根据权利要求9所述的音响处理方法,其中,

11.根据权利要求10所述的音响处理方法,其中,

12.根据权利要求1至11中任一项所述的音响处理方法,其中,

13.根据权利要求12所述的音响处理方法,其中,

14.根据权利要求13所述的音响处理方法,其中,

15.根据权利要求1所述的音响处理方法,其中,

16.一种音响处理系统,其具有:

17.一种程序,其使计算机系统作为如下功能部起作用:


技术总结
音响处理系统具有:第1生成部,其通过利用训练好的生成模型依次处理包含表示应生成的目标音的条件的条件数据在内的输入数据,从而依次生成所述目标音的第1音响特征量;信号生成部,其根据所述第1音响特征量而生成表示所述目标音的波形的时域的波形信号;以及第2生成部,其根据所述波形信号而生成第2音响特征量,第1时间点的输入数据包含相比于所述第1时间点在过去生成的所述第2音响特征量。

技术研发人员:大道龙之介
受保护的技术使用者:雅马哈株式会社
技术研发日:
技术公布日:2024/5/29
转载请注明原文地址:https://win.8miu.com/read-1167329.html

最新回复(0)