最新新闻资讯
了解音乐新动态 把握技巧新进展

声音分离技术凭借AI实现巨大飞跃

作者:
发布时间:
关键字:
AI声音分离,

声音分离是一种技术,它可以从混合的音源中提取出单个的声音。这原本被认为是一件非常困难的事,但我们引入了AI技术,在这一领域更进一步。例如,在复原经典电影、消除智能手机的噪音、实现音乐流媒体服务的实时卡拉OK功能等方面已经取得了成果,我们期待未来它能应用到更多领域。

AI声音分离是一种什么样的技术?

AI声音分离是一种技术,它可以从音频数据中去除不必要的噪音,只提取人声或其他特定乐器的声音。当人类在聆听一场多种声音混合在一起的表演时,可以分辨出各个乐器,或者在进行对话时,即使被一大群人包围,我们也能自然而然地专注于一个声音。这些都是人类独有的能力,而直到近来,计算机要做到这一点都还是极其困难的。有人将这项任务描述为混合两种果汁,之后提取其中一种。但是在过去的几年里,由于AI新方法的引入,这项技术有了极大的提升。

以前,人们试图在分离中加入大量的专业知识,例如关于混合过程的知识。此外,人们更喜欢简单的模型,因为它们可以从理论上研究它们。现在这种情况已经改变了,因为使用AI从数据中学习分离体系要好得多。在这个技术上,AI如何被使用?

我们的声音分离是由AI来进行的,可以由人来教计算机完成这个任务。例如,一把吉他有一个特定的声音或频率,这一点可被神经网络学习到。无论混合了多少种声音,我们的AI系统都能够识别这些特征。这就像我们可以发现一个苹果,因为我们之前见过很多苹果。AI在声音分离的应用方式而言,无论是机械上还是概念上都大同小异。

神经网络在所谓的训练中学习识别音频特征。在这个训练中,神经网络会看到很多音乐--比我们一生中听到的音乐还要多--以及我们应该提取的目标声音。这些信息足以让神经网络学习声音分离。

爱扒谱