|
|
1
9
我还没有找到任何库,但有两篇有趣的论文,可以为您提供术语和背景来完善您的搜索: 编辑:搜索“音频指纹”来到了一个实现页面,既有开源的,也有商业的。
|
|
|
2
7
你所描述的是 matched filter 你只需要一个 cross-correlation 功能应该是任何合理的DSP库的一部分。 根据您对处理器体系结构和语言的选择,您甚至可以找到一个可以更有效地执行此操作的矢量化库。 如果您不太关心性能,可以使用python…
我的门槛是任意的。你应该在实验上决定什么适合你。 请记住,“有趣的片段”越长,计算相关性所需的时间就越长。虽然较长的剪辑将有助于实际比赛从非比赛中脱颖而出,但您可能不需要超过几秒钟。 |
|
|
3
4
AudioDB
是一个开源的C++项目,它搜索音频的相似部分,处理嘈杂的流,并且可以给你一个相似性的度量。它可以作为客户机/服务器运行,但我相信您可以做一个独立的程序。
|
|
|
4
3
你可能想看看 this paper 王立春关于 www.shazam.com . 它不是一个API,但它提供了如何开发算法的详细信息。 |
|
|
5
0
请看一下Microsoft语音API(SAPI):
您列出的所有其他需求基本上都是您必须自己实现的实现细节。例如,当软件解释音频流时,它可以使用全文索引将它们存储在SQL Server中…从中搜索类似/相同的音频剪辑。 当然,还有其他方法可以实现这一点,这只是一个想法:—) |
|
|
6
0
我会按照蒂姆·克里格的回答去做,使用简单的统计相关函数,因为你想让内容不可知。 至于功能,我肯定会尝试mfcc,因为它被用于语音处理和音乐识别(流派,歌曲)。您可以在优秀的开放源代码中找到mfcc和大量其他音频功能 Vamp plugins (或者更高级的捆绑包,一个名为 Sonic Annotator )或者在 Marsyas 框架。 |
|
|
rjonnal · 如何缩放基于FFT的互相关,使其峰值等于皮尔逊ρ 8 年前 |
|
|
Rearden · fftw从r2c(实到复)数据计算分析信号 8 年前 |
|
|
scord · 如何从FFT中确定频率值[重复] 8 年前 |
|
|
Harvey Chang · blackfin bf537 LED闪烁 8 年前 |
|
|
Muhammad Akmal · 构造不同长度的向量 8 年前 |
|
|
Foad · 如何使用循环缓冲区[复制]将信号移动90度 8 年前 |
|
|
haleyk · 寻求有关FFT模板的帮助 8 年前 |
|
|
Peter · 回归技术的MATLAB代码问题 8 年前 |
|
|
Rickson · Python中卷积后的数据后处理 8 年前 |