我问这个问题是为了开始我的一个有趣的项目。我正在考虑用pyAudio编写代码,所以我想我必须使用pyAudio(如果有比python更好的库,请推荐给我)。我的目标是创建一个可以录制某人声音的程序。这很简单。但是,在我在一个/多个样本中记录了用户的语音后,如何识别来自用户的语音?一种声音与另一种声音的区别是什么?如何实现python来实现这一点?
发布于 2012-04-11 02:39:22
您是否考虑过使用语音识别引擎作为您的项目的基础?例如,您可以编写python代码来运行CMU sphinx (一个BSD选项) http://sphinx.subwiki.com/sphinx/index.php/Sphinx3_python_quickstart。不知道你的趣味项目的目的是什么,但如果你不想学习语音识别算法,这可能是一个好的选择。
https://stackoverflow.com/questions/10090542
复制相似问题