我正在研究Swift中的一个应用程序,我正在考虑在我的项目中获得非语音语音识别的方法。
我的意思是,是否有一种方法,我可以接受声音输入,并将它们与一些预定义的声音结合在项目中,如果匹配发生,它应该做一些特定的行动?
有什么办法可以做到这一点吗?我正在考虑打破声音和做检查,但似乎不能得到任何进一步的。
发布于 2015-04-23 23:05:28
我的个人经验跟随马特以上的评论:需要认真的技术知识。
实现这一目的的方法有几种,一种是从感兴趣的声音段(音频特征提取)中提取一些属性,然后用某种机器学习技术对该音频特征向量进行分类。这通常需要一些培训阶段,其中机器学习技术被提供了一些示例来学习您想要识别的声音(您的预定义的声音),以便它可以根据这些数据构建一个模型。
在不知道您想要识别的声音类型的情况下,这里提供的C/C++ SDK可能会对您有好处:http://www.samplesumo.com/percussive-sound-recognition页面上有一个技术演示,您可以下载并尝试使用您的声音。它是一个C/C++库,有一个Mac、Windows和iOS版本,所以您应该能够将它与iOS上的Swift应用程序集成起来。也许这能让你做你想做的事?
如果你想开发自己的技术,你可以从找到和阅读一些科学论文开始,使用关键词“声音分类”、“音频识别”、“机器监听”、“音频特征分类”、.
发布于 2015-09-25 18:28:37
马特
我们一直在开发一些很酷的工具来加速iOS的开发,特别是在Swift中。其中一个工具是我们所称的TLSphinx:Pocketsphinx周围的一个Swift包装器,可以在不离开设备的音频的情况下执行语音识别。
我认为TLSphinx可以帮助您解决问题,因为它是一个完全开放的源代码库。搜索它('TLSphinx'),你也可以下载我们的iOS应用程序(‘’),并试用这个模块来查看它是如何工作的。希望它有用!
最好的!
https://stackoverflow.com/questions/29787335
复制相似问题