我用来将语音转换为文本的语音sdk,并给出缓慢的响应,如果有任何其他Sdk可以提供快速响应,支持多种语言…
如果您有任何示例或使用任何其他Sdk,而不是提供给我…
提前感谢....
发布于 2012-10-31 17:54:53
查看这个语音识别和文语转换库'OpenEars‘。
发布于 2012-10-31 16:40:53
我不是人工智能专家,但在图像识别方面,他们使用像神经网络这样的东西,AI可以学习阅读字符,通常是基于反向传播的神经网络。
我假设语音识别类似于图像识别,但这些技术应该是独立的。
我能想到的你需要互联网连接的唯一原因是,SDK的开发者希望在服务器上收集AI结果,这样AI技术就可以从这些新结果中学习,变得更智能,就像苹果的Siri是如何工作的。
拥有较大数据池的人工智能很可能比拥有较小数据池的人工智能学习速度更快(如果应用程序只在设备上运行,它只会理解你的口音,而不是像苹果的Siri那样的国际口音)。
你使用的Speech SDK似乎沿着这条路走,因为它的所有结果都存储在他们的服务器上。
如果您想让语音识别离线工作,您可能需要学习神经网络AI编程并实现您自己的编程,或者找到其他不使用Internet连接的库。
https://stackoverflow.com/questions/13152670
复制相似问题