我知道C++和PHP,我知道OOP和数据库技术的用法。我必须为我自己的国家制作语音识别软件,它的符号是独一无二的,但得到了UTF-8的支持。到目前为止,还没有软件公司主动这么做。我需要知道什么编程语言将是完美的做,我应该采取哪些课程来学习这一过程。我不喜欢通过SAPI来处理语言,也不喜欢构建识别技术,因为它们是基于英语的(这里的问题是语法和语法非常不同--基于印欧语)。我想从头开始(机器级/语音处理-我想使声音处理直接被解析到我的符号(没有英语转换))。希望你能理解,因为我期待它,因为这是我的国家的要求。这并不是为了推广任何编程语言或课程。我现在就想知道。(如果我的问题不适合这里,请把它放在最合适的地方,并请转到那个论坛。我有过痛苦的经历)
发布于 2015-03-15 23:50:19
添加对一种新语言的支持是非常简单的,您实际上只需要遵循文档,您就可以达到目的。您还需要对脚本语言有一定的了解,这将有助于您在一些步骤上减少手工操作。Unix命令行体验是一个很大的优势,尽管你也可以在Windows上工作。
1)阅读引言,熟悉语音识别的概念--特征、声学模型、语言模型等。
2)尝试使用CMUSphinx和美国英语模式来理解事物是如何工作的。试着按照声学模型训练教程标准使用美国英语AN4数据库样本进行培训。
3)在维基百科上读到你的语言。
4)为你的语言收集一组转录的录音-播客,广播节目,有声读物。您也可以自己记录一些初始金额。你需要大约20个小时的转录数据才能开始,100个小时才能创建一个好的模型。
5)根据你收集的数据,创建一个单词列表和一本语音词典。大多数语音词典都可以用一个简单的规则创建,用您最喜欢的脚本语言(如Python )中的一个小脚本。详情请参见生成字典。
6)手动或用sphinx4对齐器将音频分割成短句,创建一个包含培训教程中所述所需文件的数据库。
7)将新模型集成到应用程序中,并设计数据收集以改进模型。
如果你有问题,可以在CMU狮身人面像/论坛上随意提问。
发布于 2015-02-12 11:19:36
查看是否有任何现有语音识别系统可以添加自定义语言。这将节省你多年的精力。即便如此,也会收集大量的语言词汇和语法数据库。
以下是一些让你开始学习的方法:
如果没有,那么您可能会使用C/C++来处理传入的音频足够快。您可以在这里了解有关语音识别原理的更多信息:http://en.wikipedia.org/wiki/Speech_识别
https://softwarerecs.stackexchange.com/questions/17124
复制相似问题