我是信息技术专业最后一年的本科生。我和我的团队已经把“手语识别”作为我们最后一年的项目。我们刚刚开始收集信息(收集数据)。我们计划使用仪器手套作为输入设备。但我们在这方面的知识不多。
此外,我们发现了以下训练系统的实际识别手势,因此手语的方法。
请告诉我我应该用哪一个来识别。
另外,告诉我有关仪器手套和有什么具体的品种,我们应该选择我们的项目?
发布于 2011-08-11 15:38:53
现在在GA技术公司公司( Thad Starner )在1995年就成功地让这款产品与HMMs和一款头戴式摄像机一起工作。我想,从那时起,随着处理能力和传感器的大幅增加,你会有一些好运气。
泰德·斯塔纳和亚历克斯·彭特兰。利用隐马尔可夫模型实时识别视频中的美国手语。“计算机视觉国际研讨会论文集”,珊瑚山墙,佛罗里达州,美国,1995年。IEEE计算机学会出版社。
然而,您必须在数据清理/过滤到HMM之前进行大量的数据清理/过滤。这是一项信号处理任务,可以使用模糊逻辑对输入进行分类(看看鼠标手势识别是如何完成的),并使用类似于NN的方法对数据进行降采样。
发布于 2012-05-12 14:35:33
我认识一些ASL?在过去被计算机捕获和识别,那是很久以前的事了。我记得在VHS上看过这个视频。最迟1994年。
手语(不止一种)是典型的多渠道媒体-不仅仅是手部,所以手套可能不够(取决于你的目标)。我的ASL几乎不存在,但是英国手语使用类似的东西(需要一点盐,我很生疏):
我认为,要成功捕获和解析所有这些通道,您将面临很大的压力。也许读一个适当限制的子集可能是个好主意:基本的手写体(ASL的拼写非常清楚,今天应该很容易)和一些基本的动作。您可能不得不限制您解析的句子的复杂性,因为您可能无法可靠地捕捉所有方面。
对于本地签名者来说,这个软件有点像手语听力学习者,错过了很多东西。我想签字人会很快适应的。毕竟,母语为英语的人仍然可以理解一个句子,即使有些文章缺失了。
发布于 2011-08-11 15:13:35
大量借用评论:我认为你应该研究现有的图像识别算法。就我个人而言,我只是简单地实现了一个现有的开源开源。一旦你对一个人有了一些了解和安慰,就把它训练在一个单一的标志上。
使用手套的输出来生成图像。为此,我将寻找一个手套,它可以提供易于翻译到图像的输出,例如表示数字位置的位表。然后将图像传递到图像识别软件中。
一旦他们一起工作,手套和图像识别软件,你应该转移到任何你想要的用户界面,如语音或文本输出。
最后,继续添加标记,每次添加后测试,直到你的学期结束,或者系统性能下降太多。
https://softwareengineering.stackexchange.com/questions/99096
复制相似问题