我正在制作一个电子游戏来教西班牙语和普通话。这是一场演讲集中的游戏。我使用谷歌Chrome的W3C语音识别实现,因为它是免费的,似乎很棒。
我已经向其他人发布了这个游戏,人们在识别方面遇到了很大的困难,在es-ES上设置了语言代码。A人说:
My favorite so far: "refrescos" turns into "Craigslist jobs"! :D
And then "Netflix codes".如果语言代码设置为es-ES,如何解释“作业”(我可以理解像"Netflix“这样的专有名词,但不理解”作业“)
B人说lo siento转录为lo síento,C人说转录为lo siento。同一个API怎么能用一个有重音标记的和一个没有重音的API来解释同一个口语单词呢?
每个都有Chrome 76。
我的问题是:
发布于 2019-09-10 04:29:32
Web语音API是为简单的语音命令和短语而设计的。它不是最好的质量识别引擎。它也取决于人的口音。你提到的另一个这样的问题还说,网络演讲是为命令设计的。这不是最好的教学语言,因为一个用户可能会有一个非常强烈的非本地口音至少一种语言。
https://stackoverflow.com/questions/57814831
复制相似问题