要直接使用Google的Speech API,现在需要获取API密钥。要获得该密钥,您必须订阅chromium dev@chromium.org新闻组,然后执行几个步骤,Google将为您提供一个“不用于分发”的开发人员密钥。密钥的速率限制为50次/天。
例如,node-google- Speech -api概述了节点应用程序需要这个键来直接访问Google的Speech API (无需使用浏览器):https://github.com/psirenny/node-google-speech-api
还有PHP库和Java库用于访问Google的Speech API,也需要这个密钥。
我想写一个利用谷歌语音识别技术的桌面应用程序,但对于广泛的分发,甚至对于我设想的软件的单一桌面部署,50个请求/天的限制是不可接受的。如果语音识别以某种方式中断,我看到单个桌面用户每天会有多达500个请求,其中大多数可能是长时间轮询/连续的,所以可能只有2到3个请求/天,但一次只有几个小时。再乘以几百个用户,我很容易就会超过50个请求/天。
我试图想出一种方法,在我自己的应用程序中访问谷歌在桌面上的高级语音识别技术(语言并不重要,但node.js很可能是混合的一部分,所以node.js解决方案将是首选),这让我考虑了Google Chrome碰巧实现的网络语音应用编程接口标准。
据我所知,Google Chrome对Web Speech API的实现没有硬的请求/天限制,我可以很高兴地写出全天使用Web Speech API的网站,与Google Speech API direct相比,没有或只有最少的限制。这让我开始思考,如果我分发一个Chrome (不是Chromium)浏览器,这样我就可以使用真正的Google Chrome浏览器,但添加了一个“扩展”,允许自定义html5网页中的Javascript与客户端系统上的其他应用程序(即,与此特殊安装的Chrome一起运行的Node.js应用程序)进行交互,并以javascript编写我的语音识别部分,并将输出传输到我设计并安装在客户系统上的其他应用程序中。
这行得通吗?
这种方法的陷阱是什么?
您是否有其他方法的建议,或者您是否会推荐一种商业许可的解决方案,可以与Google的语音技术的易用性和极端的自然语言准确性相媲美?
发布于 2014-08-22 01:37:41
https://stackoverflow.com/questions/25102263
复制相似问题