我刚开始研究机器学习和相关技术。我选择语音识别作为起点。我试过并识别Google示例和我自己的示例。随着时间的推移,它没有正确地识别出我样本中的所有单词。
发布于 2021-10-27 00:08:13
Google语音到文本(SST)是由预先培训过的机器学习模型提供的,然而,它是一项不断改进的服务。
为了确保您充分利用SST,请查阅在公开文档中发布的最佳实践,其中包括:
如果没有您的示例文件,就很难确定您需要在哪里工作以提高结果的质量,但是请注意,Google教程的设计已经考虑到了上述最佳实践。
作为一个快速示例,请注意,在此如何引导 to 中,在本地文件上执行同步语音识别可以找到两个最佳做法:
请查看本文件关于如何优化音频文件,以了解更多。
接下来,有一些方法可以使模型适应您的特定需求,请回顾本文件关于如何改进转录结果的内容,以及基于本节关于如何提高单词和短语识别的问题;此外,您可能希望深入研究类,因为当您为特定的业务案例实现时,这些方法是非常有用的。
在语音到文本和其他ML/AI技术上有很多选择,而且很难将它们排列在一起,但是请回顾一下本主题所涉及的这篇博客文章。
https://stackoverflow.com/questions/69728664
复制相似问题