首页
学习
活动
专区
圈层
工具
发布
社区首页 >问答首页 >改进规范对文本的识别

改进规范对文本的识别
EN

Stack Overflow用户
提问于 2021-10-26 19:07:47
回答 1查看 182关注 0票数 1

我刚开始研究机器学习和相关技术。我选择语音识别作为起点。我试过并识别Google示例和我自己的示例。随着时间的推移,它没有正确地识别出我样本中的所有单词。

  • 怎样才能提高认知度?
  • 有什么方法可以教我的声音或特定的短语吗?
  • 除了Google,还有其他选择吗?
EN

回答 1

Stack Overflow用户

发布于 2021-10-27 00:08:13

Google语音到文本(SST)是由预先培训过的机器学习模型提供的,然而,它是一项不断改进的服务。

为了确保您充分利用SST,请查阅在公开文档中发布的最佳实践,其中包括:

  • 取样率
  • 传输编解码
  • 背景噪声
  • 输入信道使用
  • 帧大小

如果没有您的示例文件,就很难确定您需要在哪里工作以提高结果的质量,但是请注意,Google教程的设计已经考虑到了上述最佳实践。

作为一个快速示例,请注意,在此如何引导 to 中,在本地文件上执行同步语音识别可以找到两个最佳做法:

  • 编码使用LINEAR16编解码器完成。
  • 采样率为16000赫兹。

请查看本文件关于如何优化音频文件,以了解更多。

接下来,有一些方法可以使模型适应您的特定需求,请回顾本文件关于如何改进转录结果的内容,以及基于本节关于如何提高单词和短语识别的问题;此外,您可能希望深入研究,因为当您为特定的业务案例实现时,这些方法是非常有用的。

在语音到文本和其他ML/AI技术上有很多选择,而且很难将它们排列在一起,但是请回顾一下本主题所涉及的这篇博客文章

票数 2
EN
页面原文内容由Stack Overflow提供。腾讯云小微IT领域专用引擎提供翻译支持
原文链接:

https://stackoverflow.com/questions/69728664

复制
相关文章

相似问题

领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档