我正在尝试构建一个Google Assistant应用程序来识别从另一个设备(电视、收音机等)播放的音频剪辑。并基于该音频剪辑采取动作以播放另一音频剪辑、YouTube视频或在浏览器中打开网站。
这将是伟大的,知道实现这一功能的可能性,如果有任何可用的谷歌资源/文章,我可以使用。
谢谢,
发布于 2019-02-18 16:51:40
我很抱歉地通知您,到目前为止,您无法访问与助手交互的原始录音。你只能得到用户发话的字符串。这意味着您不能开发识别音频片段的操作,只能在其中使用字符串(假设语音到文本引擎可以理解它们)
你也不能打开一个基于ANY输入的网站或YouTube应用,即使你使用字符串。因为与助手的交互是语音优先的。这意味着你不能总是假设用户有一个屏幕或安装了YouTube应用程序。如果交互是通过启用了Assistant的智能扬声器进行的,该怎么办?
但是,您可以通过在单独的应用程序中录制用户的语音,然后使用助手的SSML语法或媒体响应来播放它们,从而将用户的语音回放给他们(或其他人的语音)。Here's一篇详细的文章,我的意思,它可以实现。
https://stackoverflow.com/questions/54741538
复制相似问题