【问题标题】:Control of Text-to-Speech output audio in Microsoft WebChat在 Microsoft WebChat 中控制文本到语音的输出音频
【发布时间】:2020-03-19 07:37:44
【问题描述】:

我正在使用 Microsoft WebChat 连接到我的机器人服务,并且大多数交互主要是基于语音的。我正在使用 Azure 语音服务,语音输出完全由 WebChat 处理。我目前正在向 Bot 发送一个非活动事件,如果在设定的持续时间后未收到输入,它会提示非活动用户。这是根据传入的活动完成的。但是,在语音驱动的场景中,有时会在 Bot 仍在说出消息时发送事件,因为即使消息尚未完全发音,也会根据收到传入活动的时间发送非活动事件。我想在每条消息发出声音后发送非活动提示“n”秒,但为此,我需要知道每条消息的播放持续时间。有没有办法可以获取文本转语音服务提供的每条语音消息的输出持续时间,以便在正确的时间发送非活动提示?

【问题讨论】:

  • 接受/投票支持更大的 Stack Overflow 社区和任何有类似问题的人。如果您觉得我的回答足够,请“接受”并点赞。如果没有,请告诉我我还能提供哪些帮助!

标签: botframework direct-line-botframework web-chat


【解决方案1】:

此时,对于网络聊天,没有办法捕获语音持续时间。如果您希望看到包含的内容,我建议将其作为功能请求提交以供将来开发。你可以这样做here

认知服务的一项功能,通过其 REST API(请参阅 here),并且似乎通过 SDK(请参阅 here)。您可以将语音 STT/TTS 直接集成到您的项目中,以便利用响应对象中可用的“持续时间”属性。

希望有帮助!

【讨论】:

    猜你喜欢
    • 2018-11-20
    • 2017-10-29
    • 2019-08-12
    • 2022-01-01
    • 2020-09-06
    • 2019-12-21
    • 1970-01-01
    • 1970-01-01
    • 2010-12-09
    相关资源
    最近更新 更多