【发布时间】:2021-07-22 05:23:42
【问题描述】:
我找到了Wav2Vec-U 的 github repo,但是没有很好的文档记录。我想知道是否有任何火车程序。我正在尝试在常见的语音音频上对其进行训练。但它需要 wrd、ltr 和 phn 文件,我无权访问。
【问题讨论】:
标签: python speech-recognition speech-to-text fairseq
我找到了Wav2Vec-U 的 github repo,但是没有很好的文档记录。我想知道是否有任何火车程序。我正在尝试在常见的语音音频上对其进行训练。但它需要 wrd、ltr 和 phn 文件,我无权访问。
【问题讨论】:
标签: python speech-recognition speech-to-text fairseq
目前最好的(唯一?)相关文章是在 Kaggle 上托管的 this notebook。在该笔记本的 cmets 部分,有一个指向 another notebook 的链接,该链接与您问题的 wrd, ltr, and phn files 部分特别相关。
【讨论】: