【问题标题】:Exporting Audio for Google Speech using pydub使用 pydub 为 Google Speech 导出音频
【发布时间】:2017-02-10 08:04:47
【问题描述】:

我正在尝试将音频文件导出到 LINEAR16 以用于 Google Speech,我注意到它们指定了 little-endian 字节顺序。我正在使用pydub 导出为“原始”格式,但我无法从文档(或源代码)中判断导出的文件是小端格式还是大端格式? 我正在使用以下命令进行导出:

audio = pydub.from_file(self.mFilePathName, "mp4")
fullFileNameRaw = "audio.raw"
audio.export(fullFileNameRaw, format='raw')

谢谢。 -K

【问题讨论】:

    标签: python audio google-speech-api pydub google-cloud-speech


    【解决方案1】:

    根据this answer,标准(RIFF)波形文件是小端的。 Pydub 使用 stdlib wavemodule 编写波形文件,所以我猜它是小端。 (如果您使用波头编写文件,它实际上在开头有 RIFF)。

    不过,稍微深入研究一下,它似乎可能取决于硬件平台的字节序。 x86 和 AMD64 都是小端,所以基本上涵盖了人们会运行 pydub 的所有地方(我认为?)

    【讨论】:

    • 完美。谢谢!
    猜你喜欢
    • 2016-03-12
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2014-07-07
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多