代码之家  ›  专栏  ›  技术社区  ›  Simon Ernesto Cardenas Zarate

如何将linear16文本转换为语音并转换为音频文件

  •  0
  • Simon Ernesto Cardenas Zarate  · 技术社区  · 7 年前

    我刚开始玩Google文本语音转换API。我生成了一个post请求:

    https://texttospeech.googleapis.com/v1/text:synthesize?fields=audioContent&key={YOUR_API_KEY}
    

    使用以下数据:

    {
     "input": {
      "text": "Hola esto es una prueba"
    },
     "voice": {
      "languageCode": "es-419"
     },
     "audioConfig": {
      "audioEncoding": "LINEAR16",
      "speakingRate": 1,
      "pitch": 0
     }
    }
    

    我得到了200份回复,内容如下:

    {
        "audioContent" : "UklGRn6iCwBXQVZFZm10I...(super long string)"
    }
    

    我假设这是编码的(或解码的,不确定命名),但我想听听什么是“音频内容”。

    0 回复  |  直到 7 年前
        1
  •  1
  •   Simon Ernesto Cardenas Zarate    7 年前

    像 Tanaike 指出,回应确实是Base64。为了实际收听音频,我将base64编码字符串粘贴到一个文件中,然后运行:

    base64 -d audio.txt > audio.wav
    

    这就成功了。

    推荐文章