它主要是针对文字转WAV音频