从微观层面上来看文字转WAV音频