他需要积累文字转WAV音频