但终究是提出了要求文字转WAV音频