feat: 新增音频格式与采样率配置,完善OpenAI兼容格式映射

1.  新增BYTEDANCE_TTS_FORMAT和BYTEDANCE_TTS_SAMPLE_RATE环境变量配置
2.  实现OpenAI TTS格式到火山API格式的映射转换
3.  自动处理wav格式:内部用pcm请求后封装标准WAV头
4.  动态设置响应Content-Type,适配不同输出格式
5.  更新文档与配置示例,完善日志与错误处理
This commit is contained in:
sun
2026-06-27 23:28:35 +08:00
parent 82cc68e7ee
commit 21b86bfcfe
7 changed files with 269 additions and 82 deletions
+7
View File
@@ -21,6 +21,13 @@ BYTEDANCE_TTS_SPEAKER=your_speaker_id_here
# 请求超时时间,默认30秒
BYTEDANCE_TTS_TIMEOUT=30s
# 音频格式:mp3/ogg_opus/pcm/wav(默认mp3)
# 注意:流式场景下wav会多次返回header,内部自动用pcm请求再封装header
BYTEDANCE_TTS_FORMAT=mp3
# 音频采样率:8000/16000/22050/24000/32000/44100/48000(默认24000)
BYTEDANCE_TTS_SAMPLE_RATE=24000
# OpenAI兼容接口的API密钥(可选)
OPENAI_TTS_API_KEY=your_openai_compatible_key_here