feat: 新增音频格式与采样率配置,完善OpenAI兼容格式映射

1.  新增BYTEDANCE_TTS_FORMAT和BYTEDANCE_TTS_SAMPLE_RATE环境变量配置
2.  实现OpenAI TTS格式到火山API格式的映射转换
3.  自动处理wav格式:内部用pcm请求后封装标准WAV头
4.  动态设置响应Content-Type,适配不同输出格式
5.  更新文档与配置示例,完善日志与错误处理
This commit is contained in:
sun
2026-06-27 23:28:35 +08:00
parent 82cc68e7ee
commit 21b86bfcfe
7 changed files with 269 additions and 82 deletions
+3
View File
@@ -33,9 +33,12 @@ type ByteDanceTTSConfig struct {
Model string // v3 声音复刻/语音大模型 子模型版本,复刻音色必填
URL string
Timeout time.Duration
Format string // 音频编码格式: mp3/ogg_opus/pcm/wav(wav内部用pcm请求再封装header)
SampleRate int // 采样率: 8000/16000/22050/24000/32000/44100/48000
}
type SynthesisResult struct {
AudioData []byte
ReqID string
Format string // 实际输出格式,用于设置 Content-Type
}