feat: 新增音频格式与采样率配置,完善OpenAI兼容格式映射
1. 新增BYTEDANCE_TTS_FORMAT和BYTEDANCE_TTS_SAMPLE_RATE环境变量配置 2. 实现OpenAI TTS格式到火山API格式的映射转换 3. 自动处理wav格式:内部用pcm请求后封装标准WAV头 4. 动态设置响应Content-Type,适配不同输出格式 5. 更新文档与配置示例,完善日志与错误处理
This commit is contained in:
@@ -33,9 +33,12 @@ type ByteDanceTTSConfig struct {
|
||||
Model string // v3 声音复刻/语音大模型 子模型版本,复刻音色必填
|
||||
URL string
|
||||
Timeout time.Duration
|
||||
Format string // 音频编码格式: mp3/ogg_opus/pcm/wav(wav内部用pcm请求再封装header)
|
||||
SampleRate int // 采样率: 8000/16000/22050/24000/32000/44100/48000
|
||||
}
|
||||
|
||||
type SynthesisResult struct {
|
||||
AudioData []byte
|
||||
ReqID string
|
||||
Format string // 实际输出格式,用于设置 Content-Type
|
||||
}
|
||||
|
||||
Reference in New Issue
Block a user