完整流程:
① 用文字指令生成语音样本(TTS 预览)→
② 上传授权录音获得 consent_id →
③ 将生成的音频作为样本注册为 OpenAI 自定义语音(voice_xxx)→
④ 在实时对话中使用该 voice_id。
要求:需 OpenAI 账号开通 Custom Voices;预览文本建议 ≤20 秒;样本需 ≤30 秒。
要求:需 OpenAI 账号开通 Custom Voices;预览文本建议 ≤20 秒;样本需 ≤30 秒。
① 指令生成
② 授权上传
③ 注册 Realtime
④ 完成
步骤 1:通过指令生成语音样本
样本已生成,可试听。确认满意后进入步骤 2、3 注册为 Realtime 语音。
步骤 2:上传授权录音
步骤 3:注册为 OpenAI Realtime 自定义语音
将步骤 1 生成的 MP3 作为 audio_sample 上传,获得 voice_xxx,
可在 Realtime 中以 {"id":"voice_xxx"} 使用。
处理中...