模型/Qwen/qwen3-tts-vc
Qwen
NEW

Qwen3-TTS-VC

文本音频
合成
≈$0.83
/ 万字符
创建音色
$0.01
/ 个

Qwen3-TTS-VC is Alibaba Tongyi's voice-cloning text-to-speech model — enroll a custom voice from a short reference clip, then synthesize any text in that voice across multiple languages.

快速开始

如何调用

POST /v1/audio/voices → /v1/audio/speech
bash
# 1) clone a voice (returns a voice id)
curl https://conduit-api.bifrostapi.net/v1/audio/voices \
  -H "Authorization: Bearer ck-YOUR_KEY" -F "file=@sample.wav"

# 2) speak with the cloned voice id
curl https://conduit-api.bifrostapi.net/v1/audio/speech \
  -H "Authorization: Bearer ck-YOUR_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen3-tts-vc","input":"你好","voice":"<your-voice-id>"}' --output out.wav

→ 先克隆拿到 voice id,再用它调 /audio/speech。

鉴权 · 计费 · 流式 → 快速接入

来自 Qwen 的其他模型