ElevenLabs Multilingual v2 is the higher-quality text-to-speech model across 32 languages, trading ~250-300ms of latency for better voice quality. Call POST /v1/audio/speech; `voice` takes an ElevenLabs voice_id.
curl https://conduit-api.bifrostapi.net/v1/audio/speech \
-H "Authorization: Bearer ck-YOUR_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"eleven-multilingual","input":"你好,世界"}' \
--output out.mp3→ 返回二进制音频(audio/mpeg)。默认音色即可跑;要换音色再加 "voice",填 ElevenLabs 的 voice_id。
鉴权 · 计费 · 流式 → 快速接入