luxtts · 2026-10-06

实时语音

短句对话用。整段 wav 一次返回,短句生成通常在 300ms 内。有声小说见 tts.html,耳语见 asmr.html。三套不要混模型名。

接入
项值
端点POST /v1/audio/speech
ttkkhttps://ttkk.inping.com/v1/audio/speech
ttqqhttps://ttqq.inping.com/v1/audio/speech
api.clavue.comhttps://api.clavue.com/v1/audio/speech
鉴权Authorization: Bearer sk-…(各站自己的令牌)
modelluxtts(等价 clavue-tts-live)
返回audio/wav,48 kHz,单声道
超时客户端 30s 足够。按一句一句打,不要当有声书队列。

三个入口 body 相同。内网网关 http://192.168.2.100:11401/v1/audio/speech,NodePort http://192.168.2.100:31821。

字段

字段说明
modelluxtts 或 clavue-tts-live
input要说的字。必填,1–200 字。一句到一小句,越短越快
voice音色。不传默认 夹子。speaker 同义
num_steps可选,1–8,默认 2。加大稍慢、齿音轻一点。对话保持 2

没有 instructions。音色只由 voice 决定。传了风格字段也不会改腔。

音色

voice也认听感
夹子jiazi · 夹子音默认。高、甜、尾音往上勾
御姐yujie · 御姐音中低、稳、有距离
少御shaoyu · 少御音年轻、干净、尾音收住
温柔wenrou稍慢、软
绿茶lvcha · 绿茶妹甜软
男声male · 男男声

未知 voice 返回 400,并带可选 id 列表。这些音色是参考句克隆,不是录音棚原声。

请求

POST https://ttkk.inping.com/v1/audio/speech
Authorization: Bearer sk-…
Content-Type: application/json

{
  "model": "luxtts",
  "input": "好,我在。你说。",
  "voice": "夹子"
}

curl

curl -sS -m 30 -o out.wav \
  -H "Authorization: Bearer $CLAVUE_KEY" -H 'Content-Type: application/json' \
  -d '{"model":"luxtts","input":"好,我在。你说。","voice":"夹子"}' \
  https://ttkk.inping.com/v1/audio/speech

ttqq、api.clavue.com 只换主机名。响应头 X-Voice 是实际音色 id(如 jiazi),X-Generate-Ms 是生成耗时,X-Audio-Seconds 是音频时长,X-Rtf 是耗时/时长,X-Num-Steps 是步数。

Python(openai SDK)

from openai import OpenAI
client = OpenAI(base_url="https://ttkk.inping.com/v1", api_key=CLAVUE_KEY)
r = client.audio.speech.create(
    model="luxtts",
    input="好,我在。你说。",
    voice="夹子",
    timeout=30,
)
r.write_to_file("out.wav")

怎么接进对话

不要做