媒体 API
POST/omni/media/v1/audio/generations

语音生成 (TTS)

文字转语音是同步的——文字进、一个音频文件以签名 URL 回。base URL 与 atp- key 同上。gateway 把 unified model 路由到音频 provider(例如 fish-s2-pro)并说对应方言。没有异步任务;GET /omni/media/v1/audio/tasks/{id} 一律回 404

  • 输出写入对象存储、以带签名的边缘 URL(https://media-<env>.atptoken.ai/v/...)回传,TTL 30 分钟——不会内嵌 base64。请尽快取用。
  • 当 project 余额 ≤ 0,请求会以 402 insufficient_quota 拒绝。
curl https://api.atptoken.ai/omni/media/v1/audio/generations \
  -H "Authorization: Bearer atp-..." -H "Content-Type: application/json" \
  -d '{ "model": "fish-s2-pro", "text": "Hello from ATP Token.", "format": "mp3" }'
FieldTypeDescription
modelstring · 必填unified audio model (`audio` pool)
textstring · 必填text to speak
reference_idstringvoice id (string, or array for multi-speaker)
formatstring`mp3` (default) / `wav` / `pcm` / `opus`
sample_rateintegerHz (format default)
prosodyobject`{ "speed": 1, "volume": 0, "normalize_loudness": true }`
temperaturenumberexpressiveness 0–1 (default `0.7`)

响应 200

{
  "created": 1781776187,
  "data": [
    { "url": "https://media-prod.atptoken.ai/v/audio/aud_....mp3?exp=...&sig=..." }
  ]
}

**OpenAI 风格 client:**OpenAI TTS 模型也接受 OpenAI 格式——inputvoiceresponse_format——由 gateway 转换。

错误

400
missing `model` / `text`, or an invalid `format`.
422
the model has no audio provider.