自定义音色

少量样本即可克隆专属音色。本节介绍该模型在天鸿智算平台的接入方式、请求参数与示例代码。

本模型已在天鸿智算平台上线,调用方式与 OpenAI 兼容协议保持一致。如需具体的参数细节、计费单价或上线状态,请前往 控制台 查阅或 联系技术支持

接口信息

项目
请求方法POST
请求地址https://api.thhtcloud.com/v1/audio/speech
模型名 (model)请前往控制台查询当前可用的最新模型 ID
认证方式Authorization: Bearer <YOUR_API_KEY>

调用示例

下方为通用调用示例,请将 MODEL_NAME 替换为该模型的实际 ID,并填入您的 API Key。

curl https://api.thhtcloud.com/v1/audio/speech \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $YOUR_API_KEY" \
  -d '{
    "model": "自定义音色",
    "input": "欢迎使用天鸿智算语音合成服务",
    "voice": "default",
    "format": "mp3"
  }' --output output.mp3

常用参数

以下为该接口的常见参数。具体支持哪些参数、各参数的取值范围,请以控制台 API 探索器实测为准。

参数详情待补充

本模型的完整参数列表(如分辨率、时长、采样数、风格预设、CFG、Seed 等)将在后续文档迭代中补全。当前可在控制台「API 探索器」中查看每个参数的实时支持情况。

响应说明

响应体遵循 OpenAI 兼容协议结构:

  • 同步接口(文本、图片):直接返回生成结果或资源地址
  • 异步接口(视频、长音频):先返回 task_id,再通过查询接口轮询状态,状态变为 succeeded 后返回结果

注意事项

  • 请求超时时间建议设置为 60 秒,异步任务的轮询间隔建议为 5 秒
  • 视频生成等长耗时任务,请使用 Webhook 或异步轮询,避免阻塞主线程
  • 生成结果默认保存有效期有限,请在过期前下载或转存到您的 OSS
  • 如触发内容安全策略将返回 content_filter 错误,请检查输入提示词

相关文档