模型广场

U2-TTS

model id: u2-tts

概述

音频

U2-TTS 把拟人化细节、风格/情绪控制与多语种多方言能力结合起来,让同一段文字既能用于严肃的业务播报,也能切换成更有感染力的角色口吻,适配不同内容与品牌表达。同时支持长文本异步合成与丰富音频输出配置,便于接入生产流程做规模化生成,在"好听"和"好用"之间取得平衡。

输入
文本
输出
音频

模型价格

立即充值
输入
¥2
元/万字

模型限流与上下文

并发20

快速接入

1. 调用URL

https://maas-api.unisound.com/v1/audio/speech/tasks

2. 获取API Key

3. 模型调用

Create T2A Async Task查看API文档
curl --request POST \
  --url https://maas-api.unisound.com/v1/audio/speech/tasks \
  --header 'Authorization: Bearer <api_key>' \
  --header 'Content-Type: application/json;charset=UTF-8' \
  --data '{
  "model": "u2-tts",
  "text": "水泊梁山的故事家喻户晓",
  "voice_setting": {
    "voice_id": "cn_male_chenyu",
    "volume": 50,
    "pitch": 50,
    "bright": 50,
    "emotion": "happy",
    "language": "zh"
  },
  "pronunciation_dict": {
    "tone": [
      "水泊梁山/水泊<py>po1</py>梁山"
    ]
  },
  "audio_setting": {
    "audio_sample_rate": 16000,
    "format": "mp3"
  }
}'