通用通用于多行业、多场景的基础模型能力
医疗面向医疗场景的专业模型能力
语音U2-ASR-Med敬请期待
医疗语音识别模型
语音U2-TTS-Med敬请期待
医疗语音合成模型
视觉U1-OCR-Med
专为医疗场景打造,集文书分类、版面解析、专业信息抽取于一体。
视觉U2-RadiMed敬请期待
医疗影像模型
语音›音色设计
未检测到 API Key,请点击右上角「配置 API Key」按钮后再使用调试功能。
新闻主播
Prompt:一位35岁左右的女性新闻主播,嗓音清亮、字正腔圆,带有标准的播音腔。语速平稳且节奏感强,语气客观、冷静、专业,不带过多的个人情感色彩,展现出新闻播报的权威感。
电台DJ
Prompt:一位20多岁的年轻男性电台DJ,声音低沉温柔,略带一点磁性的沙哑。语速偏慢,音量较小,像是在深夜里对着麦克风轻声交谈,语气中带着平静和淡淡的忧伤,营造出极强的亲密感和陪伴感。
说书人
Prompt:一位50岁左右的中年男性说书人,嗓音深沉厚重,带有明显的颗粒感。语速缓慢,在关键节点有明显的停顿,语气神秘、压抑,善于通过压低声音来制造紧张和悬疑的氛围。
软萌四川妹子
Prompt:用温柔的四川话,女生。
幼儿园老师
Prompt:一位20多岁的女性幼儿园老师,声音清脆甜美,音调偏高,充满元气。语速轻快,语气活泼夸张,带着满满的爱心和耐心,像是在和一群小朋友面对面讲故事,极具亲和力。
售后客服
Prompt:一位30岁左右的女性高端客服专员,声音知性、温柔且极具亲和力。她正在面对一位极度愤怒的VIP客户,语气需要保持绝对的柔软、真诚,并带有明显的愧疚感。语速偏慢,在句与句之间有小停顿。
声音配置
0 / 1000字符
填写时需 8-64 位,英文字母开头,支持字母/数字/-/_,末位不能为 - 或 _;voice_id 不可重复
0 / 100
使用指南
描述音色的性别、年龄、音调特点,说明语速、情感、适用场景
试听文本应该能体现音色特点
如果音色偏差较大,可调整描述中的年龄、音高、语速、口音、情绪、用途等维度重新生成。
语音合成可选择 u2-tts-design模型,使用对应 voice_id 即可调用设计音色。
