中
En
配置 API Key
通用
通用于多行业、多场景的基础模型能力
文本
Unisound U2
面向任务执行的原生智能体大模型,具备顶尖复杂推理、专业代码与长文本深度解析能力。
语音
U2-ASR
将音频文件快速精准转写为文本,实现多场景语音数字化。
语音
U2-TTS
文本转语音,生成自然流畅、多音色、多情感语音。
语音
U2-TTS-Clone
集文本转语音与声音克隆功能于一体,秒级克隆、高保真还原。
语音
U2-TTS-Design
自由调配音色风格与情绪,快速产出专属人声,高效满足各类语音合成需求。
视觉
U1-OCR
具备文档智能分类、证照精准识别、版式原样还原、关键信息智能抽取四大核心解析能力。
医疗
面向医疗场景的专业模型能力
文本
U2-Med
面向医疗、医保、医药全场景的专业大模型,覆盖临床、审核、风控、健康管理等核心业务。
语音
U2-ASR-Med
敬请期待
医疗语音识别模型
语音
U2-TTS-Med
敬请期待
医疗语音合成模型
视觉
U1-OCR-Med
专为医疗场景打造,集文书分类、版面解析、专业信息抽取于一体。
视觉
U2-RadiMed
敬请期待
医疗影像模型
U2 SkillHub
AI Agent技能商店,一键安装、海量精选与自定义Skill上传平台。
U2 Agent
原生 Agent 大模型智能助手,支持对话、专家 Agent 双模式,适配办公、金融等场景。
U2Claw
聚合多领域 AI 专家的桌面 AI Agent 龙虾智能工具。
语音
›
语音合成(同步)
未检测到 API Key,请点击右上角「配置 API Key」按钮后再使用调试功能。
文字转语音
选择合成模型
u2-tts
合成试听
0 / 500字
参数调试
音色设置
*
音色 (voice_id)
请选择音色
语种 (language)
方言 (dialect)
情绪 (emotion)
中性
音量音速
音量 (volume)
[0, 100]
0
50
100
语调 (pitch)
[0, 100]
0
50
100
音频设置
采样率 (audio_sample_rate)
32000
输出格式 (format)
mp3
自定义发音规则
发音 / 注音替换规则 (pronunciation_dict)