模型广场立即充值
U2-ASR
model id: u2-asr
概述
音频
U2-ASR 以全场景通用能力为基础,结合上下文理解与专属词汇优化,告别生硬逐字识别,升级为更自然的语义理解模式。覆盖多方言、中英双语,兼顾识别精准度与规整化文本输出,支持一句话识别与实时语音转写能力,适配即时交互与低延迟场景,个人、学习、办公、生活场景人人可用。
输入
输出
模型价格
输入
¥1
元/小时模型限流与上下文
并发20
快速接入
1. 调用URL
https://maas-api.unisound.com/v1/audio/asr/tasks
2. 获取API Key
3. 模型调用
Start Transcribe查看API文档
curl --request POST \
--url https://maas-api.unisound.com/v1/audio/asr/tasks \
--header 'Authorization: Bearer <api_key>' \
--header 'Content-Type: application/json' \
--data '
{
"file_id": 871009177767936,
"model": "u2-asr",
"format": "mp3",
"sample_rate": 16000,
"enable_itn": true,
"channel": 1,
"enable_speaker": false,
"speaker_num": 2,
"word_info": true,
"context": "上下文信息(限制500字)",
"hotwords": [
"元宇宙",
"区块链"
]
}
'