模型广场

U2-ASR

model id: u2-asr

概述

音频

U2-ASR 以全场景通用能力为基础,结合上下文理解与专属词汇优化,告别生硬逐字识别,升级为更自然的语义理解模式。覆盖多方言、中英双语,兼顾识别精准度与规整化文本输出,支持一句话识别与实时语音转写能力,适配即时交互与低延迟场景,个人、学习、办公、生活场景人人可用。

输入
音频
输出
文本

模型价格

立即充值
输入
¥1
元/小时

模型限流与上下文

并发20

快速接入

1. 调用URL

https://maas-api.unisound.com/v1/audio/asr/tasks

2. 获取API Key

3. 模型调用

Start Transcribe查看API文档
curl --request POST \
  --url https://maas-api.unisound.com/v1/audio/asr/tasks \
  --header 'Authorization: Bearer <api_key>' \
  --header 'Content-Type: application/json' \
  --data '
  {
    "file_id": 871009177767936,
    "model": "u2-asr",
    "format": "mp3",
    "sample_rate": 16000,
    "enable_itn": true,
    "channel": 1,
    "enable_speaker": false,
    "speaker_num": 2,
    "word_info": true,
    "context": "上下文信息(限制500字)",
    "hotwords": [
        "元宇宙",
        "区块链"
      ]
  }
'