U2 Flash
为真实生产任务而生
灵活思考、持续执行,面向真实业务场景稳定完成复杂任务
云知声模型矩阵
文本、语音、视觉多模态融合,覆盖全场景 AI 需求
U2 Flash
文本面向复杂任务的高性价比通用大模型,具备推理、办公、Coding 与 Agent 等能力
Unisound U2
文本支持自主规划、工具调用、多 Agent 协同、长程任务编排与自主纠错,可完成从目标理解到结果交付的全链路执行,兼顾高效推理与低 Token 消耗。
U2-Med
文本具备医疗 · 医保 · 医药 全场景专业能力,覆盖临床、审核、风控、健康管理、医药研发,提供精准可信赖的三医智能服务。
U2-RadiMed
文本支持影像与文本多模态输入,提供病灶定位、影像解读、诊断辅助与结构化报告生成能力。
U2-ASR
语音复杂噪音与方言场景识别准确率业内首次突破90%,多语种、全体系方言覆盖,长音频结构化转写,快速可靠、易落地。
U2-TTS
语音语义理解与细腻情感表达双突破,高度拟人化,创意多元,赋予语音自然表达力
U2-TTS-Clone
语音一句话样本即可秒级克隆音色,支持情感迁移与中英跨语种合成,快速沉淀品牌 / 角色专属声音资产。
U2-TTS-Design
语音无需参考音频,文字即可原创定制音色,全维度调节声线风格,支持永久复用与资产管理,轻松打造个人及企业专属声音资产库。
U1-OCR
视觉融合视觉与语义解析能力,具备完善文档处理能力,兼容多语种、手写及各类非标文档,可满足个人日常文件打理与企业文档数字化处理需求。
U1-OCR-Med
视觉专为医疗场景打造,适配病历、处方、检查报告、收费单据等各类医疗文档,可高效处理复杂医学表述与手写、印章等特殊场景,助力智慧医疗业务高效落地。
与顶尖伙伴携手共创
深入产业,为 500+ 企业创造卓越价值


































