U2 Flash
U2 Flash 聚焦Agent 与 Coding核心场景,具备强大的复杂推理、代码生成与任务执行能力,支持长上下文,可胜任复杂工程开发、长程任务及多步骤Agent 工作流。在保持强劲模型能力的同时,实现更快的推理速度与更优的成本效率,为开发者与企业提供高性能、高性价比的智能底座。
U2 Flash 聚焦Agent 与 Coding核心场景,具备强大的复杂推理、代码生成与任务执行能力,支持长上下文,可胜任复杂工程开发、长程任务及多步骤Agent 工作流。在保持强劲模型能力的同时,实现更快的推理速度与更优的成本效率,为开发者与企业提供高性能、高性价比的智能底座。
Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。面向长程编程、知识工作和推理等前沿智能场景而设计。
GLM-5.3 是智谱迄今编程能力最强的模型,在内部自建体感评测中较 GLM-5.2 提升 50%;网络安全能力:在白盒代码审查与漏洞发现等安全任务中,GLM-5.3 的表现持平 Mythos 5,展现出面向网络安全防御场景的强大潜力。
GLM-5.3-Flash 是智谱 GLM-5 系列首个原生多模态模型,以极致低成本架构实现超越 GLM-5.2 的更强智能。模型采用 320B 总参 / 18B 激活的稀疏 + 线性注意力混合架构,视觉能力原生融入 Coding 循环,可主动观察界面、渲染结果与交互反馈,跨代码、浏览器与图形界面协同完成任务;同时拓展至 Office、金融研究及专业文档场景,能自主拆解目标、调用工具并优化输出。
GLM-5.2是智谱AI面向长程任务(Long Horizon Task)设计的新一代开源旗舰模型,支持1M无损超长上下文。具备卓越的编程与工程能力,可自主完成任务拆解、架构设计、前后端开发、联调测试到多端部署的完整链路,适用于复杂工程任务、长程交互、代码生成、企业应用等场景。
Qwen3.7系列中高性价比Plus模型,在强大文本能力的基础上全面升级了视觉-语言能力,同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力,能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。
Qwen3.8-Flash 是千问最新推出的多模态大模型,兼具强大的理解与生成能力和出色的响应速度。模型原生支持百万级上下文窗口,能够一次性处理超长文档、代码仓库和复杂对话。在编程辅助、智能体协作、图文理解等场景中表现尤为出色——无论是自动修复代码、操作桌面应用,还是分析图表与长视频,都能给出准确、高质量的结果。同时兼容 OpenAI 与 Anthropic 主流接口协议,可无缝接入 Claude Code、Codex 等开发者工具,轻松构建高并发应用与智能工作流。凭借优异的性能与极具竞争力的推理成本,Qwen3.8-Flash 是开发者和企业在 AI 应用中兼顾效果与效率的理想选择。
2.4 万亿参数 MoE 旗舰,编程与办公能力全面跃升,可自主编程十数天交付完整项目;原生视觉理解贯穿规划、执行与验证全流程,支持超长文档与长视频的深度语义解析。
云知声发布新一代旗舰大模型 Unisound U2,凭借高智能密度、高 Token 价值、原生智能体三大核心突破,重塑大模型效率与自主能力。依托数据提纯与高密度语义表征,做到小体量强能力,单 Token 信息价值更高,推理成本更低,任务表现不输大参数模型。结合首创的原生推理路径蒸馏技术,可自主完成任务拆解、执行、校验与优化,形成全链路闭环,是新一代 AI Agent 的理想原生基座。
U2-Med 深度掌握医疗知识、医保政策、药学规则与医学文献,可精准解析病历、检查报告、处方单据、政策条款、学术文献等多类型专业内容。无论是普通用户解读体检报告、咨询用药与医保报销问题,还是医疗机构开展医保审核、保险理赔、药物研发、临床研究等专业工作,均能提供精准、高效、可信赖的智能支持。
U2-RadiMed 是云知声自研的专业医学影像大模型,支持影像与文本输入。辅助医生进行影像解读、病灶定位、辅助诊断,并自动生成结构化报告,实现从影像分析到临床决策支持的全流程协同,成为可信的 AI 医疗助手。
U2-TTS 把拟人化细节、风格/情绪控制与多语种多方言能力结合起来,让同一段文字既能用于严肃的业务播报,也能切换成更有感染力的角色口吻,适配不同内容与品牌表达。同时支持长文本异步合成与丰富音频输出配置,便于接入生产流程做规模化生成,在"好听"和"好用"之间取得平衡。
TTS-Clone 支持极少语音样本快速复刻目标音色,并生成高度还原、具备情感表达能力的自然语音。复刻音色可长期留存、反复调用,助力打造可沉淀、可复用的专属声音资产。
U2-TTS-Design 不需要上传真人样音,也不用从一堆固定音色里硬选——只要用自然语言描述你想要的声音(例如:性别、年龄、音高、语速、情绪、口音、质感、角色性格、使用场景),它就能从零生成一个可复用的专属音色。
U2-ASR 以全场景通用能力为基础,结合上下文理解与专属词汇优化,告别生硬逐字识别,升级为更自然的语义理解模式。覆盖多方言、中英双语,兼顾识别精准度与规整化文本输出,支持一句话识别与实时语音转写能力,适配即时交互与低延迟场景,个人、学习、办公、生活场景人人可用。
U1-OCR 是一款智能文档解析与抽取模型,突破传统 OCR 仅字符识别的局限,实现从"认字"到"懂文档、会提取"的升级。可一站式完成证照识别、版式还原、关键信息抽取,将非结构化文档自动转为规整可用的数据,覆盖日常办公、证照票据、复杂报表等全场景,大幅节省人工录入与核对时间。
U1-OCR-MED 是专为医疗场景打造的文档智能模型,具备医疗文书分类、专业信息抽取一站式处理能力,精准适配病历、检查报告、处方、收费单据等各类医疗文档场景,高效解决手写潦草、术语缩写、印章遮挡、排版复杂等行业痛点,同时支持零样本跨领域泛化,兼顾医疗专业精度与业务落地效率。
高效轻量化MoE模型,总参284B,激活13B,原生支持百万超长上下文能力。推理速度快、延迟低、调用成本低廉,综合能力均衡,主打高并发、轻量化任务,适合日常对话、内容创作、基础 RAG、批量文案处理等普惠刚需场景。
旗舰级 MoE 大模型,总参1.6T、激活 49B,原生支持百万级超长上下文。依托海量高质量训练数据,具备顶尖数学逻辑、复杂推理、专业代码与长文本深度解析能力,适配高阶科研、复杂办公、深度智能代理等高难度场景。
Kimi K2.5 是一个多模态智能体模型视觉和语言理解与高级智能体功能、即时模式和思考模式以及对话和智能体范式无缝集成。
Kimi K2.6具备更强更稳的长程代码编写能力,指令遵循和自我纠错能力显著提升,同时支持文本、图片与视频输入,思考与非思考模式,对话与Agent任务。
GLM-5.1是智谱AI推出的面向长程任务(Long Horizon Task)设计的模型,总参数744B,支持200K超长上下文,最大输出 128K tokens。拥有强大逻辑推理、长文本理解与代码生成能力、兼顾性能与推理效率;在多任务基准中表现优异,适用于智能交互、企业应用、开发辅助等场景。
GLM-5是面向Coding与Agent场景的新一代大模型,在复杂系统工程与长程任务中达到开源 SOTA,真实编程体验逼近 Claude Opus 级别;基于 744B 新基座、异步强化学习与稀疏注意力,实现从"写代码"到"写工程"的全面升级。
MiniMax M3 凭借业界领先的 Coding 与 Agentic 能力、1M 超长上下文窗口以及原生多模态特性,可出色胜任企业级长文档理解、高质量内容生成、代码编写、Bug 修复及原生应用构建等任务;强大的 Agentic 能力端到端贯通工作流,原生多模态更带来流畅自然的图文混合交互体验。
MiniMax-M2.5是于2026 年 2 月 12 日正式发布的全球首款原生为 Agent 场景设计的生产级大模型,主打 "更快更强更智能,为真实世界生产力而生",解决大模型" 慢、贵 " 的核心痛点。
Qwen3.7系列中规模最大、综合能力最强的Max文本模型,核心优势在于智能体能力的广度与深度:在编程、办公与生产力、长周期自主执行方面均能出色胜任各项任务。
Qwen3.6原生视觉语言系列Plus模型,展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果相较3.5系列显著提升。模型在Agentic coding、前端编程、Vibe coding等代码能力、多模态万物识别、OCR、物体定位等能力上显著增强。
Qwen3.6原生视觉语言系列Flash模型,模型效果相较3.5-Flash显著提升。本模型重点提升agentic coding能力(在多项代码智能体基准上大幅超越前代)、数学推理和代码推理能力;视觉方面在空间智能能力上显著增强,物体定位与目标检测提升尤为突出。
Qwen3.6系列35B-A3B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。模型效果相较3.5-35B-A3B显著提升了agentic coding能力、数学推理和代码推理能力、空间智能能力、物体定位与目标检测能力。