# 千问云 > 千问云是阿里云推出的大模型服务平台,提供通义千问系列模型及第三方模型的API服务,覆盖文本生成、视觉理解、语音识别与合成、图像/视频生成、向量检索等AI能力。 - [模型市场](https://www.qianwenai.com/models.md) ## 智能体 - [零门槛搭建全托管智能体,可信赖 AI 生产力](https://www.qianwenai.com/agents/jvs.md): 可信赖的企业级 Agent 生产力 助力个人、开发者及企业零门槛构建、运行专属 AI 智能体,让 Agent 从能跑到好用 - [想到即做到,AI 伙伴助你分钟级造应用](https://www.qianwenai.com/agents/meoo.md): 有想法,就妙悟 秒悟 Meoo 是云端极速 AI 应用创作平台。它是一个“会编程、懂设计、自部署的 AI 伙伴”。分钟级将灵感变成一个产品,按需启动云服� - [深度智能,真实工程](https://www.qianwenai.com/agents/qoder.md): 面向真实软件的智能体编程平台 你定义目标,Qoder 编程智能体理解你的代码库与工程规范,自主完成规划、编码、验证,交付可审查的结果 - [说出想法,自动完成,直接交付](https://www.qianwenai.com/agents/qoderwork.md): 不止聊天,搞定一切 将 Qoder Agent 能力扩展到日常工作,自然语言描述需求即可自动拆解任务、交付结果,轻松完成文件整理、数据处理与文档生成 - [为什么选择 千问](https://www.qianwenai.com/agents/qwen.md): 阿里官方 AI 助手 体验最新、最强 Qwen 大模型的第一入口,“聪明会办事”,旨在成为你在工作、学习、生活中的 AI 助手 - [多模态融合创作,释放无限创意](https://www.qianwenai.com/agents/wan.md): 领先的视觉生成大模型体验与创作平台 万相是阿里巴巴的 AI 视觉创作平台,提供图像和视频的生成与编辑能力,适用于广告、影视、游戏、UGC 等场景� - [能聊天,更能做事](https://www.qianwenai.com/agents/wukong.md): 你说,悟空干 悟空是钉钉推出的 AI 桌面智能体,打通企业数据,不只会聊天,更能动手干活,让每个人都拥有一支 AI 团队。 ## Qwen3.7 系列 - [Qwen3.7-Max](https://www.qianwenai.com/models/qwen3.7-max-preview.md): 文本生成推理 Qwen3.7系列中规模最大、综合能力最强的Max模型预览版,仅支持思考模式,开放纯文本模型能力供体验。主要优化面向用户的通用对话场景 - [Qwen3.7-Max](https://www.qianwenai.com/models/qwen3.7-max.md): 推理文本生成 Qwen3.7系列中规模最大、综合能力最强的Max模型,当前开放纯文本模型能力供体验。Qwen3.7是面向智能体时代的新一代旗舰模型,核心优势� ### Qwen3.7 系列 - 历史版本 - [Qwen3.7-Max (qwen3.7-max-2026-05-17)](https://www.qianwenai.com/models/qwen3.7-max-2026-05-17.md) - [Qwen3.7-Max (qwen3.7-max-2026-05-20)](https://www.qianwenai.com/models/qwen3.7-max-2026-05-20.md) ## Qwen3.6 系列 - [Qwen3.6开源模型](https://www.qianwenai.com/models/qwen3.6-27b.md): 推理视觉理解文本生成 Qwen3.6系列27B原生视觉语言Dense模型,模型效果相较3.5-27B重点提升了Agentic coding能力、模型STEM与推理能力进一步增强;视觉模态方 - [Qwen3.6开源模型](https://www.qianwenai.com/models/qwen3.6-35b-a3b.md): 视觉理解文本生成推理 Qwen3.6系列35B-A3B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。� - [Qwen3.6-Flash](https://www.qianwenai.com/models/qwen3.6-flash.md): 推理视觉理解文本生成 Qwen3.6原生视觉语言系列Flash模型,模型效果相较3.5-Flash显著提升。本模型重点提升agentic coding能力(在多项代码智能体基准上大� - [Qwen3.6-Max](https://www.qianwenai.com/models/qwen3.6-max-preview.md): 推理文本生成 Qwen3.6系列中规模最大、综合能力最强的Max模型Preview版本,当前开放纯文本模型能力供体验。相较于此前发布的Qwen3-Max和Qwen3.6-Plus,本模� - [Qwen3.6-Plus](https://www.qianwenai.com/models/qwen3.6-plus.md): 推理视觉理解文本生成 Qwen3.6原生视觉语言系列Plus模型,展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果相较3.5系列显著提升。模型在Agentic cod ### Qwen3.6 系列 - 历史版本 - [Qwen3.6-Flash (qwen3.6-flash-2026-04-16)](https://www.qianwenai.com/models/qwen3.6-flash-2026-04-16.md) - [Qwen3.6-Plus (qwen3.6-plus-2026-04-02)](https://www.qianwenai.com/models/qwen3.6-plus-2026-04-02.md) ## Qwen3.5 系列 - [Qwen3.5开源模型](https://www.qianwenai.com/models/qwen3.5-122b-a10b.md): 推理视觉理解文本生成 Qwen3.5系列122B-A10B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。 - [Qwen3.5开源模型](https://www.qianwenai.com/models/qwen3.5-27b.md): 推理视觉理解文本生成 Qwen3.5系列27B原生视觉语言Dense模型,融合了线性注意力机制;响应速度快,兼具推理速度和性能。该模型的综合能力接近于Qwen3.5 - [Qwen3.5开源模型](https://www.qianwenai.com/models/qwen3.5-35b-a3b.md): 推理视觉理解文本生成 Qwen3.5系列35B-A3B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。� - [Qwen3.5开源模型](https://www.qianwenai.com/models/qwen3.5-397b-a17b.md): 推理视觉理解文本生成 Qwen3.5系列397B-A17B原生视觉语言模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。 - [Qwen3.5-Flash](https://www.qianwenai.com/models/qwen3.5-flash.md): 推理视觉理解文本生成 Qwen3.5原生视觉语言系列Flash模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。模� - [Qwen3.5-LiveTranslate-Flash-Realtime](https://www.qianwenai.com/models/qwen3.5-livetranslate-flash-realtime.md): 实时语音翻译 Qwen3.5-LiveTranslate-Flash的实时版本,一款高精度、高响应、高鲁棒性的多语言实时音视频同传大模型。依托Qwen3.5-Omni强大的基座能力、海量� - [Qwen3.5-Omni-Flash-Realtime](https://www.qianwenai.com/models/qwen3.5-omni-flash-realtime.md): 实时全模态 Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本,支持60+种语言音频输入 - [Qwen3.5-Omni-Flash](https://www.qianwenai.com/models/qwen3.5-omni-flash.md): 多模态 Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本, 支持超过 10 小时的音频理� - [Qwen3.5-Omni-Plus-Realtime](https://www.qianwenai.com/models/qwen3.5-omni-plus-realtime.md): 实时全模态 Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本,支持60+种语言音频输入 - [Qwen3.5-Omni-Plus](https://www.qianwenai.com/models/qwen3.5-omni-plus.md): 多模态 Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本, 支持超过 10 小时的音频理� - [Qwen3.5-Plus](https://www.qianwenai.com/models/qwen3.5-plus.md): 文本生成推理视觉理解 Qwen3.5原生视觉语言系列Plus模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在� ### Qwen3.5 系列 - 历史版本 - [Qwen3.5-Flash (qwen3.5-flash-2026-02-23)](https://www.qianwenai.com/models/qwen3.5-flash-2026-02-23.md) - [Qwen3.5-LiveTranslate-Flash-Realtime (qwen3.5-livetranslate-flash-realtime-2026-05-19)](https://www.qianwenai.com/models/qwen3.5-livetranslate-flash-realtime-2026-05-19.md) - [Qwen3.5-Omni-Flash (qwen3.5-omni-flash-2026-03-15)](https://www.qianwenai.com/models/qwen3.5-omni-flash-2026-03-15.md) - [Qwen3.5-Omni-Flash-Realtime (qwen3.5-omni-flash-realtime-2026-03-15)](https://www.qianwenai.com/models/qwen3.5-omni-flash-realtime-2026-03-15.md) - [Qwen3.5-Omni-Plus (qwen3.5-omni-plus-2026-03-15)](https://www.qianwenai.com/models/qwen3.5-omni-plus-2026-03-15.md) - [Qwen3.5-Omni-Plus-Realtime (qwen3.5-omni-plus-realtime-2026-03-15)](https://www.qianwenai.com/models/qwen3.5-omni-plus-realtime-2026-03-15.md) - [Qwen3.5-Plus (qwen3.5-plus-2026-02-15)](https://www.qianwenai.com/models/qwen3.5-plus-2026-02-15.md) - [Qwen3.5-Plus (qwen3.5-plus-2026-04-20)](https://www.qianwenai.com/models/qwen3.5-plus-2026-04-20.md) ## Qwen Coder 编程模型 - [Qwen-Coder-Plus](https://www.qianwenai.com/models/qwen-coder-plus.md): 文本生成 千问系列代码及编程模型是专门用于编程和代码生成的语言模型,性能出色,效果突出。 文本 - [Qwen-Coder-Turbo](https://www.qianwenai.com/models/qwen-coder-turbo.md): 文本生成 千问系列代码及编程模型是专门用于编程和代码生成的语言模型,推理速度快,成本低。 文本 - [Qwen3-Coder-30B-A3B-Instruct](https://www.qianwenai.com/models/qwen3-coder-30b-a3b-instruct.md): 文本生成 基于Qwen3的代码生成模型,继承Qwen3-Coder-480B-A35B-Instruct的coding agent能力,代码能力达到同尺寸规模模型SOTA。 文本 - [Qwen3-Coder-480B-A35B-Instruct](https://www.qianwenai.com/models/qwen3-coder-480b-a35b-instruct.md): 文本生成 基于Qwen3的代码生成模型,具有强大的Coding Agent能力,代码能力达到开源模型 SOTA。 文本 - [Qwen3-Coder-Flash](https://www.qianwenai.com/models/qwen3-coder-flash.md): 文本生成 基于Qwen3的代码生成模型,继承Qwen3-Coder-Plus的coding agent能力,支持多轮工具交互,重点优化仓库级别理解能力并增加工具调用稳定性。 文本 - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-coder-next.md): 文本生成 Qwen3系列新一代代码生成模型,效果接近Qwen3-Coder-Plus兼具更优性能。模型重点优化仓库级别理解、支持多轮工具交互、提升对于agentic coding类� - [Qwen3-Coder-Plus](https://www.qianwenai.com/models/qwen3-coder-plus.md): 文本生成 基于Qwen3的代码生成模型,具有强大的Coding Agent能力,擅长工具调用和环境交互,能够实现自主编程、代码能力卓越的同时兼具通用能力。 文� ### Qwen Coder 编程模型 - 历史版本 - [Qwen3-Coder-Flash (qwen3-coder-flash-2025-07-28)](https://www.qianwenai.com/models/qwen3-coder-flash-2025-07-28.md) - [Qwen3-Coder-Plus (qwen3-coder-plus-2025-07-22)](https://www.qianwenai.com/models/qwen3-coder-plus-2025-07-22.md) - [Qwen3-Coder-Plus (qwen3-coder-plus-2025-09-23)](https://www.qianwenai.com/models/qwen3-coder-plus-2025-09-23.md) ## Qwen 视觉语言模型 - [Qwen-VL-Max](https://www.qianwenai.com/models/qwen-vl-max.md): 视觉理解 千问VL-Max(qwen-vl-max),即千问超大规模视觉语言模型。相比增强版,再次提升视觉推理能力和指令遵循能力,提供更高的视觉感知和认知水� - [Qwen-VL-OCR](https://www.qianwenai.com/models/qwen-vl-ocr-1028.md): 视觉理解 千问VL-OCR(qwen-vl-ocr),即基于Qwen-VL训练的OCR识别大模型。通过统一模型的方式聚合多种图文识别、解析、处理类任务,提供强大的图文识别� - [Qwen-VL-OCR](https://www.qianwenai.com/models/qwen-vl-ocr.md): 视觉理解 千问VL-OCR(qwen-vl-ocr),即基于Qwen-VL训练的OCR识别大模型。通过统一模型的方式聚合多种图文识别、解析、处理类任务,提供强大的图文识别� - [Qwen-VL-Plus](https://www.qianwenai.com/models/qwen-vl-plus.md): 视觉理解 千问VL-Plus(qwen-vl-plus),即千问大规模视觉语言模型增强版。大幅提升细节识别能力和文字识别能力,支持超百万像素分辨率和任意长宽比规 - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-vl-235b-a22b-instruct.md): 视觉理解 Qwen3系列视觉理解模型,在视觉coding、空间感知等方向全面升级;视觉感知与识别能力大幅提升,支持超长视频理解,OCR能力迎来重大升级。 � - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-vl-235b-a22b-thinking.md): 视觉理解推理 Qwen3系列视觉理解模型,多模态思考能力显著增强,模型在STEM与数学推理方面进行了重点优化;视觉感知与识别能力全面提升、OCR能力迎� - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-vl-30b-a3b-instruct.md): 视觉理解 Qwen3-VL系列第二大MoE模型的Instruct版本,响应速度快,支持长视频长文档等超长上下文;全面升级图像/视频理解、空间感知与万物识别能力;� - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-vl-30b-a3b-thinking.md): 视觉理解推理 Qwen3-VL系列第二大MoE模型的Thinking版本,响应速度快,具备更强多模态理解与推理、视觉智能体、长视频长文档等超长上下文支持能力;全 - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-vl-32b-instruct.md): 视觉理解 Qwen3-VL系列最大尺寸Dense模型的非推理版本,综合表现仅次于Qwen3-VL-235B-Instruct,文档识别和理解能力出色,空间感知与万物识别能力强,视觉2D - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-vl-32b-thinking.md): 视觉理解推理 Qwen3-VL系列最大尺寸Dense模型的推理版本,多模态推理能力仅次于Qwen3-VL-235B-Thinking,STEM&数学类解题能力、通用图像和视频理解能力出众, - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-vl-8b-instruct.md): 视觉理解 Qwen3-VL系列8B Dense模型的Instruct版本,占用显存更低,全面升级图像/视频理解、长视频长文档等超长上下文支持、空间感知与万物识别能力,胜 - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-vl-8b-thinking.md): 视觉理解推理 Qwen3-VL系列8B Dense模型的Thinking版本,占用显存更低,能够完成多模态理解与推理;支持长视频长文档等超长上下文、视觉2D/3D定位;全面� - [Qwen-VL-Embedding](https://www.qianwenai.com/models/qwen3-vl-embedding.md): 向量 基于Qwen3-VL底座训练的统一多模态向量模型,支持文本、图片、视频单模态/混合模态输入,输出统一表征向量,适用于跨模态检索、图搜、视频检� - [Qwen3-VL-Flash](https://www.qianwenai.com/models/qwen3-vl-flash.md): 视觉理解推理 Qwen3系列小尺寸视觉理解模型,实现思考模式和非思考模式的有效融合,效果优于开源版Qwen3-VL-30B-A3B,响应速度快。全面升级图像/视频理 - [Qwen3-VL-Plus](https://www.qianwenai.com/models/qwen3-vl-plus.md): 视觉理解推理 Qwen3系列视觉理解模型,实现思考模式和非思考模式的有效融合,视觉智能体能力在OS World等公开测试集上达到世界顶尖水平。此版本在视 - [Qwen-Rerank](https://www.qianwenai.com/models/qwen3-vl-rerank.md): 向量 Qwen3-VL-Rerank重排模型,它能够深入理解文本、图片、视频的丰富多模态信息。在初步检索获得结果后,Qwen3-VL-Rerank 能够运用其先进的跨模态关联能 ### Qwen 视觉语言模型 - 历史版本 - [Qwen-VL-OCR (qwen-vl-ocr-2025-04-13)](https://www.qianwenai.com/models/qwen-vl-ocr-2025-04-13.md) - [Qwen-VL-OCR (qwen-vl-ocr-2025-08-28)](https://www.qianwenai.com/models/qwen-vl-ocr-2025-08-28.md) - [Qwen-VL-OCR (qwen-vl-ocr-2025-11-20)](https://www.qianwenai.com/models/qwen-vl-ocr-2025-11-20.md) - [Qwen-VL-OCR (qwen-vl-ocr-latest)](https://www.qianwenai.com/models/qwen-vl-ocr-latest.md) - [Qwen-VL-Plus (qwen-vl-plus-latest)](https://www.qianwenai.com/models/qwen-vl-plus-latest.md) - [Qwen3-VL-Flash (qwen3-vl-flash-2025-10-15)](https://www.qianwenai.com/models/qwen3-vl-flash-2025-10-15.md) - [Qwen3-VL-Flash (qwen3-vl-flash-2026-01-22)](https://www.qianwenai.com/models/qwen3-vl-flash-2026-01-22.md) - [Qwen3-VL-Plus (qwen3-vl-plus-2025-09-23)](https://www.qianwenai.com/models/qwen3-vl-plus-2025-09-23.md) - [Qwen3-VL-Plus (qwen3-vl-plus-2025-12-19)](https://www.qianwenai.com/models/qwen3-vl-plus-2025-12-19.md) ## Qwen 全模态模型 - [Qwen-Omni-Turbo-Realtime](https://www.qianwenai.com/models/qwen-omni-turbo-realtime.md): 实时全模态 千问全新多模态理解生成大模型实时版,适合实时音频交互场景。支持音频伴随文本、图像、视频混合输入理解,具备语音和文本同时流式� - [Qwen-Omni-Turbo](https://www.qianwenai.com/models/qwen-omni-turbo.md): 多模态 千问全新多模态理解生成大模型,支持文本, 图像,语音,视频输入理解和混合输入理解,具备文本和语音同时流式生成能力,多模态内容理解� - [Qwen2.5-开源模型](https://www.qianwenai.com/models/qwen2.5-omni-7b.md): 多模态 基于Qwen2.5训练的全新多模态理解生成大模型,支持文本, 图像,语音,视频输入理解和混合输入理解,具备文本和语音同时流式生成能力,多模� - [Qwen3-Omni-30b-a3b-Captioner](https://www.qianwenai.com/models/qwen3-omni-30b-a3b-captioner.md): 语音识别 千问3-Omni-30b-a3b-Captioner是一款强大的音频细粒度分析模型,专为在复杂多变的音频场景中生成精准、全面的内容描述而设计,可自动解析并描� - [Qwen3-Omni-Flash-Realtime](https://www.qianwenai.com/models/qwen3-omni-flash-realtime.md): 实时全模态 千问3-Omni-Flash多模态大模型的实时版,基于Thinker–Talker混合专家(MoE)架构,支持文本、图像、音频、视频的高效理解与语音生成能力,可 - [Qwen3-Omni-Flash](https://www.qianwenai.com/models/qwen3-omni-flash.md): 多模态 千问3-Omni-Flash多模态大模型,基于Thinker–Talker混合专家(MoE)架构,支持文本、图像、音频、视频的高效理解与语音生成能力,可进行119种语言 ### Qwen 全模态模型 - 历史版本 - [Qwen-Omni-Turbo (qwen-omni-turbo-2025-01-19)](https://www.qianwenai.com/models/qwen-omni-turbo-2025-01-19.md) - [Qwen-Omni-Turbo (qwen-omni-turbo-2025-03-26)](https://www.qianwenai.com/models/qwen-omni-turbo-2025-03-26.md) - [Qwen-Omni-Turbo (qwen-omni-turbo-latest)](https://www.qianwenai.com/models/qwen-omni-turbo-latest.md) - [Qwen-Omni-Turbo-Realtime (qwen-omni-turbo-realtime-2025-05-08)](https://www.qianwenai.com/models/qwen-omni-turbo-realtime-2025-05-08.md) - [Qwen-Omni-Turbo-Realtime (qwen-omni-turbo-realtime-latest)](https://www.qianwenai.com/models/qwen-omni-turbo-realtime-latest.md) - [Qwen3-Omni-Flash (qwen3-omni-flash-2025-09-15)](https://www.qianwenai.com/models/qwen3-omni-flash-2025-09-15.md) - [Qwen3-Omni-Flash (qwen3-omni-flash-2025-12-01)](https://www.qianwenai.com/models/qwen3-omni-flash-2025-12-01.md) - [Qwen3-Omni-Flash-Realtime (qwen3-omni-flash-realtime-2025-09-15)](https://www.qianwenai.com/models/qwen3-omni-flash-realtime-2025-09-15.md) - [Qwen3-Omni-Flash-Realtime (qwen3-omni-flash-realtime-2025-12-01)](https://www.qianwenai.com/models/qwen3-omni-flash-realtime-2025-12-01.md) ## Qwen3 基础语言模型 - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-14b.md): 推理文本生成 实现思考模式和非思考模式的有效融合,可在对话中切换模式。推理能力达到同规模业界SOTA水平、通用能力显著超过Qwen2.5-14B。 文本 - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-235b-a22b-instruct-2507.md): 文本生成 基于Qwen3的非思考模式开源模型,相较上一版本(千问3-235B-A22B)主观创作能力与模型安全性均有小幅度提升。 文本 - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-235b-a22b-thinking-2507.md): 推理文本生成 基于Qwen3的思考模式开源模型,相较上一版本(千问3-235B-A22B)逻辑能力、通用能力、知识增强及创作能力均有大幅提升,适用于高难度强 - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-235b-a22b.md): 推理文本生成 实现思考模式和非思考模式的有效融合,可在对话中切换模式。推理能力显著超过QwQ、通用能力显著超过Qwen2.5-72B-Instruct,达到同规模业� - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-30b-a3b-instruct-2507.md): 文本生成 基于Qwen3的非思考模式开源模型,相较上一版本(千问3-30B-A3B)中英文和多语言整体通用能力有大幅提升。主观开放类任务专项优化,显著更� - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-30b-a3b-thinking-2507.md): 推理文本生成 基于Qwen3的思考模式开源模型,相较上一版本(千问3-30B-A3B)复杂推理类任务性能优秀,包括逻辑推理、数学、科学、代码类等具有一定� - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-30b-a3b.md): 推理文本生成 实现思考模式和非思考模式的有效融合,可在对话中切换模式。推理能力以更小参数规模比肩QwQ-32B、通用能力显著超过Qwen2.5-14B,达到同� - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-32b.md): 推理文本生成 实现思考模式和非思考模式的有效融合,可在对话中切换模式。推理能力显著超过QwQ、通用能力显著超过Qwen2.5-32B-Instruct,达到同规模业� - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-8b.md): 推理文本生成 实现思考模式和非思考模式的有效融合,可在对话中切换模式。推理能力达到同规模业界SOTA水平、通用能力显著超过Qwen2.5-7B。 文本 - [Qwen3-Max](https://www.qianwenai.com/models/qwen3-max-preview.md): 文本生成推理 Qwen3系列Max模型Preview版本,实现思考模式和非思考模式的有效融合。思考模式下在智能体编程能力、常识知识推理能力、数学/科学/通用� - [Qwen3-Max](https://www.qianwenai.com/models/qwen3-max.md): 文本生成推理 千问3系列Max模型,相较preview版本在智能体编程与工具调用方向进行了专项升级。本次发布的正式版模型达到领域SOTA水平,适配场景更加� - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-next-80b-a3b-instruct.md): 文本生成 基于Qwen3的新一代非思考模式开源模型,相较上一版本(千问3-235B-A22B-Instruct-2507)中文文本理解能力更佳、逻辑推理能力有增强、文本生成类� - [Qwen3开源模型](https://www.qianwenai.com/models/qwen3-next-80b-a3b-thinking.md): 推理文本生成 基于Qwen3的新一代思考模式开源模型,相较上一版本(千问3-235B-A22B-Thinking-2507指令遵循能力有提升、模型总结回复更加精简。 文本 - [Qwen-Rerank](https://www.qianwenai.com/models/qwen3-rerank.md): 向量 基于Qwen LLM底座训练的文本排序模型,对输入的Query和候选Docs进行相关性排序,支持100+语种和长文本输入,适用于文本检索、RAG等场景,效果对齐� ### Qwen3 基础语言模型 - 历史版本 - [Qwen3-Max (qwen3-max-2025-09-23)](https://www.qianwenai.com/models/qwen3-max-2025-09-23.md) - [Qwen3-Max (qwen3-max-2026-01-23)](https://www.qianwenai.com/models/qwen3-max-2026-01-23.md) ## Qwen 推理模型 - [QVQ-Max](https://www.qianwenai.com/models/qvq-max.md): 推理视觉理解 千问QVQ视觉推理模型,支持视觉输入及思维链输出,在数学、编程、视觉分析、创作以及通用任务上都表现了更强的能力。 文本图像视频 - [Qwen-QVQ-Plus](https://www.qianwenai.com/models/qvq-plus.md): 推理视觉理解 千问QVQ视觉推理模型增强版,支持视觉输入及思维链输出,在数学、编程、视觉分析、创作以及通用任务上都表现了更强的能力 文本图像 - [Qwen-QwQ-Plus](https://www.qianwenai.com/models/qwq-plus.md): 推理 千问QwQ推理模型增强版,基于Qwen2.5模型训练的QwQ推理模型,通过强化学习大幅度提升了模型推理能力。模型数学代码等核心指标(AIME 24/25、livecode ## Qwen 文本模型 - [Qwen-Doc-Turbo](https://www.qianwenai.com/models/qwen-doc-turbo.md): 文本生成 快速对文档进行精准信息抽取,打标分类,内容审核及摘要总结。 文本 - [Qwen-Flash-Character](https://www.qianwenai.com/models/qwen-flash-character.md): 文本生成 千问系列多语言角色扮演模型,本模型是动态更新版本,模型更新会提前通知,适合拟人化的角色扮演,同时优化了限定人设指令遵循、话题� - [Qwen-Flash](https://www.qianwenai.com/models/qwen-flash.md): 推理文本生成 Qwen3系列Flash模型,实现思考模式和非思考模式的有效融合,可在对话中切换模式。复杂推理类任务性能优秀,指令遵循、文本理解等能力 - [Qwen-Long](https://www.qianwenai.com/models/qwen-long.md): 文本生成 Qwen-Long是在通义千问针对超长上下文处理场景的大语言模型,支持中文、英文等不同语言输入,支持最长1000万tokens(约1500万字或1.5万页文档)的 - [Qwen-Max](https://www.qianwenai.com/models/qwen-max.md): 文本生成 千问2.5系列千亿级别超大规模语言模型,支持中文、英文等不同语言输入。随着模型的升级,qwen-max将滚动更新升级。如果希望使用固定版本� - [Qwen-Plus](https://www.qianwenai.com/models/qwen-plus-0112.md): 文本生成 千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。相对于千问-Plus-2024-1220版本,中英文整体能力有 - [Qwen-Plus](https://www.qianwenai.com/models/qwen-plus-1220.md): 文本生成 千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。相对于千问-Plus-1125版本,中英文整体能力有提� - [Qwen-Plus-Character](https://www.qianwenai.com/models/qwen-plus-character.md): 文本生成 千问系列角色扮演模型,本模型是动态更新版本,模型更新会提前通知,适合拟人化的角色扮演,同时优化了限定人设指令遵循、话题推进、� - [Qwen-Plus](https://www.qianwenai.com/models/qwen-plus.md): 推理文本生成 Qwen3系列Plus模型,实现思考模式和非思考模式的有效融合,可在对话中切换模式。推理能力显著超过QwQ、通用能力显著超过Qwen2.5-Plus,达� - [Qwen-Turbo](https://www.qianwenai.com/models/qwen-turbo.md): 推理文本生成 Qwen3系列Turbo模型,实现思考模式和非思考模式的有效融合,可在对话中切换模式。推理能力以更小参数规模比肩QwQ-32B、通用能力显著超� ### Qwen 文本模型 - 历史版本 - [Qwen-Flash (qwen-flash-2025-07-28)](https://www.qianwenai.com/models/qwen-flash-2025-07-28.md) - [Qwen-Flash-Character (qwen-flash-character-2026-02-26)](https://www.qianwenai.com/models/qwen-flash-character-2026-02-26.md) - [Qwen-Long (qwen-long-2025-01-25)](https://www.qianwenai.com/models/qwen-long-2025-01-25.md) - [Qwen-Long (qwen-long-latest)](https://www.qianwenai.com/models/qwen-long-latest.md) - [Qwen-Plus (qwen-plus-2025-01-25)](https://www.qianwenai.com/models/qwen-plus-2025-01-25.md) - [Qwen-Plus (qwen-plus-2025-04-28)](https://www.qianwenai.com/models/qwen-plus-2025-04-28.md) - [Qwen-Plus (qwen-plus-2025-07-14)](https://www.qianwenai.com/models/qwen-plus-2025-07-14.md) - [Qwen-Plus (qwen-plus-2025-07-28)](https://www.qianwenai.com/models/qwen-plus-2025-07-28.md) - [Qwen-Plus (qwen-plus-2025-09-11)](https://www.qianwenai.com/models/qwen-plus-2025-09-11.md) - [Qwen-Plus (qwen-plus-2025-12-01)](https://www.qianwenai.com/models/qwen-plus-2025-12-01.md) - [Qwen-Plus (qwen-plus-latest)](https://www.qianwenai.com/models/qwen-plus-latest.md) ## Qwen 数学模型 - [Qwen-Math-Plus](https://www.qianwenai.com/models/qwen-math-plus-0816.md): 文本生成 千问数学模型具有强大的数学解题能力,擅长处理中英文数学题,包括方程、计算、证明等方向。 文本 - [Qwen-Math-Plus](https://www.qianwenai.com/models/qwen-math-plus-0919.md): 文本生成 千问系列数学模型是专门用于数学解题的语言模型,推理效果好,模型性能优秀本模型为2024年9月19日快照版本,预计维护到下个版本发布后一 - [Qwen-Math-Plus](https://www.qianwenai.com/models/qwen-math-plus.md): 文本生成 千问数学模型具有强大的数学解题能力,擅长处理中英文数学题,包括方程、计算、证明等方向。 文本 - [Qwen-Math-Turbo](https://www.qianwenai.com/models/qwen-math-turbo.md): 文本生成 千问系列数学模型是专门用于数学解题的语言模型,推理速度快,成本低。 文本 ### Qwen 数学模型 - 历史版本 - [Qwen-Math-Plus (qwen-math-plus-latest)](https://www.qianwenai.com/models/qwen-math-plus-latest.md) ## Qwen 翻译模型 - [Qwen-MT-Flash](https://www.qianwenai.com/models/qwen-mt-flash.md): 文本生成 基于Qwen3全面升级的轻量级文本翻译大模型,支持92个语种互译,模型性能和翻译效果全面升级,并提供更稳定的术语定制、格式还原度、领域 - [Qwen-MT-Image](https://www.qianwenai.com/models/qwen-mt-image.md): 图像生成 专注做图片翻译的模型服务,能将中、英、日等11个语言的图片翻译到指定的语言,精准还原图片排版和内容信息,支持术语定义、敏感词过� - [Qwen-MT-Lite](https://www.qianwenai.com/models/qwen-mt-lite.md): 文本生成 基于Qwen3全面升级的基础级文本翻译大模型,支持32个语种互译,模型性能和翻译效果全面升级,并提供更稳定的术语定制、格式还原度、领域 - [Qwen-MT-Plus](https://www.qianwenai.com/models/qwen-mt-plus.md): 文本生成 基于Qwen3全面升级的旗舰级翻译大模型,支持92个语种互译,模型性能和翻译效果全面升级,并提供更稳定的术语定制、格式还原度、领域提示 - [Qwen-MT-Turbo](https://www.qianwenai.com/models/qwen-mt-turbo.md): 文本生成 基于Qwen3全面升级的轻量级文本翻译大模型,支持92个语种互译,模型性能和翻译效果全面升级,提供更稳定的术语定制、格式还原度、领域提 ## Qwen 语音合成模型 (TTS) - [Qwen-TTS-Realtime](https://www.qianwenai.com/models/qwen-tts-realtime.md): Realtime-Text-to-Speech Qwen-TTS实时模型是通义实验室“qwen系列”模型中的语音合成模型。具备双向上下文感知能力,可以低延迟高保真完成多音色、方言及� - [Qwen-TTS](https://www.qianwenai.com/models/qwen-tts.md): 语音合成 千问系列首个语音合成模型,支持中文、英文、中英混合输入。自适应根据输入文本调整输出语气,音色真实自然,支持流式输出。 文本 - [Qwen3-TTS-Flash-Realtime](https://www.qianwenai.com/models/qwen3-tts-flash-realtime.md): 语音合成 千问3-TTS-Flash-Realtime模型是通义实验室最新的实时语音合成大模型,不仅拥有17种高表现力的拟人音色,且能低延迟高稳定地实时合成音频;同 - [Qwen3-TTS-Flash](https://www.qianwenai.com/models/qwen3-tts-flash.md): 语音合成 Qwen3-TTS-Flash模型是通义实验室最新推出的离线语音合成大模型,不仅拥有17种高表现力的拟人音色,且能低延迟高稳定地合成音频;同时支持� - [qwen3-tts-instruct-flash-realtime](https://www.qianwenai.com/models/qwen3-tts-instruct-flash-realtime.md): 语音合成 千问3-TTS-Flash模型是通义实验室最新推出的实时语音合成大模型,Instruct模型可通过自然语言进行合成效果的处理,确保在不同语境下,合成情 - [Qwen3-TTS-Instruct-Flash](https://www.qianwenai.com/models/qwen3-tts-instruct-flash.md): 语音合成 Qwen3-TTS-Flash模型是通义实验室最新推出的实时语音合成大模型,Instruct模型可通过自然语言进行合成效果的处理,确保在不同语境下,合成情� ### Qwen 语音合成模型 (TTS) - 历史版本 - [Qwen-TTS (qwen-tts-2025-04-10)](https://www.qianwenai.com/models/qwen-tts-2025-04-10.md) - [Qwen-TTS (qwen-tts-2025-05-22)](https://www.qianwenai.com/models/qwen-tts-2025-05-22.md) - [Qwen-TTS (qwen-tts-latest)](https://www.qianwenai.com/models/qwen-tts-latest.md) - [Qwen-TTS-Realtime (qwen-tts-realtime-2025-07-15)](https://www.qianwenai.com/models/qwen-tts-realtime-2025-07-15.md) - [Qwen-TTS-Realtime (qwen-tts-realtime-latest)](https://www.qianwenai.com/models/qwen-tts-realtime-latest.md) - [Qwen3-TTS-Flash (qwen3-tts-flash-2025-09-18)](https://www.qianwenai.com/models/qwen3-tts-flash-2025-09-18.md) - [Qwen3-TTS-Flash (qwen3-tts-flash-2025-11-27)](https://www.qianwenai.com/models/qwen3-tts-flash-2025-11-27.md) - [Qwen3-TTS-Flash-Realtime (qwen3-tts-flash-realtime-2025-09-18)](https://www.qianwenai.com/models/qwen3-tts-flash-realtime-2025-09-18.md) - [Qwen3-TTS-Flash-Realtime (qwen3-tts-flash-realtime-2025-11-27)](https://www.qianwenai.com/models/qwen3-tts-flash-realtime-2025-11-27.md) - [Qwen3-TTS-Instruct-Flash (qwen3-tts-instruct-flash-2026-01-26)](https://www.qianwenai.com/models/qwen3-tts-instruct-flash-2026-01-26.md) - [qwen3-tts-instruct-flash-realtime (qwen3-tts-instruct-flash-realtime-2026-01-22)](https://www.qianwenai.com/models/qwen3-tts-instruct-flash-realtime-2026-01-22.md) - [Qwen3-TTS-VC (qwen3-tts-vc-2026-01-22)](https://www.qianwenai.com/models/qwen3-tts-vc-2026-01-22.md) - [Qwen3-TTS-VC-Realtime (qwen3-tts-vc-realtime-2025-11-27)](https://www.qianwenai.com/models/qwen3-tts-vc-realtime-2025-11-27.md) - [Qwen3-TTS-VC-Realtime (qwen3-tts-vc-realtime-2026-01-15)](https://www.qianwenai.com/models/qwen3-tts-vc-realtime-2026-01-15.md) - [Qwen3-TTS-VD (qwen3-tts-vd-2026-01-26)](https://www.qianwenai.com/models/qwen3-tts-vd-2026-01-26.md) - [Qwen3-TTS-VD-Realtime (qwen3-tts-vd-realtime-2025-12-16)](https://www.qianwenai.com/models/qwen3-tts-vd-realtime-2025-12-16.md) - [Qwen3-TTS-VD-Realtime (qwen3-tts-vd-realtime-2026-01-15)](https://www.qianwenai.com/models/qwen3-tts-vd-realtime-2026-01-15.md) ## Qwen 语音识别模型 (ASR) - [Qwen3-ASR-Flash-Filetrans](https://www.qianwenai.com/models/qwen3-asr-flash-filetrans.md): 语音识别 千问3-ASR-Flash的大文件转录版本,千问3-ASR-Flash是一款基于大语言模型的高精度、高智能、高鲁棒性的多语种语音识别模型。依托强大的基座模 - [Qwen3-ASR-Flash-Realtime](https://www.qianwenai.com/models/qwen3-asr-flash-realtime.md): 实时语音识别 千问3-ASR-Flash的实时版,一款基于大语言模型的高精度、高智能、高鲁棒性的多语种语音识别模型。依托强大的基座模型、海量的文本与� - [Qwen3-ASR-Flash](https://www.qianwenai.com/models/qwen3-asr-flash.md): 语音识别 千问3-ASR-Flash是一款基于大语言模型的高精度、高智能、高鲁棒性的多语种语音识别模型。依托强大的基座模型、海量的文本与多模态数据、� ### Qwen 语音识别模型 (ASR) - 历史版本 - [Qwen3-ASR-Flash (qwen3-asr-flash-2025-09-08)](https://www.qianwenai.com/models/qwen3-asr-flash-2025-09-08.md) - [Qwen3-ASR-Flash (qwen3-asr-flash-2026-02-10)](https://www.qianwenai.com/models/qwen3-asr-flash-2026-02-10.md) - [Qwen3-ASR-Flash-Filetrans (qwen3-asr-flash-filetrans-2025-11-17)](https://www.qianwenai.com/models/qwen3-asr-flash-filetrans-2025-11-17.md) - [Qwen3-ASR-Flash-Realtime (qwen3-asr-flash-realtime-2025-10-27)](https://www.qianwenai.com/models/qwen3-asr-flash-realtime-2025-10-27.md) - [Qwen3-ASR-Flash-Realtime (qwen3-asr-flash-realtime-2026-02-10)](https://www.qianwenai.com/models/qwen3-asr-flash-realtime-2026-02-10.md) ## Qwen 声音模型 - [Qwen-声音设计](https://www.qianwenai.com/models/qwen-voice-design.md): 语音合成 千问voice-design模型是千问语音模型的声音设计系列模型,仅需输入简单的文字描述,即可迅速设计出符合要求的相关声音。结合qwen3-tts-vd-realti - [Qwen-声音复刻](https://www.qianwenai.com/models/qwen-voice-enrollment.md): 语音合成 千问voice-enrollment模型是千问语音模型的声音复刻系列模型,仅需5s以上的音频,即可迅速复刻高相似度声音。结合qwen3-tts-vc-realtime模型使用,� ## Qwen 图像生成模型 - [Qwen-Image-2.0-Pro](https://www.qianwenai.com/models/qwen-image-2.0-pro.md): 图像生成 Qwen-Image-2.0系列满血版模型,实现了图片生成和图片编辑的融合;具备更专业的文字渲染1k token指令支持能力、更细腻的真实质感,细腻刻画写 - [Qwen-Image-2.0](https://www.qianwenai.com/models/qwen-image-2.0.md): 图像生成 Qwen-Image-2.0系列加速版模型,实现了图片生成和图片编辑的融合;具备更专业的文字渲染1k token指令支持能力、更细腻的真实质感,细腻刻画写 - [Qwen-Image-Edit-Max](https://www.qianwenai.com/models/qwen-image-edit-max.md): 图像生成 千问图像编辑模型Max系列,提供更稳定、更丰富的编辑能力:提升工业设计与几何推理能力;提升角色一致性;减轻偏移问题;集成Lora能力, - [Qwen-Image-Edit-Plus](https://www.qianwenai.com/models/qwen-image-edit-plus.md): 图像生成 千问系列图像编辑Plus模型,在首版Edit模型基础上进一步优化了推理性能与系统稳定性,大幅缩短图像生成与编辑的响应时间;支持单次请求� - [Qwen-Image-Edit-Plus](https://www.qianwenai.com/models/qwen-image-edit.md): 图像生成 千问系列首个图像编辑模型,成功将Qwen-Image的文本渲染能力拓展到编辑任务上。支持精准的中英双语文字编辑、视觉外观与语义双重编辑、具 - [Qwen-Image-Max](https://www.qianwenai.com/models/qwen-image-max.md): 图像生成 千问图像生成模型Max系列,在各类生成任务中表现出色,相较Plus系列大幅度降低生成图片的AI感,提升图像真实性;具备更真实的人物质感、� - [Qwen-Image-Plus](https://www.qianwenai.com/models/qwen-image-plus.md): 图像生成 千问系列图像生成模型,参数规模200亿。具备卓越的文本渲染能力,在复杂文本渲染、各类生成与编辑任务重表现出色,在多个公开基准测试� - [Qwen-Image-Plus](https://www.qianwenai.com/models/qwen-image.md): 图像生成 千问系列首个图像生成模型,参数规模200亿。具备卓越的文本渲染能力,在复杂文本渲染、各类生成与编辑任务重表现出色,在多个公开基准� - [Z-Image-Turbo](https://www.qianwenai.com/models/z-image-turbo.md): 图像生成 Z-Image-Turbo是在Artificial Analysis评测中荣登文生图开源模型世界第一的高效图像生成模型,仅用60亿参数和8步推理就能生成媲美大规模商业模型的� ### Qwen 图像生成模型 - 历史版本 - [Qwen-Image-2.0 (qwen-image-2.0-2026-03-03)](https://www.qianwenai.com/models/qwen-image-2.0-2026-03-03.md) - [Qwen-Image-2.0-Pro (qwen-image-2.0-pro-2026-03-03)](https://www.qianwenai.com/models/qwen-image-2.0-pro-2026-03-03.md) - [Qwen-Image-2.0-Pro (qwen-image-2.0-pro-2026-04-22)](https://www.qianwenai.com/models/qwen-image-2.0-pro-2026-04-22.md) - [Qwen-Image-Edit-Max (qwen-image-edit-max-2026-01-16)](https://www.qianwenai.com/models/qwen-image-edit-max-2026-01-16.md) - [Qwen-Image-Edit-Plus (qwen-image-edit-plus-2025-10-30)](https://www.qianwenai.com/models/qwen-image-edit-plus-2025-10-30.md) - [Qwen-Image-Edit-Plus (qwen-image-edit-plus-2025-12-15)](https://www.qianwenai.com/models/qwen-image-edit-plus-2025-12-15.md) - [Qwen-Image-Max (qwen-image-max-2025-12-30)](https://www.qianwenai.com/models/qwen-image-max-2025-12-30.md) - [Qwen-Image-Plus (qwen-image-plus-2026-01-09)](https://www.qianwenai.com/models/qwen-image-plus-2026-01-09.md) ## Qwen 深度研究 - [qwen-deep-research](https://www.qianwenai.com/models/qwen-deep-research.md): 文本生成 千问深入研究是一款面向复杂研究任务的高级智能体系统,具备多轮推理与全局规划能力,能够运用互联网搜索等多种工具,对任务进行精细� ### Qwen 深度研究 - 历史版本 - [qwen-deep-research (qwen-deep-research-2025-12-15)](https://www.qianwenai.com/models/qwen-deep-research-2025-12-15.md) ## Qwen 实时翻译模型 - [Qwen3-LiveTranslate-Flash-Realtime](https://www.qianwenai.com/models/qwen3-livetranslate-flash-realtime.md): 实时语音翻译 Qwen3-LiveTranslate-Flash的实时版本,一款高精度、高响应、高鲁棒性的多语言实时音视频同传大模型。依托Qwen3-Omni强大的基座能力、海量多� - [Qwen3-LiveTranslate-Flash](https://www.qianwenai.com/models/qwen3-livetranslate-flash.md): 实时语音识别 Qwen3-LiveTranslate-Flash,一款高精度、高响应、高鲁棒性的多语言实时音视频同传大模型。依托Qwen3-Omni强大的基座能力、海量多模态数据、� ### Qwen 实时翻译模型 - 历史版本 - [Qwen3-LiveTranslate-Flash (qwen3-livetranslate-flash-2025-12-01)](https://www.qianwenai.com/models/qwen3-livetranslate-flash-2025-12-01.md) - [Qwen3-LiveTranslate-Flash-Realtime (qwen3-livetranslate-flash-realtime-2025-09-22)](https://www.qianwenai.com/models/qwen3-livetranslate-flash-realtime-2025-09-22.md) ## Qwen 其他模型 - [Qwen-VL-Embedding](https://www.qianwenai.com/models/qwen2.5-vl-embedding.md): 向量 基于Qwen2.5-VL底座训练的统一多模态向量模型,支持文本、图片、视频单模态/混合模态输入,输出统一表征向量,适用于跨模态检索、图搜、视频� ## DeepSeek 模型 - [DeepSeek](https://www.qianwenai.com/models/deepseek-r1-0528.md): 推理 0528为R1模型的小版本升级,相较于旧版 R1,新版在复杂推理任务中的表现有了显著提升。在数学、编程与通用逻辑等多个基准测评中取得了优异成� - [DeepSeek](https://www.qianwenai.com/models/deepseek-r1-distill-qwen-1.5b.md): 文本生成 DeepSeek-R1-Distill-Qwen-1.5B是一个基于Qwen2.5-Math-1.5B的蒸馏大型语言模型,使用了 DeepSeek R1 的输出。 文本 - [DeepSeek](https://www.qianwenai.com/models/deepseek-r1-distill-qwen-14b.md): 文本生成 DeepSeek-R1-Distill-Qwen-14B是一个基于Qwen2.5-14B的蒸馏大型语言模型,使用了 DeepSeek R1 的输出。 文本 - [DeepSeek](https://www.qianwenai.com/models/deepseek-r1-distill-qwen-32b.md): 文本生成 DeepSeek-R1-Distill-Qwen-32B是一个基于Qwen2.5-32B的蒸馏大型语言模型,使用了 DeepSeek R1 的输出。 文本 - [DeepSeek](https://www.qianwenai.com/models/deepseek-r1-distill-qwen-7b.md): 文本生成 DeepSeek-R1-Distill-Qwen-7B是一个基于Qwen2.5-Math-7B的蒸馏大型语言模型,使用了 DeepSeek R1 的输出。 文本 - [DeepSeek](https://www.qianwenai.com/models/deepseek-r1.md): 推理 DeepSeek-R1 在后训练阶段大规模使用了强化学习技术,在仅有极少标注数据的情况下,极大提升了模型推理能力。在数学、代码、自然语言推理等任� - [DeepSeek](https://www.qianwenai.com/models/deepseek-v3.1.md): 文本生成推理 DeepSeek-V3.1为混合推理架构模型,同时支持思考模式与非思考模式,具备更高的推理效率和更强的Agent能力。 文本 - [DeepSeek](https://www.qianwenai.com/models/deepseek-v3.2-exp.md): 文本生成推理 引入了DeepSeek Sparse Attention(一种稀疏注意力机制)的实验性质版本,针对长文本的训练和推理效率进行了探索性的优化和验证。 文本 - [DeepSeek](https://www.qianwenai.com/models/deepseek-v3.2.md): 推理文本生成 DeepSeek-V3.2是引入DeepSeek Sparse Attention(一种稀疏注意力机制)的正式版模型,也是DeepSeek推出的首个将思考融入工具使用的模型,同时支持 - [DeepSeek](https://www.qianwenai.com/models/deepseek-v3.md): 文本生成推理 DeepSeek-V3 为自研 MoE 模型,671B 参数,激活 37B,在 14.8T token 上进行了预训练,在长文本、代码、数学、百科、中文 能力上表现优秀。 文� - [DeepSeek](https://www.qianwenai.com/models/deepseek-v4-flash.md): 文本生成推理 高效轻量化MoE模型,总参284B,激活13B,原生支持百万超长上下文能力。推理速度快、延迟低、调用成本低廉,综合能力均衡,主打高并发 - [DeepSeek](https://www.qianwenai.com/models/deepseek-v4-pro.md): 推理文本生成 旗舰级 MoE 大模型,总参1.6T、激活 49B,原生支持百万级超长上下文。依托海量高质量训练数据,具备顶尖数学逻辑、复杂推理、专业代码 ## GLM (智谱) 模型 - [GLM](https://www.qianwenai.com/models/glm-4.5-air.md): 文本生成 GLM-4.5-Air采用混合专家(MoE)架构,总参数量为1060亿,激活参数120亿,相较GLM-4.5更紧凑、轻量,适用于对模型规模和资源消耗有一定限制的场 - [GLM](https://www.qianwenai.com/models/glm-4.5.md): 文本生成 GLM-4.5采用混合专家(MoE)架构,总参数量为3550 亿,激活参数320亿,在复杂推理、代码生成及智能体交互等通用能力上实现了能力融合与技术� - [GLM](https://www.qianwenai.com/models/glm-4.6.md): 推理文本生成 GLM新一代旗舰模型,核心能力较4.5全面提升。总参数量为3550 亿,激活参数320亿,上下文窗口扩展至200K。 文本 - [GLM](https://www.qianwenai.com/models/glm-4.7.md): 文本生成推理 智谱最新旗舰,具备更强的编程能力与更稳定的多步骤推理/执行能力。总参数355B,支持长程任务规划、编码、工具协同,问答自然、写� - [GLM](https://www.qianwenai.com/models/glm-5.1.md): 文本生成 GLM-5.1是智谱AI推出的面向长程任务(Long Horizon Task)设计的模型,总参数744B,支持200K超长上下文,最大输出 128K tokens。拥有强大逻辑推理、长 - [GLM](https://www.qianwenai.com/models/glm-5.md): 文本生成 GLM-5是面向Coding与Agent场景的新一代大模型,在复杂系统工程与长程任务中达到开源 SOTA,真实编程体验逼近 Claude Opus 级别;基于 744B 新基座、 ## Kimi / Moonshot 模型 - [Kimi](https://www.qianwenai.com/models/Moonshot-Kimi-K2-Instruct.md): 文本生成 Kimi-K2是月之暗面提供的国内首个开源万亿参数MoE模型,激活参数达 320 亿,具有卓越的编码和工具调用能力。 文本 - [Kimi](https://www.qianwenai.com/models/kimi-k2-thinking.md): 文本生成推理 kimi-k2-thinking模型是月之暗面提供的具有通用 Agentic能力和推理能力的思考模型,它擅长深度推理,并可通过多步工具调用,帮助解决各类� - [Kimi](https://www.qianwenai.com/models/kimi-k2.5.md): 推理视觉理解文本生成 kimi-k2.5是月之暗面迄今发布最全能的模型,原生多模态架构设计,同时支持视觉与文本输入、思考与非思考模式、对话与Agent任� - [Kimi](https://www.qianwenai.com/models/kimi-k2.6.md): 推理视觉理解文本生成 kimi-k2.6是Kimi最新最智能的模型,具备更强更稳的长程代码编写能力,指令遵循和自我纠错能力显著提升,同时支持文本、图片与 ## MiniMax 模型 - [MiniMax](https://www.qianwenai.com/models/MiniMax-M2.1.md): 推理文本生成 MiniMax-M2.1是MiniMax推出的旗舰级开源大模型,聚焦真实世界复杂任务,以多语言编程与长链 Agent 能力为核心优势。 文本 - [MiniMax](https://www.qianwenai.com/models/MiniMax-M2.5.md): 推理文本生成 MiniMax-M2.5是MiniMax推出的旗舰级开源大模型,经过数十万个真实复杂环境中的大规模强化学习训练,M2.5 在编程、工具调用和搜索、办公等� ## Wan 视频/图像生成模型 - [Wan-I2V](https://www.qianwenai.com/models/wan2.2-animate-mix.md): 视频生成 wan2.2-animate-mix视频换人是一款角色替换的模型产品,上传一张角色照片与一段表演视频,即可将原视频中的角色精准替换为照片中的角色,完� - [Wan-I2V](https://www.qianwenai.com/models/wan2.2-animate-move.md): 视频生成 wan2.2-animate-move图生动作是一款角色动画生成模型,用户只需上传一张角色照片和一段参考表演视频,即可将视频中的表情和动作迁移到图片角 - [Wan-I2V](https://www.qianwenai.com/models/wan2.2-i2v-flash.md): 视频生成 全新升级的万相2.2图生视频,生成速度更快。优化视频生成稳定性与成功率,更强大的指令遵循能力,稳定保持图片文字、人像和商品一致性� - [Wan-I2V](https://www.qianwenai.com/models/wan2.2-i2v-plus.md): 视频生成 全新升级的万相2.2图生视频,视频品质更高。优化视频生成稳定性与成功率,更强大的指令遵循能力,稳定保持图片文字、人像和商品一致性� - [Wan-I2V](https://www.qianwenai.com/models/wan2.2-kf2v-flash.md): 视频生成 全新升级的万相2.2-首尾帧生视频,生成速度更快。优化视频动态稳定性与成功率,更强大的指令遵循能力,两张图片生成丝滑过度视频。 图� - [Wan-I2V](https://www.qianwenai.com/models/wan2.2-s2v-detect.md): 视频生成 wan2.2-s2v-detect 是 wan2.2-s2v 的辅助模型,用于确认输入的人物肖像图片是否符合 wan2.2-s2v 模型所需的人物肖像图片规范。wan2.2-s2v 模型基于 wan2.2- - [Wan-I2V](https://www.qianwenai.com/models/wan2.2-s2v.md): 视频生成 wan2.2-s2v 是一款视频生成模型,可基于人物图片和人声音频文件,生成高质量的人物说话/唱歌/表演动态视频。 图像 - [Wan-T2I](https://www.qianwenai.com/models/wan2.2-t2i-flash.md): 图像生成 全新升级的万相2.2文生图,更快的生成速度。在生成图像创意性、稳定性、写实质感方面全面升级,指令遵循更强,原生支持多种风格。支持� - [Wan-T2I](https://www.qianwenai.com/models/wan2.2-t2i-plus.md): 图像生成 全新升级的万相2.2文生图,更丰富的画面细节。在生成图像创意性、稳定性、写实质感方面全面升级,指令遵循更强,原生支持多种风格。支� - [Wan-T2V](https://www.qianwenai.com/models/wan2.2-t2v-plus.md): 视频生成 全新升级的万相2.2文生视频,视频品质更高。可稳定生成大幅度复杂运动,支持影视级画面表现与控制,更强大的指令遵循能力,实现物理世� - [Wan-Image](https://www.qianwenai.com/models/wan2.5-i2i-preview.md): 图像生成 万相2.5-图像编辑-Preview,全新升级模型架构。支持指令控制实现丰富的图像编辑能力,指令遵循能力进一步提升,支持高一致性保持的多图参� - [Wan-I2V](https://www.qianwenai.com/models/wan2.5-i2v-preview.md): 视频生成 万相2.5-图生视频-Preview,全新升级技术架构,支持与画面同步的声音生成,支持10秒长视频生成,更强的指令遵循能力,运动能力、画面质感� - [Wan-T2I](https://www.qianwenai.com/models/wan2.5-t2i-preview.md): 图像生成 万相2.5-文生图-Preview,全新升级模型架构。画面美学、设计感、真实质感显著提升,精准指令遵循,擅长中英文和小语种文字生成,支持复杂� - [Wan-T2V](https://www.qianwenai.com/models/wan2.5-t2v-preview.md): 视频生成 万相2.5-文生视频-Preview,全新升级模型架构,支持与画面同步的声音生成,支持10秒长视频生成,更强的指令遵循能力,运动能力、画面质感� - [Wan-I2V](https://www.qianwenai.com/models/wan2.6-i2v-flash.md): 视频生成 万相2.6-图生视频-Flash,生成更快更高性价比。智能分镜调度支持多镜头叙事,多人稳定对话,更自然真实音色,最高支持15秒时长生成 图像音 - [Wan-I2V](https://www.qianwenai.com/models/wan2.6-i2v.md): 视频生成 万相2.6-图生视频,智能分镜调度支持多镜头叙事,更高品质的声音生成,多人稳定对话,更自然真实音色,最高支持15秒时长生成 图像文本音 - [Wan-Image](https://www.qianwenai.com/models/wan2.6-image.md): 图像生成 万相2.6-图像生成,全能图像生成模型,支持图文一体化推理生成,具备多图创意融合、商用级一致性、美学要素迁移与镜头光影精确控制,全 - [Wan-R2V](https://www.qianwenai.com/models/wan2.6-r2v-flash.md): 视频生成 万相2.6-参考生视频-Flash,生成更快性价比更高。支持指定人物或任意物品进行参考,精准保持形象和声音的一致性,支持多角色参考合拍 图� - [Wan-R2V](https://www.qianwenai.com/models/wan2.6-r2v.md): 视频生成 万相2.6-参考生视频,支持指定人物或任意物品进行参考,精准保持形象和声音的一致性,支持多角色参考合拍。提醒:当使用视频进行参考时 - [Wan-T2I](https://www.qianwenai.com/models/wan2.6-t2i.md): 图像生成 万相2.6-文生图,画面质感、美学表现、指令遵循升级,在艺术风格精准控制、真实感人像、长文本生图及广泛历史文化IP覆盖上均表现出卓越� - [Wan-T2V](https://www.qianwenai.com/models/wan2.6-t2v.md): 视频生成 万相2.6-文生视频,智能分镜调度支持多镜头叙事,能够生成主体、场景和氛围一致的多镜头叙事视频,最高支持15秒时长,更高品质的声音生� - [Wan-I2V](https://www.qianwenai.com/models/wan2.7-i2v.md): 视频生成 万相2.7-图生视频,演绎能力全面升级,文戏情感细腻自然,动作戏激烈拳拳到肉,搭配更富有戏剧性和节奏感的镜头切换,实现更强表演能力 - [Wan-Image](https://www.qianwenai.com/models/wan2.7-image-pro.md): 图像生成 万相2.7-图像生成与编辑旗舰版模型,支持文生图、文生组图、图生组图、图像编辑、多图参考生成、交互式编辑,在文字渲染、主体一致性、 - [Wan-Image](https://www.qianwenai.com/models/wan2.7-image.md): 图像生成 万相2.7-图像生成与编辑,支持文生图、文生组图、图生组图、图像编辑、多图参考生成、交互式编辑,在文字渲染、主体一致性、复杂指令遵 - [Wan-R2V](https://www.qianwenai.com/models/wan2.7-r2v.md): 视频生成 Wan2.7-R2V,更加稳定的角色、道具与场景参考,支持最大5个图/视频混合参考,支持音频音色参考,搭配基础能力升级实现更强表演能力。 音频 - [Wan-T2V](https://www.qianwenai.com/models/wan2.7-t2v.md): 视频生成 Wan2.7-T2V,演绎能力全面升级,文戏情感细腻自然,动作戏激烈拳拳到肉,搭配更富有戏剧性和节奏感的镜头切换,实现更强表演能力。 音频� - [Wan-VideoEdit](https://www.qianwenai.com/models/wan2.7-videoedit.md): 视频生成 Wan2.7-VideoEdit,自然语言指令编辑视频,支持局部或全局编辑,可参考图像替换视频元素,支持复刻视频动作、特效、运镜等动态过程。 图像� - [图像背景生成](https://www.qianwenai.com/models/wanx-background-generation-v2.md): 图像生成 图像背景生成可以基于输入的前景图像素材拓展生成背景信息,实现自然的光影融合效果,与细腻的写实画面生成。支持文本描述、图像引导� - [创意海报生成](https://www.qianwenai.com/models/wanx-poster-generation-v1.md): 图像生成 创意海报生成,您的创意海报魔法工厂!它能够根据你的要求自动生成海报的背景和文字排版,支持多种海报风格,从宣传到祝福,让每一张� - [万相-涂鸦作画](https://www.qianwenai.com/models/wanx-sketch-to-image-lite.md): 图像生成 万相-涂鸦作画通过手绘任意内容加文字描述,即可生成精美的涂鸦绘画作品,作品中的内容在参考手绘线条的同时,兼顾创意性和趣味性。涂 - [人像风格重绘](https://www.qianwenai.com/models/wanx-style-repaint-v1.md): 图像生成 人像风格重绘可以将输入的人物图像进行多种风格化的重绘生成,使新生成的图像在兼顾原始人物相貌的同时,带来不同风格的绘画效果。 图 - [Wan-T2I](https://www.qianwenai.com/models/wanx-v1.md): 图像生成 万相-文本生成图像大模型,支持中英文双语输入,重点风格包括但不限于水彩、油画、中国画、素描、扁平插画、二次元、3D卡通 文本 - [虚拟模特](https://www.qianwenai.com/models/wanx-virtualmodel.md): 图像生成 虚拟模特可以对上传的真人或者人台实拍商品展示图进行智能生成,将其中的模特和背景替换为心仪的内容,在保持人物姿态不变的情况下,� - [万相-图像局部重绘](https://www.qianwenai.com/models/wanx-x-painting.md): 图像生成 万相-图像局部重绘是基于自研的Composer组合生成框架的AI绘画创作大模型后置处理链路,能够根据用户输入的原始图片和意涂抹图中局部区域� - [Wan-T2I](https://www.qianwenai.com/models/wanx2.0-t2i-turbo.md): 图像生成 Wan2.0-T2I-Turbo,更擅长质感人像和创意设计画作生成,在图像美观度、真实感、艺术性上全面升级,支持最大200万像素生成,支持智能提示词改 - [Wan-I2V](https://www.qianwenai.com/models/wanx2.1-i2v-plus.md): 视频生成 万相2.1-图生视频-Plus,让图片变为动态视频。支持大幅度复杂运动、物理规律遵循、丰富艺术风格和影视级画面质感,指令遵循能力进一步提� - [Wan-I2V](https://www.qianwenai.com/models/wanx2.1-i2v-turbo.md): 视频生成 万相2.1-图生视频-Turbo,让图片变为动态视频。支持大幅度复杂运动、物理规律遵循、丰富艺术风格和影视级画面质感,指令遵循能力进一步提 - [Wan-Image](https://www.qianwenai.com/models/wanx2.1-imageedit.md): 图像生成 万相-通义图像编辑,支持预设编辑任务与指令式编辑,包含多种局部/全图编辑能力,如图像风格化、线稿生图、局部重绘、参考图生成、图� - [Wan-I2V](https://www.qianwenai.com/models/wanx2.1-kf2v-plus.md): 视频生成 万相2.1-首尾帧-Plus,两张图片生成丝滑过度视频。支持大幅度复杂运动、物理规律遵循、丰富艺术风格和影视级画面质感,指令遵循能力进一� - [Wan-T2I](https://www.qianwenai.com/models/wanx2.1-t2i-plus.md): 图像生成 万相2.1-文生图-Plus,更丰富的画面细节,在图像美观度、真实感、艺术性上全面升级,更强的语义理解能力、丰富的风格泛化性、支持最大200� - [Wan-T2I](https://www.qianwenai.com/models/wanx2.1-t2i-turbo.md): 图像生成 万相2.1-文生图-Turbo,更快的生成速度,在图像美观度、真实感、艺术性上全面升级,更强的语义理解能力、丰富的风格泛化性、支持最大200万 - [Wan-T2V](https://www.qianwenai.com/models/wanx2.1-t2v-plus.md): 视频生成 万相2.1-文生视频-Plus,一句话生成视频。视频品质更高,支持大幅度复杂运动、现实物理规律还原、丰富艺术风格和影视级画面质感,指令遵� - [Wan-T2V](https://www.qianwenai.com/models/wanx2.1-t2v-turbo.md): 视频生成 万相2.1-文生视频-Turbo,一句话生成视频。生成速度更快,支持大幅度复杂运动、现实物理规律还原、丰富的艺术风格和影视级画面质感,指令 - [Wan2.1-VACE-Plus](https://www.qianwenai.com/models/wanx2.1-vace-plus.md): 视频生成 万相2.1-VACE-Plus,视频编辑统一模型。支持局部编辑、视频重绘、背景扩展、时长延展、图片参考等多种视频编辑与生成任务,支持文本、图像 ### Wan 视频/图像生成模型 - 历史版本 - [Wan-I2V (wan2.7-i2v-2026-04-25)](https://www.qianwenai.com/models/wan2.7-i2v-2026-04-25.md) - [Wan-T2V (wan2.7-t2v-2026-04-25)](https://www.qianwenai.com/models/wan2.7-t2v-2026-04-25.md) ## HappyHorse 视频模型 - [HappyHorse-I2V](https://www.qianwenai.com/models/happyhorse-1.0-i2v.md): 视频生成 HappyHorse-1.0-I2V支持图生视频,具备高度还原的动态画面生成能力,能够精准理解文本语义,输出流畅自然、细节丰富的高质量视频。 图像文本 - [HappyHorse-R2V](https://www.qianwenai.com/models/happyhorse-1.0-r2v.md): 视频生成 HappyHorse-1.0-R2V支持参考生视频,更加稳定的主体与场景参考,支持最多9张图片参考,能够精准保持创作意图,实现更强表现能力。 图像文本 - [HappyHorse-T2V](https://www.qianwenai.com/models/happyhorse-1.0-t2v.md): 视频生成 HappyHorse-1.0-T2V支持文生视频,具备高度还原的动态画面生成能力,能够精准理解文本语义,输出流畅自然、细节丰富的高质量视频。 文本 - [HappyHorse-Video-Edit](https://www.qianwenai.com/models/happyhorse-1.0-video-edit.md): 视频生成 HappyHorse-1.0-Video-Edit支持视频编辑,自然语言指令编辑视频,可参考最多5张图片局部或全局编辑视频元素,能够精准复刻视频动态过程,实现� ## CosyVoice 语音合成 - [CosyVoice大模型](https://www.qianwenai.com/models/cosyvoice-clone-v1.md): 语音合成 声音复刻Cosyvoice大模型,依托先进的大模型技术进行特征提取,从而完成声音的复刻,且无需训练过程。仅需提供时长较短的音频,即可迅速� - [CosyVoice大模型](https://www.qianwenai.com/models/cosyvoice-v1.md): 语音合成 CosyVoice 是通义实验室依托大规模预训练语言模型,深度融合文本理解和语音生成的新一代生成式语音合成大模型,支持文本至语音的实时流式 - [CosyVoice大模型](https://www.qianwenai.com/models/cosyvoice-v2.md): 语音合成 cosyvoice-V2是通义实验室依托大规模预训练语言模型,在深度融合文本理解和语音生成的新一代生成式语音合成大模型,支持文本至语音的实时� - [CosyVoice大模型](https://www.qianwenai.com/models/cosyvoice-v3-flash.md): 语音合成 合成能力:CosyVoice-v3-Flash是通义实验室CosyVoice系列最新版高性能的语音合成大模型,较之前版本在自然度、音质、韵律、情感表现力上有更好� - [CosyVoice大模型](https://www.qianwenai.com/models/cosyvoice-v3-plus.md): 语音合成 克隆能力:CosyVoice-v3-plus是通义实验室CosyVoice系列最新版的语音克隆大模型,具有更好的音质和复刻相似度,适用于更专业的场景。仅需提供5- - [CosyVoice大模型](https://www.qianwenai.com/models/cosyvoice-v3.5-flash.md): 语音合成 CosyVoice-v3.5-Flash是通义实验室CosyVoice系列的高性能语音合成大模型。对声音克隆和声音设计的语音合成效果进行全面升级,确保说话人高相似� - [CosyVoice大模型](https://www.qianwenai.com/models/cosyvoice-v3.5-plus.md): 语音合成 CosyVoice-v3.5-Plus是通义实验室CosyVoice系列的超高表现力语音合成大模型。对声音克隆和声音设计的语音合成效果进行全面升级,确保说话人高相 ## Sambert 语音合成 - [Sambert语音合成](https://www.qianwenai.com/models/sambert-beth-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-betty-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-brian-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-cally-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-camila-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-cindy-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-clara-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-donna-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-eva-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-hanna-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-indah-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-perla-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-waan-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhichu-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhida-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhide-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhifei-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhigui-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhihao-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhijia-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhijing-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhilun-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhimao-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhimiao-emo-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhiming-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhimo-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhina-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhinan-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhiqi-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhiqian-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhiru-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhishu-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhishuo-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhistella-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhiting-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhiwei-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhixiang-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhixiao-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhiya-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhiye-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhiying-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhiyuan-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � - [Sambert语音合成](https://www.qianwenai.com/models/sambert-zhiyue-v1.md): 语音合成 提供SAMBERT+NSFGAN深度神经网络算法与传统领域知识深度结合的文字转语音服务,兼具读音准确,韵律自然,声音还原度高,表现力强的特点。 � ## Paraformer/FunASR 语音识别 - [Fun-ASR实时语音识别](https://www.qianwenai.com/models/fun-asr-flash-8k-realtime.md): 实时语音识别 通义百聆推出的新一代轻量级实时语音识别模型,依托自研的先进语音技术架构,具备强大的上下文理解能力。专为中文电话客服场景设� - [Fun-ASR语音识别](https://www.qianwenai.com/models/fun-asr-mtl.md): 语音识别 百聆多语言语音识别大模型,支持超过31种语言,支持语种自由切换,出海用户首推,尤其东南亚出海。fun-asr为该模型的升级版本,建议切换� - [Fun-ASR实时语音识别](https://www.qianwenai.com/models/fun-asr-realtime.md): 实时语音识别 通义实验室新一代端到端语音识别大模型的实时版,基于领先的自研语音技术,具备卓越的上下文感知和高精度语音转写能力。基于端到� - [Fun-ASR语音识别](https://www.qianwenai.com/models/fun-asr.md): 语音识别 百聆2026年4月更新的大模型ASR版本,全面支持汉语传统七大方言体系(官话/吴/湘/赣/客/闽/粤),并适配 20+ 地区口音官话。针对中文古诗词的 - [Paraformer语音识别-8k-v1](https://www.qianwenai.com/models/paraformer-8k-v1.md): 语音识别 Paraformer语音识别提供的文件转写API,能够对常见的音频或音视频文件进行语音识别,并将结果返回给调用者。Paraformer中文语音识别模型,支� - [Paraformer语音识别-8k-v2](https://www.qianwenai.com/models/paraformer-8k-v2.md): 语音识别 Paraformer最新中文语音识别模型,模型结构升级,具有更好的识别效果,支持8kHz电话语音识别,仅支持中文热词。 音频 - [Paraformer语音识别-mtl-v1](https://www.qianwenai.com/models/paraformer-mtl-v1.md): 语音识别 Paraformer多语言语音识别模型,支持16kHz及以上采样率的音频或视频语音识别。 支持的语种/方言包括:中文普通话、中文方言(粤语、吴语、� - [Paraformer实时语音识别-8k-v1](https://www.qianwenai.com/models/paraformer-realtime-8k-v1.md): 实时语音识别 Paraformer中文实时语音识别模型,支持8kHz电话客服等场景下的实时语音识别。 音频 - [Paraformer实时语音识别-8k-v2](https://www.qianwenai.com/models/paraformer-realtime-8k-v2.md): 实时语音识别 推荐使用 Paraformer最新实时语音识别模型,支持多个语种自由切换的视频直播、会议等实时场景的语音识别。可以通过language\_hints参数选� - [Paraformer实时语音识别-v1](https://www.qianwenai.com/models/paraformer-realtime-v1.md): 实时语音识别 Paraformer中文实时语音识别模型,支持16kHz及以上采样率的视频直播、会议等实时场景下的语音识别。 音频 - [Paraformer实时语音识别-v2](https://www.qianwenai.com/models/paraformer-realtime-v2.md): 实时语音识别 推荐使用 Paraformer最新实时语音识别模型,支持多个语种自由切换的视频直播、会议等实时场景的语音识别。可以通过language\_hints参数选� - [Paraformer语音识别-v1](https://www.qianwenai.com/models/paraformer-v1.md): 语音识别 Paraformer中英文语音识别模型,支持16kHz及以上采样率的音频或视频语音识别。 音频 - [Paraformer语音识别-v2](https://www.qianwenai.com/models/paraformer-v2.md): 语音识别 推荐使用 Paraformer最新语音识别模型,支持多个语种的语音识别。可以通过language\_hints参数选择语种获得更准确的识别效果,支持任意采样率� - [语音识别热词](https://www.qianwenai.com/models/speech-biasing.md): 语音识别 热词是指用户可以预先定义的一组特定词汇或短语,这些词汇或短语在识别、翻译过程中会被赋予更高的优先级。针对您的特定业务领域,如� ### Paraformer/FunASR 语音识别 - 历史版本 - [Fun-ASR语音识别 (fun-asr-2025-08-25)](https://www.qianwenai.com/models/fun-asr-2025-08-25.md) - [Fun-ASR语音识别 (fun-asr-2025-11-07)](https://www.qianwenai.com/models/fun-asr-2025-11-07.md) - [Fun-ASR实时语音识别 (fun-asr-flash-8k-realtime-2026-01-28)](https://www.qianwenai.com/models/fun-asr-flash-8k-realtime-2026-01-28.md) - [Fun-ASR语音识别 (fun-asr-mtl-2025-08-25)](https://www.qianwenai.com/models/fun-asr-mtl-2025-08-25.md) - [Fun-ASR实时语音识别 (fun-asr-realtime-2025-09-15)](https://www.qianwenai.com/models/fun-asr-realtime-2025-09-15.md) - [Fun-ASR实时语音识别 (fun-asr-realtime-2025-11-07)](https://www.qianwenai.com/models/fun-asr-realtime-2025-11-07.md) - [Fun-ASR实时语音识别 (fun-asr-realtime-2026-02-28)](https://www.qianwenai.com/models/fun-asr-realtime-2026-02-28.md) ## Gummy 语音对话模型 - [一句话识别及翻译V1.0](https://www.qianwenai.com/models/gummy-chat-v1.md): 语音识别 多语言语音转写及翻译的多模态大模型。本模型支持60秒以内的实时语音识别,适用于语音搜索、设备指令等场景。提供10个混合语种的高准确 - [实时语音识别及翻译V1.0](https://www.qianwenai.com/models/gummy-realtime-v1.md): 实时语音翻译 多语言语音转写及翻译的多模态大模型。本模型提供长时间、高准确率、实时转写中/英/日/韩等10个混合语种的服务。同时支持中英日韩� ## 文本/多模态向量模型 - [Qwen-Rerank](https://www.qianwenai.com/models/gte-rerank-v2.md): 向量 gte-rerank-v2是通义实验室研发的多语言文本统一排序模型,面向全球多个主流语种,提供高水平的文本排序服务。通常用于语义检索、RAG等场景,可 - [通义多模态向量](https://www.qianwenai.com/models/multimodal-embedding-v1.md): 向量 通义实验室基于预训练多模态大模型构建的多模态向量模型。该模型根据用户的输入生成高维连续向量,这些输入可以是文本、图片或视频。多模� - [Qwen-Embedding](https://www.qianwenai.com/models/text-embedding-async-v1.md): 向量 通用文本向量的批处理接口,通过这个接口客户可以以文本方式一次性的提交大批量的向量计算请求,在系统完成所有的计算之后,大模型服务平� - [Qwen-Embedding](https://www.qianwenai.com/models/text-embedding-async-v2.md): 向量 通用文本向量的批处理接口,通过这个接口客户可以以文本方式一次性的提交大批量的向量计算请求,在系统完成所有的计算之后,大模型服务平� - [Qwen-Embedding](https://www.qianwenai.com/models/text-embedding-v1.md): 向量 通用文本向量,是通义实验室基于LLM底座的多语言文本统一向量模型,面向全球多个主流语种,提供高水准的向量服务,帮助开发者将文本数据快� - [Qwen-Embedding](https://www.qianwenai.com/models/text-embedding-v2.md): 向量 通用文本向量,是通义实验室基于LLM底座的多语言文本统一向量模型,面向全球多个主流语种,提供高水准的向量服务,帮助开发者将文本数据快� - [Qwen-Embedding](https://www.qianwenai.com/models/text-embedding-v3.md): 向量 通用文本向量,是通义实验室基于LLM底座的多语言文本统一向量模型,面向全球多个主流语种,提供高水准的向量服务,帮助开发者将文本数据快� - [Qwen-Embedding](https://www.qianwenai.com/models/text-embedding-v4.md): 向量 是通义实验室基于Qwen3训练的多语言文本统一向量模型,相较V3版本在文本检索、聚类、分类性能大幅提升;在MTEB多语言、中英、Code检索等评测任� - [通义多模态向量](https://www.qianwenai.com/models/tongyi-embedding-vision-flash.md): 向量 Embedding-Vision是基于LLM底座的视觉多模态表征模型,具有以视觉为中心、领域性能优异(电商、 安防、相册/图库、自驾等)、高性价比的特点。兼� - [通义多模态向量](https://www.qianwenai.com/models/tongyi-embedding-vision-plus.md): 向量 Embedding-Vision是基于LLM底座的视觉多模态表征模型,具有以视觉为中心、领域性能优异(电商、 安防、相册/图库、自驾等)、高性价比的特点。兼� ### 文本/多模态向量模型 - 历史版本 - [通义多模态向量 (tongyi-embedding-vision-flash-2026-03-06)](https://www.qianwenai.com/models/tongyi-embedding-vision-flash-2026-03-06.md) - [通义多模态向量 (tongyi-embedding-vision-plus-2026-03-06)](https://www.qianwenai.com/models/tongyi-embedding-vision-plus-2026-03-06.md) ## 图像/视频处理模型 - [AI试衣OutfitAnyone-图片分割](https://www.qianwenai.com/models/aitryon-parsing-v1.md): 图像生成 图片分割模型是AI试衣OutfitAnyone的辅助模型,可对模特图、服饰图进行分割,用于试衣图片的前后处理。 图像 - [AI试衣-Plus版](https://www.qianwenai.com/models/aitryon-plus.md): 图像生成 aitryon-plus是一款效果出众的虚拟试衣图片生成模型,可基于服饰平拍图片以及人物正面全身照,输出服饰的人物试衣效果图片。 相较于aitryon� - [AI试衣OutfitAnyone-图片精修](https://www.qianwenai.com/models/aitryon-refiner.md): 图像生成 图片精修是对AI试衣生成的效果图进行二次生成,输出还原度更高的精修试衣效果图。 图像 - [AI试衣-基础版](https://www.qianwenai.com/models/aitryon.md): 图像生成 aitryon是一款性能出众的虚拟试衣图片生成模型,可基于服饰平拍图片以及人物正面全身照,输出服饰的人物试衣效果图片。aitryon模型可在较� - [舞动人像AnimateAnyone-detect](https://www.qianwenai.com/models/animate-anyone-detect-gen2.md): 视频生成 AnimateAnyone-detect是辅助AnimateAnyone的图像检测模型,用于检测图片中的人物形象是否符合视频生成要求。 图像 - [舞动人像AnimateAnyone](https://www.qianwenai.com/models/animate-anyone-gen2.md): 视频生成 AnimateAnyone是一款视频生成模型,可基于人物图片和动作模板生成人物全身动作视频。 图像 - [舞动人像AnimateAnyone-template](https://www.qianwenai.com/models/animate-anyone-template-gen2.md): 视频生成 AnimateAnyone-Template是辅助AnimateAnyone的动作模板生成模型,可基于视频提取人物动作并制作模板。 视频 - [FaceChain人物图像检测](https://www.qianwenai.com/models/facechain-facedetect.md): 图像生成 对用户上传的人物图像进行检测,判断其中所包含的人脸是否符合facechain微调所需的标准,检测维度包括人脸数量、大小、角度、光照、清晰� - [FaceChain人物写真生成](https://www.qianwenai.com/models/facechain-generation.md): 图像生成 基于人物形象训练已经得到的形象,可以继续通过人物生成写真模型完成该形象的写真生成,支持多种预设风格,包括证件照、商务写真等。 - [GUI-Plus](https://www.qianwenai.com/models/gui-plus.md): 视觉理解 GUI系列图形界面交互基础模型,针对手机端与电脑端图形界面理解与交互任务,性能优于开源版同类GUI模型。全面升级跨平台界面理解与多步� - [图像擦除补全](https://www.qianwenai.com/models/image-erase-completion.md): 图像生成 图像擦除补全通过指定图像mask中要删除的人体、宠物、物品、文字、水印等图像区域,在保留背景的同时移除图像中的一个或多个人物、物体 - [人物实例分割](https://www.qianwenai.com/models/image-instance-segmentation.md): 图像生成 人物实例分割运用了检测和分割技术,不仅能够在图像中识别出不同的对象,而且还能准确地画出每一个对象边界的像素级掩码(mask)。 图� - [图像画面扩展](https://www.qianwenai.com/models/image-out-painting.md): 图像生成 图像画面大模型,对输入图像进行画面自由扩展,支持旋转画面,支持按照扩展系数和扩展像素数两种方式进行扩图。用户可以通过指定宽度� - [灵动人像LivePortrait-detect](https://www.qianwenai.com/models/liveportrait-detect.md): 视频生成 LivePortrait-detect是辅助LivePortrait的图像检测模型,用于检测图片中的人物形象是否符合视频生成要求。 图像 - [灵动人像LivePortrait](https://www.qianwenai.com/models/liveportrait.md): 视频生成 LivePortrait是一款视频生成模型,可基于人物图片生成轻量化的人物肖像动态视频。 图像 - [鞋靴模特](https://www.qianwenai.com/models/shoemodel-v1.md): 图像生成 鞋靴模特支持输入多视角鞋靴系列图片,同时对输入模特模板图的鞋子区域进行鞋靴AI试穿,实现模特鞋靴布局重绘生成,最终生成图片的效� - [视频风格重绘](https://www.qianwenai.com/models/video-style-transform.md): 视频生成 视频风格重绘可以将输入的视频帧序列进行多种风格化的重绘/生成,使新视频画面在兼顾原始人物和物体相貌的同时,带来不同风格的绘画效 - [声动人像VideoRetalk](https://www.qianwenai.com/models/videoretalk.md): 视频生成 VideoRetalk是一个人物视频生成模型,可基于人物视频和人声音频,生成人物讲话口型与输入音频相匹配的新视频。 视频音频 - [虚拟模特V2](https://www.qianwenai.com/models/virtualmodel-v2.md): 图像生成 虚拟模特可以对上传的真人或者人台实拍商品展示图进行智能生成,将其中的模特和背景替换为心仪的内容,在保持人物姿态不变的情况下,� - [WordArt锦书-文字变形](https://www.qianwenai.com/models/wordart-semantic.md): 图像生成 WordArt锦书-文字变形可以对输入的文字边缘轮廓进行创意变形,根据提示词内容进行边缘变化,实现一种字体的更多种创意用法,返回带有文� - [WordArt锦书-文字纹理生成](https://www.qianwenai.com/models/wordart-texture.md): 图像生成 WordArt锦书-文字纹理生成可以对输入的文字内容或文字图片进行创意设计,根据提示词内容对文字添加材质和纹理,实现立体凸显或场景融合� ### 图像/视频处理模型 - 历史版本 - [GUI-Plus (gui-plus-2026-02-26)](https://www.qianwenai.com/models/gui-plus-2026-02-26.md) ## 音乐生成模型 - [音乐生成](https://www.qianwenai.com/models/fun-music-v1.md): 语音合成 百聆音乐生成大模型(Fun音乐大模型)支持输入开放性歌曲的创作要求或歌词,生成整首男/女声演唱的中文或英文歌曲。歌曲通俗易懂,情绪 ## 法律模型 - [通义法睿-Plus-32K](https://www.qianwenai.com/models/farui-plus.md): 文本生成 通义法睿是以通义千问为基座经法律行业数据和知识专门训练的法律行业大模型产品,综合运用了模型精调、强化学习、 RAG检索增强、法律Age ## 通义其他模型 - [意图分类模型](https://www.qianwenai.com/models/tongyi-intent-detect-v3.md): 文本生成 意图识别和槽位填充是对话系统中的基础任务。本模型实现了一个基于 API的意图(intent)和槽位参数(slots)联合预测。在一次模型输出中,� - [通义晓蜜-对话分析-flash](https://www.qianwenai.com/models/tongyi-xiaomi-analysis-flash.md): 文本生成 通义晓蜜-对话分析-flash是专注于日常任务,如对话信息抽取、场景分类等分析类需求的模型,自定义分析标准遵循与对话语义理解能力显著提 - [通义晓蜜-对话分析-pro](https://www.qianwenai.com/models/tongyi-xiaomi-analysis-pro.md): 文本生成 通义晓蜜-对话分析-pro是专注于高阶复杂分析,如针对具备复杂业务逻辑的复杂质检规则等分析需求的模型,支持自定义更细粒度的分析标准� ## 表情生成模型 - [悦动人像EMO-detect](https://www.qianwenai.com/models/emo-detect-v1.md): 视频生成 EMO-Detect是辅助EMO的图像检测模型,用于检测图片中的人物形象是否符合视频生成要求。 图像 - [悦动人像EMO](https://www.qianwenai.com/models/emo-v1.md): 视频生成 EMO是一款视频生成模型,可基于人物图片生成高质量的人物肖像动态视频。 图像 - [表情包Emoji-detect](https://www.qianwenai.com/models/emoji-detect-v1.md): 视频生成 表情包Emoji-Detect是辅助表情包Emoji生成的图像检测模型,用于检测图片中的人物形象是否符合视频生成要求。 图像 - [表情包Emoji](https://www.qianwenai.com/models/emoji-v1.md): 视频生成 表情包emoji是一款人脸动效视频生成模型,可基于人脸图片和预设的人脸动态模板,生成人脸动效视频。 图像 ## 其他模型 - [大模型声音复刻及声音设计](https://www.qianwenai.com/models/voice-enrollment.md): 语音合成 大模型声音复刻服务依托先进的大模型技术进行特征提取,无需训练过程就可以完成声音的复刻。仅需提供极短的音频,即可迅速生成高度相�