Qwen3.8-Omni-Flash
复制成功!
概述
Qwen 新一代原生全模态模型,支持 1M 长序列,可直接输入文本、图像、音频与视频,基于 Qwen3.8-Flash-Next 架构。模型面向真实生产力场景中的 Agent 能力:在具备编程、文本知识工作、GUI 操作等 Agentic 能力的同时,在以音视频为核心的Agentic应用例如视频剪辑、音乐视频创作、影视制作与解说、音视频到图文摘要、音视频对话等需要综合处理文本、图像、音频和视频的工作流上取得了显著的效果。支持 2 通道与 4 通道空间音频解析,兼容 DashScope 与 OpenAI 协议,建议安装配套的 Qwen-MM-Plugins,便于 Agent 框架接入原生多模态能力。
输入
文本图像音频视频
输出
文本
功能
定价
- 输入¥0.8/M tokens
- 输出¥2.7/M tokens
- 输入(缓存命中)¥0.1/M tokens
速率限制与上下文
- 最大输入991K
- 最大输出131K
- 最大输入(思考模式)983K
- 最大输出(思考模式)131K
- 上下文1M
- 最大思维链262K
- TPM每分钟 Token 数2M
- RPM每分钟请求数30K
内置工具
API 参考
调用API复制成功!
1234567891011121314151617181920212223242526272829
# 安装依赖:pip install -U openai
# 请先配置目标地域的 DASHSCOPE_API_KEY 环境变量。
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["DASHSCOPE_API_KEY"],
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)
completion = client.chat.completions.create(
model="qwen3.8-omni-flash",
messages=[{"role": "user", "content": "你是谁?"}],
# Qwen3.8-Omni-Flash 仅支持文本输出,不设置 audio 参数。
modalities=["text"],
stream=True,
stream_options={"include_usage": True},
)
for chunk in completion:
if chunk.choices:
content = chunk.choices[0].delta.content
if content:
print(content, end="", flush=True)
elif chunk.usage:
print()
print("Usage:", chunk.usage)
print()