Qwen3.5-Omni-Plus
复制成功!
立即体验加入对比
多模态
概述
多模态
Qwen3.5-Omni是Qwen最新一代全模态大模型,支持文本,图片,音频,音视频理解与交互。作为 Qwen3-Omni 的全面进化版本, 支持超过 10 小时的音频理解及超过 400 秒的 720P(1 FPS)音视频理解与对话,并进一步拓展语言范围,支持60+种语言音频输入,30+语言语音输出,并且具备强大的结构化音视频理解能力,广泛应用于文本创作、语音助手、多媒体分析等场景,提供自然流畅的多模态理解与交互体验。
输入
文本图像视频音频
输出
文本音频
功能
定价
- 输入:音频¥53/M tokens
- 输出:文本+音频(输出的文本不计费)¥213/M tokens
- 输入:文本/图片/视频¥7/M tokens
- 输出:文本¥40/M tokens
- 输入:音频(Batch File)¥26.5/M tokens
- 输入:文本/图片/视频(Batch File)¥3.5/M tokens
- 输出:文本(Batch File)¥20/M tokens
- 输入:音频(Batch Chat)限时5折¥53¥26.5/M tokens
- 输入:文本/图片/视频(Batch Chat)限时5折¥7¥3.5/M tokens
- 输出:文本(Batch Chat)限时5折¥40¥20/M tokens
速率限制与上下文
- 最大输入196.60K
- 最大输出65.53K
- RPM每分钟请求数60
- TPM每分钟 Token 数100K
- 上下文262.14K
内置工具
search_strategy:agentCompletions API
API 参考
获取 API Key复制成功!
12345678910111213141516171819202122232425
import os
from openai import OpenAI
client = OpenAI(
# 新加坡和北京地域的API Key不同。获取API Key:https://www.alibabacloud.com/help/zh/model-studio/get-api-key
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)
completion = client.chat.completions.create(
model="qwen3.5-omni-plus",
messages=[{"role": "user", "content": "你是谁"}],
# 设置输出数据的模态,当前支持两种:["text","audio"]、["text"]
modalities=["text", "audio"],
audio={"voice": "Ethan", "format": "wav"},
# stream 必须设置为 True,否则会报错
stream=True,
stream_options={"include_usage": True},
)
for chunk in completion:
if chunk.choices:
print(chunk.choices[0].delta)
else:
print(chunk.usage)