Qwen3.7-Max
复制成功!
立即体验加入对比
文本生成视觉理解推理
概述
文本生成视觉理解推理
Qwen3.7系列中规模最大、综合能力最强的Max模型,相较于5月20日快照增加了视觉模态理解能力,能够感知真实世界场景,具备多模态交互混合智能体能力。该版本为2026年6月8日快照。
输入
图像文本视频
输出
文本
功能
定价
- 输入¥12/M tokens
- 输出¥36/M tokens
- 输入(缓存命中)¥2.4/M tokens
- 显式缓存创建¥15/M tokens
- 显式缓存命中¥1.2/M tokens
速率限制与上下文
- 最大输入991.80K
- 最大输出65.53K
- RPM每分钟请求数600
- TPM每分钟 Token 数1M
- 最大输入(思考模式)983.61K
- 最大输出(思考模式)65.53K
- 上下文1M
内置工具
code_interpreterResponses API
i2i_searchResponses API
t2i_searchResponses API
web_extractorResponses API
web_searchResponses API
API 参考
获取 API Key复制成功!
123456789101112131415161718
import os
import dashscope
dashscope.base_http_api_url = "https://dashscope.aliyuncs.com/api/v1"
messages = [
{
"role": "user",
"content": [
{"image": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20241022/emyrja/dog_and_girl.jpeg"},
{"text": "图中描绘的是什么景象?"}]
}]
response = dashscope.MultiModalConversation.call(
api_key=os.getenv('DASHSCOPE_API_KEY'),
model='qwen3.7-max-2026-06-08',
messages=messages
)
print(response.output.choices[0].message.content[0]["text"])