Qwen-Plus
复制成功!
立即体验加入对比
概述
千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。本模型是动态更新版本,模型更新不会提前通知。
输入
文本
输出
文本
功能
定价
- 输入¥0.8/M tokens
- 输出¥2/M tokens
- 输入(思考)¥0.8/M tokens
- 输出(思考)¥8/M tokens
- 思考模式输出(Batch File)¥4/M tokens
- 输入(Batch File)¥0.4/M tokens
- 输出(Batch File)¥1/M tokens
- 输入(思考模式 Batch File)¥0.4/M tokens
速率限制与上下文
- 最大输入995K
- 最大输出32K
- 上下文1M
- TPM每分钟 Token 数1M
- RPM每分钟请求数15K
API 参考
调用API复制成功!
123456789101112131415161718192021222324252627282930
from openai import OpenAI
import os
client = OpenAI(
# 如果没有配置环境变量,请用阿里云百炼API Key替换:api_key="sk-xxx"
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)
messages = [{"role": "user", "content": "你是谁"}]
completion = client.chat.completions.create(
model="qwen-plus-latest", # 您可以按需更换为其它深度思考模型
messages=messages,
extra_body={"enable_thinking": True},
stream=True
)
is_answering = False # 是否进入回复阶段
print("\n" + "=" * 20 + "思考过程" + "=" * 20)
for chunk in completion:
if not chunk.choices:
continue
delta = chunk.choices[0].delta
if hasattr(delta, "reasoning_content") and delta.reasoning_content is not None:
if not is_answering:
print(delta.reasoning_content, end="", flush=True)
if hasattr(delta, "content") and delta.content:
if not is_answering:
print("\n" + "=" * 20 + "完整回复" + "=" * 20)
is_answering = True
print(delta.content, end="", flush=True)