智谱GLM系列文本模型
复制成功!
文本生成推理
概述
文本生成推理
智谱原厂直供,最新旗舰模型。GLM-5.2 是智谱迄今能力最强的开源模型,支持真正可用的 1M 上下文,并在长程任务中继续保持领先。
输入
文本
输出
文本
功能
定价
- 输入¥8/M tokens
- 输出¥28/M tokens
- 输入(缓存命中)¥2/M tokens
速率限制与上下文
- 最大输入1.04M
- 最大输出131.07K
- RPM每分钟请求数200
- TPM每分钟 Token 数3M
- 最大输入(思考模式)1.04M
- 最大输出(思考模式)131.07K
- 上下文1.04M
API 参考
开通模型开通后即可体验并通过 API 调用该模型。复制成功!
1234567891011121314151617181920212223
from openai import OpenAI
import os
client = OpenAI(
api_key="sk-xxx", # 替换为你的百炼API Key
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)
completion = client.chat.completions.create(
model="ZHIPU/GLM-5.2",
messages=[{"role": "user", "content": "你是谁"}],
extra_body={"enable_thinking": True, "reasoning_effort": "max"},
stream=True,
)
for chunk in completion:
if not chunk.choices:
continue
delta = chunk.choices[0].delta
if hasattr(delta, "reasoning_content") and delta.reasoning_content:
print(delta.reasoning_content, end="", flush=True)
if hasattr(delta, "content") and delta.content:
print(delta.content, end="", flush=True)