智谱GLM系列文本模型
复制成功!
文本生成推理
概述
文本生成推理
智谱新一代旗舰基座,面向AgenticEngineering,实现从代码到工程的范式跃迁,擅长复杂系统工程与长程Agent任务。
输入
文本
输出
文本
功能
定价
- 输入¥6/M tokens
- 输出¥22/M tokens
- 输入(缓存命中)¥1.5/M tokens
速率限制与上下文
- 最大输入204.80K
- 最大输出131.07K
- RPM每分钟请求数200
- TPM每分钟 Token 数3M
- 最大输入(思考模式)204.80K
- 最大输出(思考模式)131.07K
- 上下文204.80K
API 参考
开通模型开通后即可体验并通过 API 调用该模型。复制成功!
1234567891011121314151617181920212223
from openai import OpenAI
import os
client = OpenAI(
api_key="sk-xxx", # 替换为你的百炼API Key
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)
completion = client.chat.completions.create(
model="ZHIPU/GLM-5",
messages=[{"role": "user", "content": "你是谁"}],
extra_body={"enable_thinking": True, "reasoning_effort": "max"},
stream=True,
)
for chunk in completion:
if not chunk.choices:
continue
delta = chunk.choices[0].delta
if hasattr(delta, "reasoning_content") and delta.reasoning_content:
print(delta.reasoning_content, end="", flush=True)
if hasattr(delta, "content") and delta.content:
print(delta.content, end="", flush=True)