智谱GLM系列文本模型
复制成功!
文本生成
概述
文本生成
GLM-5.1 是智谱最新旗舰模型,代码能力大大增强,长程任务显著提升,能够在单次任务中持续、自主地工作长达 8 小时,完成从规划、执行到迭代优化的完整闭环,交付工程级成果。 在综合能力与 Coding 能力上,GLM-5.1 整体表现对齐 Claude Opus 4.6,并在长程自主执行、复杂工程优化与真实开发场景中展现出更强的持续工作能力,是构建 Autonomous Agent 与长程 Coding Agent 的理想基座。
输入
文本
输出
文本
功能
定价
- 输入¥8/M tokens
- 输出¥28/M tokens
- 输入(缓存命中)¥2/M tokens
速率限制与上下文
- 最大输入204.80K
- 最大输出131.07K
- RPM每分钟请求数200
- TPM每分钟 Token 数3M
- 最大输入(思考模式)204.80K
- 最大输出(思考模式)131.07K
- 上下文204.80K
API 参考
开通模型开通后即可体验并通过 API 调用该模型。复制成功!
1234567891011121314151617181920212223
from openai import OpenAI
import os
client = OpenAI(
api_key="sk-xxx", # 替换为你的百炼API Key
base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)
completion = client.chat.completions.create(
model="ZHIPU/GLM-5.1",
messages=[{"role": "user", "content": "你是谁"}],
extra_body={"enable_thinking": True, "reasoning_effort": "max"},
stream=True,
)
for chunk in completion:
if not chunk.choices:
continue
delta = chunk.choices[0].delta
if hasattr(delta, "reasoning_content") and delta.reasoning_content:
print(delta.reasoning_content, end="", flush=True)
if hasattr(delta, "content") and delta.content:
print(delta.content, end="", flush=True)