智谱GLM系列文本模型

复制成功!
开通模型开通后即可体验并通过 API 调用该模型。加入对比
文本生成

概述

文本生成

GLM-5.1 是智谱最新旗舰模型,代码能力大大增强,长程任务显著提升,能够在单次任务中持续、自主地工作长达 8 小时,完成从规划、执行到迭代优化的完整闭环,交付工程级成果。 在综合能力与 Coding 能力上,GLM-5.1 整体表现对齐 Claude Opus 4.6,并在长程自主执行、复杂工程优化与真实开发场景中展现出更强的持续工作能力,是构建 Autonomous Agent 与长程 Coding Agent 的理想基座。

输入

文本

输出

文本

功能

前缀补全

您可在调用通义千问 API 时启用 Partial Mode,确保模型严格基于您的起始文本进行生成。查看文档

函数调用

您可以使用 函数调用 功能,通过引入外部工具,使得大模型可以与外部世界进行交互。查看文档

缓存

Context Cache 技术会缓存长上下文请求的公共前缀,减少推理时的重复计算,提升响应速度同时降低您的使用成本。查看文档

结构化输出

开启结构化输出功能可以确保大模型输出标准格式的 JSON 字符串。查看文档

批量任务

联网搜索

启用联网检索功能后,模型将基于实时检索数据进行回复。查看文档

微调

定价

  • 输入
    ¥8/M tokens
  • 输出
    ¥28/M tokens
  • 输入(缓存命中)
    ¥2/M tokens

速率限制与上下文

  • 最大输入
    204.80K
  • 最大输出
    131.07K
  • RPM每分钟请求数
    200
  • TPM每分钟 Token 数
    3M
  • 最大输入(思考模式)
    204.80K
  • 最大输出(思考模式)
    131.07K
  • 上下文
    204.80K

API 参考

开通模型开通后即可体验并通过 API 调用该模型。
复制成功!
1234567891011121314151617181920212223
from openai import OpenAI
import os

client = OpenAI(
    api_key="sk-xxx",  # 替换为你的百炼API Key
    base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)

completion = client.chat.completions.create(
    model="ZHIPU/GLM-5.1",
    messages=[{"role": "user", "content": "你是谁"}],
    extra_body={"enable_thinking": True, "reasoning_effort": "max"},
    stream=True,
)

for chunk in completion:
    if not chunk.choices:
        continue
    delta = chunk.choices[0].delta
    if hasattr(delta, "reasoning_content") and delta.reasoning_content:
        print(delta.reasoning_content, end="", flush=True)
    if hasattr(delta, "content") and delta.content:
        print(delta.content, end="", flush=True)