chat.glm_5
zai/glm-5/chat

GLM 5 API 是 Z.ai 新一代旗舰 GLM 模型 —— GLM 家族中最强大的一款,在高难度推理、复杂编码与高要求智能体工作上相比 4.x 系列实现跨代飞跃,配备 200K token 上下文窗口、原生工具调用与结构化输出。GLM 5 API 兼容 OpenAI:把现有 SDK 指向 VibeToken,把 model 设为 glm-5。输入 ¥0.90 / 1M tokens、输出 ¥2.88 / 1M tokens、缓存输入读取 ¥0.18 / 1M —— 比官方价低 10%,全部通过一个 REST 端点。

Input
GLM-5
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
GLM-5 Online
Hi! I'm a helpful AI assistant. What can I do for you?

GLM 5 API:对话

用 GLM 5 API 调用 Z.ai 新一代旗舰 —— GLM-5 是 GLM 家族中最强大的模型,在高难度推理、复杂编码与高要求智能体工作上相比 4.x 系列实现明显跨越,且全程兼容 OpenAI。

GLM 5 API 是 Z.ai 的新一代旗舰 —— GLM 家族中最强大的模型,在高难度推理、复杂编码与高要求智能体工作上相比 4.x 系列实现跨代飞跃,原生支持工具调用、结构化输出与 200K token 上下文窗口。通过 VibeToken 接入,GLM 5 API 完全兼容 OpenAI:把现有 SDK 指向 VibeToken 的 base URL,把 model 设为 glm-5,第一次 GLM 5 API 调用即刻生效。

GLM 5 API 价格为输入 ¥0.90 / 1M tokens、输出 ¥2.88 / 1M tokens、缓存输入读取 ¥0.18 / 1M —— 比官方公开价低 10%。一把 VibeToken key 通用 GLM 5 API 与 200+ 其他模型 —— 无需 Z.ai 账号。

为什么选这个模型

团队选择 GLM 5 API 的六个理由

从前沿级推理到立减 10% 的定价 —— 团队在高难度问题上选用 GLM-5 的六个理由。

迄今最强大的 GLM

GLM-5 相比 4.x 系列实现跨代提升 —— 更深的推理、更强的多步问题求解,以及在开放、模糊任务上更出色的判断力。

前沿级推理

把高难度的数学、分析或规划问题交给 GLM 5 API,它会有条不紊地一步步攻克 —— 这是只有顶级模型才能给出的深度。

原生工具调用

GLM-5 以 OpenAI 格式规划并调用工具,对何时该行动有出色判断 —— 非常适合处理复杂、多阶段目标的自主智能体。

长上下文窗口

GLM 5 API 支持最高 200K token 上下文 —— 整个代码库、研究资料或长篇案卷都能在一次推理中尽收眼底。

兼容 OpenAI、一把 key

GLM 5 API 使用 OpenAI chat-completions 格式;一把 VibeToken key 即可把 GLM-5 与 GPT-5.5、Claude、Gemini 及 200+ 其他模型并列接入。

比公开价低 10%

GLM-5 比 Z.ai 公开价低 10% —— 输入 ¥0.90 / 1M、输出 ¥2.88 / 1M、缓存 ¥0.18 / 1M。前沿能力,按 token 计费的路由价格。

RouterBase dashboard preview
快速上手

三步开始使用 GLM 5 API

从注册到第一次响应,5 分钟以内。

  1. 创建 VibeToken API key

    注册账号并生成一把 API key —— 在同一处即可访问 GLM-5 以及 VibeToken 目录中的所有其他模型。

  2. 发送第一条消息

    把任意兼容 OpenAI 的 SDK 指向 vibetoken.cn/v1,把 model 设为 glm-5。流式、工具调用与结构化输出都遵循标准的 chat-completions 结构。

  3. 检查用量

    每次 GLM 5 API 响应都返回完整的 token 明细 —— 输入、输出与缓存输入 —— 让成本与缓存命中率在每次调用中都清晰可见。

定价

按使用量付费

VibeToken 透传合作方价格,与模型官方公开 API 价格对比。

客户故事

团队用 GLM 5 API 做什么

真实生产负载,运行在 VibeToken 200+ 模型目录之上。

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

我们只把最难的推理任务路由到 GLM 5 API,其余交给更便宜的模型 —— 它能攻克其他模型一直答错的问题。

Priya Lakshmi
Priya LakshmiFounder, Quillo

通过 VibeToken,GLM-5 成了我们复杂分析的默认选择 —— 一行配置,在开放式问题上的质量跃升一目了然。

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

多阶段规划上我们的智能体依赖 GLM 5 API —— 它会就整个目标进行推理,而不只是盯着下一步。

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

我们在一把 VibeToken key 之下把 GLM 5 API 与前沿模型做 A/B —— 它在我们最严苛的评测上站得住脚,成本却明显更低。

Sophia Martín
Sophia MartínCTO, Relay

GLM 5 API 处理了我们流水线以前要交给人工的棘手边缘情况 —— 兜底更少,输出更干净。

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

把我们最难的提示词切到 GLM 5 API 只改了一处 base URL,答案回来得更锋利、结构也更清晰。

常见问题

关于 GLM 5 API 的常见问题。

GLM 5 API 是 VibeToken 对 Z.ai GLM-5 的直通代理 —— GLM 家族中最新、最强大的模型,相比 4.x 系列实现跨代提升,面向高难度推理、复杂编码与高要求智能体,通过兼容 OpenAI 的 REST 接口提供,原生支持工具调用与结构化输出。