chat.glm_4_6
zai/glm-4-6/chat

GLM 4.6 API 是 Z.ai 最新旗舰 GLM 模型 —— 相比 GLM-4.5 的升级款,配备 200K token 上下文窗口、更强的真实场景编程能力,以及更省 token 的智能体工作流,并原生支持工具调用与结构化输出。GLM 4.6 API 兼容 OpenAI:把现有 SDK 指向 VibeToken,把 model 设为 glm-4-6。输入 ¥0.51 / 1M tokens、输出 ¥1.87 / 1M tokens、缓存输入读取 ¥0.0935 / 1M —— 比官方价低 15%,全部通过一个 REST 端点。

Input
GLM-4.6
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
GLM-4.6 Online
Hi! I'm a helpful AI assistant. What can I do for you?

GLM 4.6 API:对话

用 GLM 4.6 API 调用 Z.ai 最新旗舰 —— 相比 GLM-4.5 的重大升级,配备 200K token 上下文窗口、更强的真实场景编程能力,以及更精简、更省 token 的智能体运行。

GLM 4.6 API 是 Z.ai 最新的旗舰模型 —— 相比 GLM-4.5 再进一步:200K token 上下文窗口、更强的真实场景编码能力,以及更精简、更省 token 的智能体运行,并原生支持工具调用与结构化输出。通过 VibeToken 接入,GLM 4.6 API 完全兼容 OpenAI:把现有 SDK 指向 VibeToken 的 base URL,把 model 设为 glm-4-6,第一次 GLM 4.6 API 调用即刻生效。

GLM 4.6 API 价格为输入 ¥0.51 / 1M tokens、输出 ¥1.87 / 1M tokens、缓存输入读取 ¥0.0935 / 1M —— 比官方公开价低 15%。一把 VibeToken key 通用 GLM 4.6 API 与 200+ 其他模型 —— 无需 Z.ai 账号。

为什么选这个模型

团队选择 GLM 4.6 API 的六个理由

从 200K 上下文窗口到立减 15% 的首发定价 —— 看看 GLM-4.6 凭什么值得上线。

相比 GLM-4.5 的真实升级

GLM 4.6 API 是 Z.ai 最新旗舰 —— 在编程、推理与智能体工具调用上都明显优于 GLM-4.5,完成任务所需的 token 大约少 15%。

为代码而生

GLM 4.6 API 是顶级的编程模型 —— 多文件生成、重构、调试与更出色的前端开发,并在真实场景编程基准上取得领先成绩。

原生工具调用

GLM-4.6 专为智能体调优 —— function / tool calling 以 OpenAI 格式开箱即用,在多步串联时格式错误的调用比 GLM-4.5 更少。

长上下文窗口

GLM 4.6 API 支持最高 200K token 上下文 —— 整个代码库、长文档或完整的智能体历史都能放进一次调用。

兼容 OpenAI、一把 key

GLM 4.6 API 使用 OpenAI chat-completions 格式;同一把 VibeToken key 还可路由到 GPT-5.5、Claude、Gemini 及 200+ 其他模型。

比公开价低 15%

GLM-4.6 比 Z.ai 公开价低 15% —— 输入 ¥0.51 / 1M、输出 ¥1.87 / 1M、缓存 ¥0.0935 / 1M。按实际用量的 token 计费,不按请求收费。

RouterBase dashboard preview
快速上手

三步开始使用 GLM 4.6 API

从注册到第一次响应,5 分钟以内。

  1. 创建 VibeToken API key

    注册账号并生成一把 key —— 它即可解锁 GLM-4.6 以及 VibeToken 目录中的所有其他模型。

  2. 发送第一条消息

    把任意兼容 OpenAI 的 SDK 指向 vibetoken.cn/v1,把 model 设为 glm-4-6。响应遵循标准 chat-completions 结构,流式与工具调用均开箱即用。

  3. 检查用量

    每次响应都附带完整的 token 明细 —— 输入、输出与缓存输入 —— 让你逐次调用地观察 GLM 4.6 API 的成本与缓存命中率。

定价

按使用量付费

VibeToken 透传合作方价格,与模型官方公开 API 价格对比。

客户故事

团队用 GLM 4.6 API 做什么

真实生产负载,运行在 VibeToken 200+ 模型目录之上。

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

我们把编码智能体从 GLM-4.5 迁到了 GLM 4.6 API —— 多文件 diff 更干净,更低的 token 用量也直接体现在账单上。

Priya Lakshmi
Priya LakshmiFounder, Quillo

我们通过 VibeToken 一行代码切到 GLM 4.6 API —— 无需改 SDK,4.6 更大的 200K 上下文让我们摆脱了旧的分块变通方案。

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

对我们的智能体来说,GLM 4.6 API 的工具调用比 GLM-4.5 更可靠 —— 错误调用更少,仍是同一套 OpenAI 格式。

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

VibeToken 让我们在一把 key 之下把 GLM 4.6 API 与 GPT、Claude 做 A/B —— 4.6 以极低的成本赢下了我们的编程评测。

Sophia Martín
Sophia MartínCTO, Relay

缓存输入计费加上 4.6 更大的上下文,又一次削减了我们的 RAG 账单 —— GLM 4.6 API 上的长系统提示词如今几乎可以忽略。

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

我们把 OpenAI SDK 指向 VibeToken,GLM 4.6 API 就直接跑起来了 —— 从 GLM-4.5 升级只是改一行 model。

常见问题

关于 GLM 4.6 API 的常见问题。

GLM 4.6 API 是 VibeToken 对 Z.ai GLM-4.6 的直通代理 —— Z.ai 最新旗舰,相比 GLM-4.5 明显升级,配备 200K 上下文窗口、更强的编程与智能体工具调用,以及更好的 token 效率,通过兼容 OpenAI 的 REST 接口提供,原生支持工具调用与结构化输出。