chat.glm_4_6v
zai/glm-4-6v/chat

GLM 4.6V API 是 Z.ai 的 4.6 代视觉语言模型 —— 它把图像、视频帧与文档和文本一并接收,做 OCR、图表与表格提取以及视觉推理,原生支持工具调用与结构化输出。GLM 4.6V API 兼容 OpenAI:把现有 SDK 指向 VibeToken,把 model 设为 glm-4-6v。输入 ¥0.255 / 1M tokens、输出 ¥0.765 / 1M tokens、缓存输入读取 ¥0.0425 / 1M —— 比官方价低 15%,全部通过一个 REST 端点。

Input
GLM-4.6V
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
GLM-4.6V Online
Hi! I'm a helpful AI assistant. What can I do for you?

GLM 4.6V API:对话

用 GLM 4.6V API 给你的应用装上“眼睛” —— Z.ai 的 4.6 代视觉语言模型读取图像、视频帧、截图与文档,再以文本或工具调用作答。

GLM 4.6V API 是 Z.ai 的 4.6 代视觉语言(多模态)模型 —— 它把图像、视频帧、截图与文档和文本一并接收,做 OCR、图表与表格提取以及视觉推理,原生支持工具调用与结构化输出。通过 VibeToken 接入,GLM 4.6V API 完全兼容 OpenAI:把现有 SDK 指向 VibeToken 的 base URL,把 model 设为 glm-4-6v,第一次 GLM 4.6V API 调用即刻生效。

GLM 4.6V API 价格为输入 ¥0.255 / 1M tokens、输出 ¥0.765 / 1M tokens、缓存输入读取 ¥0.0425 / 1M —— 比官方公开价低 15%。一把 VibeToken key 通用 GLM 4.6V API 与 200+ 其他模型 —— 无需 Z.ai 账号。

为什么选这个模型

团队选择 GLM 4.6V API 的六个理由

从逐帧精准的图像识别到 85 折定价 —— 团队为何把 GLM-4.6V 放在多模态功能背后。

看懂图像、视频与文档

GLM 4.6V API 在文本之外还接收图像、多页文档与视频帧 —— 在一次多模态调用里完成 OCR、图表与表格提取以及视觉推理。

文档、图表与 OCR

把截图、扫描版 PDF、发票或仪表盘交给 GLM 4.6V API,它就能抽出文本、表格与结构 —— 无需另跑一套 OCR 流水线。

原生工具调用

GLM 4.6V API 直接根据所见、以 OpenAI 工具格式调用函数 —— 让它读一张表单,再在同一个多模态智能体循环里触发你的工具。

长上下文窗口

把长篇多图文档、完整对话历史以及图文交错的回合,全部放入一次 GLM 4.6V API 请求。

兼容 OpenAI、一把 key

GLM 4.6V API 使用 OpenAI chat-completions 格式(含图像);同一把 VibeToken key 还可路由到 GPT-5.5、Claude、Gemini 及 200+ 其他模型。

比官方低 15%

GLM 4.6V API 比 Z.ai 公开价低 15% —— 输入 ¥0.255 / 1M、输出 ¥0.765 / 1M、缓存 ¥0.0425 / 1M。图像输入按 token 计费,多模态依旧便宜。

RouterBase dashboard preview
快速上手

三步开始使用 GLM 4.6V API

从注册到第一次响应,5 分钟以内。

  1. 创建 VibeToken API key

    注册并生成一把 key —— 它解锁 GLM-4.6V 以及 VibeToken 目录中的所有其他模型。

  2. 发送第一条消息

    把任意 OpenAI 兼容 SDK 指向 vibetoken.cn/v1,把 model 设为 glm-4-6v,在文本旁带上 image_url 部分发送消息。响应遵循标准 chat-completions 结构,含流式。

  3. 检查用量

    每次响应都含完整 token 明细 —— 文本与图像输入、输出以及缓存输入 —— 让你在 GLM 4.6V API 上逐次调用地盯住多模态成本。

定价

按使用量付费

VibeToken 透传合作方价格,与模型官方公开 API 价格对比。

客户故事

团队用 GLM 4.6V API 做什么

真实生产负载,运行在 VibeToken 200+ 模型目录之上。

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

我们的客服智能体把用户看到的画面截图发给 GLM-4.6V,它就能指出哪个元素出了问题 —— 比我们之前用的视觉模型便宜得多。

Priya Lakshmi
Priya LakshmiFounder, Quillo

我们一个周末就上线了收据与发票扫描 —— 只把 base URL 换到 GLM 4.6V API,图像解析就跑通了,没有 OCR 供应商。

Aoi Tanaka
Aoi TanakaML Lead, Daybreak Robotics

我们的机器人把摄像头帧流式发给 GLM-4.6V,它通过标准工具调用返回有依据的动作 —— OpenAI 格式意味着零适配工作。

Ethan Nguyen
Ethan NguyenHead of Engineering, Compound Studio

我们在一把 VibeToken key 之下,把 GLM-4.6V 与更大的视觉模型做对比 —— 在图表与表格识别上,它以零头的价格毫不逊色。

Sophia Martín
Sophia MartínCTO, Relay

我们的 RAG 现在把扫描合同当作页面图像建索引 —— GLM-4.6V 直接读取,缓存输入价让长篇参考文档保持便宜。

Lucas Fernandes
Lucas FernandesEngineering Manager, Light

在一条消息里图文交错,用 GLM 4.6V API 就是顺 —— 我们发一张图表加一个问题,就能拿回一个有依据的回答。

常见问题

关于 GLM 4.6V API 的常见问题。

GLM 4.6V API 是 VibeToken 对 Z.ai GLM-4.6V 的代理 —— 一款 4.6 代视觉语言模型,接收图像、视频帧与文档作为输入,通过兼容 OpenAI 的 REST 接口提供,原生支持工具调用与结构化输出。