Save 5%Kimi K3
Kimi K3 是月之暗面出品的对话模型,通过 VibeToken 官方渠道接入。兼容 OpenAI 的对话接口,支持流式输出与工具调用。
VibeToken 用一个兼容 OpenAI 的 API 接入国产大模型,境内直连。
VibeToken 把国内主流实验室的模型接到同一个端点,官方渠道接入,境内直连。
按最新发布排序,来自本区域的真实目录。各品类都可以直接点进去试,几分钟就能开始构建。
Save 5%Kimi K3 是月之暗面出品的对话模型,通过 VibeToken 官方渠道接入。兼容 OpenAI 的对话接口,支持流式输出与工具调用。
Save 5%GLM-5.2 是智谱出品的对话模型,通过 VibeToken 官方渠道接入。兼容 OpenAI 的对话接口,支持流式输出与工具调用。

DeepSeek V4 Flash 是深度求索出品的对话模型,通过 VibeToken 官方渠道接入。兼容 OpenAI 的对话接口,支持流式输出与工具调用。

DeepSeek V4 Pro 是深度求索出品的对话模型,通过 VibeToken 官方渠道接入。兼容 OpenAI 的对话接口,支持流式输出与工具调用。
Save 5%Kimi K2.6 是月之暗面出品的对话模型,通过 VibeToken 官方渠道接入。兼容 OpenAI 的对话接口,支持流式输出与工具调用。
Save 10%GLM-5.1 是智谱出品的对话模型,通过 VibeToken 官方渠道接入。兼容 OpenAI 的对话接口,支持流式输出与工具调用。
Save 5%MiniMax M2.7 是MiniMax出品的对话模型,通过 VibeToken 官方渠道接入。兼容 OpenAI 的对话接口,支持流式输出与工具调用。
Save 15%Qwen3.5 122B A10B 是阿里通义出品的对话模型,通过 VibeToken 官方渠道接入。兼容 OpenAI 的对话接口,支持流式输出与工具调用。
原本要自建的能力,VibeToken 打包在一个 API 后面。路由、重试、切换、计费、用量分析,都不用自己再写一遍。
直接替换 OpenAI SDK,改一行 base URL 就能接入。请求体、响应体、流式输出与 tool calling 的字段完全一致。现有的重试、超时、日志中间件都不用改。Python、Node.js、Go、Ruby 官方 SDK 均可直接使用。LangChain、LlamaIndex、Vercel AI SDK 也能沿用既有配置。迁移通常在一个下午内完成,不需要为此单独排期。
对话有 DeepSeek、Qwen、Kimi、GLM、MiniMax,覆盖通用推理、长上下文与低成本三类需求。视频有 Kling、Wan、Seedance、Vidu,支持文生视频、图生视频与参考图驱动。图像有 Seedream,支持文生图与图像编辑。新模型跟随官方发布持续接入,通常在上线后数天内可用。不需要为每家厂商单独申请账号、单独对接、单独结算。
上游直接对接模型厂商的官方接口,不是从第三方转售商二次转发。版本与能力跟随官方发布,不会滞后。上下文长度、限流策略与计费口径都与官方一致,不会出现对不上账的情况。出问题时链路只有一跳,排查更快。官方调整能力时同步跟进,不会卡在中间商的排期上。
服务部署在境内,调用不经跨境跳转,也不需要代理或专线。延迟稳定,不受境外链路波动影响。这对需要在生产环境承诺响应时间的业务是硬指标。瞬时失败自动重试,主通道异常时毫秒级切换到备用通道,业务侧无感。可用性不由单一上游决定。
所有模型一张账单,一处结清,不用再同时维护多家厂商的账号与发票。用量可以按模型、按 key、按项目拆开看。支持导出 CSV,也能通过 API 查询。每把 key 都能单独设置月度上限,避免失控脚本超预算。支持增值税发票与对公转账。
7x24 中文响应。工单、账单、限流调整与安全问题都由国内团队直接处理,不用等时区、不用翻译、不用来回确认上下文。接入阶段的模型选型、参数调优与并发规划,也可以直接问。带上 request ID,能定位到具体那一次调用。

从注册到第一次响应,5 分钟内完成。不需要提前对接商务,也不需要等待审核。
注册账号,在控制台生成一个 sk-rb-… 密钥。可以按项目分别建 key,各自设置月度上限与权限范围。注册即有免费额度,不需要绑卡。
兼容 OpenAI 接口,只需替换 base URL 与密钥。现有的 SDK、重试逻辑与日志中间件都不用动。改完立即生效,不需要重新部署依赖。
目录里的对话、图像与视频模型,同一把密钥全部可用。切换模型只需要改一个字段,不用改调用方式,也不用重新申请权限。
一个 API 接入国产大模型。看团队为何在 VibeToken 上交付。
VibeToken 让我们的模型运维从 5 个 SDK 收敛成 1 个。上线节奏快了一倍,账单也终于只有一份。
上游抖动那次,我们在 VibeToken 上改一行代码就切了通道。用户完全没感知,事后看日志才知道出过事。
VibeToken 境内直连,p95 延迟比之前走代理低了 30%。同样的 prompt,响应稳定多了。
光是统一账单就值回票价。季末不用再追四五家厂商的发票,财务那边省了大量时间。
兼容 OpenAI 接口,换个 base URL 就是 VibeToken。整个对接花的时间,比我写这条评价还短。
VibeToken 把所有模型放在一把 key 后面。研究团队再也不来找我申请新账号了。
主通道异常时 fallback 在 200ms 内触发。对我们的客服机器人来说,这是硬性要求。
我们用一个周末把 42 个服务迁到了 VibeToken。唯一的 PR 评论是「就这?」
官方渠道接入,价目透明,比之前省了两成。上下文和限流也和官方文档对得上。
VibeToken 是国产大模型的统一 API 平台。把国内主流实验室的对话、图像与视频模型接到同一个兼容 OpenAI 的端点上,你只需要维护一把密钥和一套调用代码,就能在不同模型之间自由切换。智能路由、自动重试、通道切换与统一计费都已内置,不需要自己搭一层网关。
