我们把编程智能体换到 MiniMax M2 API,工具循环就跑得更干净了。
MiniMax M2 是一个为智能体工作流与编程而建的新一代模型——调用工具、编写与修复代码、端到端跑多步任务,在真实流量下依旧又快又省。在 VibeToken 上通过兼容 OpenAI 的端点提供,输入 ¥0.30 / 1M、输出 ¥1.20 / 1M,缓存输入仅 ¥0.03,比标准价低 5%;当工具调用与编程比一个冗长回答更重要时就用它。
MiniMax M2 API —— 为智能体与编程而建
MiniMax M2 API 提供 MiniMax M2,一个为智能体工作流与编程调校的新一代模型——快、擅长工具、便宜。
MiniMax M2 为智能体真正要做的事而建:调用工具、编写与修复代码、端到端跑多步任务。MiniMax M2 API 把这份智能体侧重与高效设计结合,因此在真实流量下依旧又快又省——每百万输入 token ¥0.30、输出 ¥1.20,缓存输入仅 ¥0.03。当工具调用与编程比一个冗长的单次回答更重要时,就用它。
你通过 VibeToken、以 OpenAI chat-completions 协议调用 MiniMax M2 API;把模型设为 minimax-m2,客户端无需改动。MiniMax M2 API 计费为每百万输入 ¥0.30、输出 ¥1.20、缓存输入 ¥0.03——比标价低 5%,一把密钥贯通整个目录。
MiniMax M2 API 给你什么
工具循环与编程,又快又省。
为智能体而建
MiniMax M2 API 为智能体工作流调校——工具调用、多步任务与长时运行的循环。
擅长编程
编写、修复与就代码进行推理,正是 MiniMax M2 API 立足之处。
快而高效
高效设计让 MiniMax M2 API 在真实流量下依旧迅捷,因而契合交互式与高并发链路。
低定价
输入 ¥0.30、输出 ¥1.20,MiniMax M2 API 便宜到足以支撑繁重的智能体循环——比标价低 5%。
近乎免费的缓存读取
缓存输入每百万仅 ¥0.03,因此在 MiniMax M2 API 上重复的上下文几乎不花钱。
OpenAI 形态
一个 chat-completions 端点、一把 VibeToken 密钥——指向 vibetoken.cn/v1、写上模型名,跳过 MiniMax SDK。

三步完成对 MiniMax M2 API 的首次调用
接入快,随时驱动工具循环。
创建密钥
一把 VibeToken 密钥即可访问 MiniMax M2 API 及目录里的每个模型。
指向并命名
把任意 OpenAI 客户端发往 vibetoken.cn/v1,model=minimax-m2。流式与函数调用开箱即用。
接上你的工具
把函数 schema 交给 MiniMax M2 API,让它驱动循环;用量按响应返回,成本按次可见。
按使用量付费
VibeToken 透传合作方价格,与模型官方公开 API 价格对比。
正在基于 MiniMax M2 API 构建的团队
工具循环与编程,跑得便宜。
MiniMax M2 API 端到端处理了多步任务,我们无需盯着循环。
输入 ¥0.30 还擅长编程,让 MiniMax M2 API 成了我们智能体工作的默认。
缓存读取 ¥0.03,让我们在 MiniMax M2 API 上的长智能体循环基本免费。
函数调用很可靠,于是我们整个工具层都跑在 MiniMax M2 API 上。
MiniMax M2 API 够快,能坐进我们的在线编程助手里。
相较旧模型只改了一个字符串;MiniMax M2 API 当天就更便宜、也更擅长工具。
我们把智能体与编程流量路由到 MiniMax M2 API,一切保持在一把密钥之内。
我们的自主编程运行在 MiniMax M2 API 上明显更稳了。
MiniMax M2 API —— 常见问题
把流量导过来之前该知道的。
VibeToken 对 MiniMax M2 的托管接入——一个为智能体工作流与编程而建的新一代模型,通过兼容 OpenAI 的端点提供。