MiniMax M1 80k API 啃完了我们最长的分析提示,我们无需裁剪上下文。
MiniMax M1 80k 是 80K 思考预算档的 MiniMax-M1——一个开源权重、混合闪电注意力的推理模型,带 1M token 上下文窗口,因而有充足空间在长文档、数学、难编程与用工具的智能体上深入推理。在 VibeToken 上通过兼容 OpenAI 的端点提供,输入 ¥0.40 / 1M、输出 ¥2.20 / 1M,比标准价低 5%;它是 40k 变体更深思考的同胞。
MiniMax M1 80k API —— 长上下文推理,80K 思考预算
MiniMax M1 80k API 以 80K 思考预算档提供 MiniMax-M1——一个开源权重的混合注意力推理模型,带 1M token 上下文窗口。
MiniMax M1 是一个开源权重、混合注意力的推理模型:其 lightning attention(闪电注意力)设计能高效扩展长推理,并可读取多达 1M token 的上下文。MiniMax M1 80k API 运行 80K 思考预算变体,让模型在作答前有更多空间逐步推理——它是 40k 档更深思考的同胞。这让它非常适合长上下文分析、数学、难编程与用工具的智能体,这些场景里额外的思考物有所值。
你通过 VibeToken、以 OpenAI chat-completions 协议访问 MiniMax M1 80k API;把模型设为 minimax-m1-80k,客户端无需改动。MiniMax M1 80k API 计费为每百万输入 token ¥0.40、输出 ¥2.20——比标价低 5%,一把密钥贯通整个目录。
MiniMax M1 80k API 给你什么
既有思考的空间,也有阅读的空间。
混合闪电注意力
MiniMax M1 采用混合闪电注意力设计,因此 MiniMax M1 80k API 扩展长推理时不再走老的成本曲线。
80K 思考预算
MiniMax M1 80k API 给模型 80K token 的思考预算——比 40k 档有更多推理空间。
1M token 上下文
1M token 窗口让 MiniMax M1 80k API 在单次调用里容纳长文档、代码库与工具轨迹。
推理、数学、编程
延展的思考让 MiniMax M1 80k API 在长上下文分析、数学与难编程上表现强劲。
用工具的智能体
可靠的函数调用让 MiniMax M1 80k API 成为用工具智能体的扎实骨干。
开源权重,托管提供
MiniMax M1 是开源权重;MiniMax M1 80k API 让你无需自建即可托管使用。

三步完成对 MiniMax M1 80k API 的首次调用
接一次线,然后把又长又难的问题喂给它。
创建密钥
一把 VibeToken 密钥即可访问 MiniMax M1 80k API 及目录里的每个模型。
指向并命名
把任意 OpenAI 客户端发往 vibetoken.cn/v1,model=minimax-m1-80k。流式与函数调用开箱即用。
喂给它长上下文
MiniMax M1 80k API 可吃下多达 1M token 的上下文,并随每个响应返回用量,成本按次可见。
按使用量付费
VibeToken 透传合作方价格,与模型官方公开 API 价格对比。
正在基于 MiniMax M1 80k API 构建的团队
把长上下文与延展思考投入实用。
80K 思考预算让 MiniMax M1 80k API 找到了较短档漏掉的解法。
1M token 窗口让 MiniMax M1 80k API 一次读完了我们的整份规范。
输入 ¥0.40,MiniMax M1 80k API 给了我们深度推理,却没有旗舰的账单。
函数调用很稳,于是我们的智能体在最难的步骤上跑 MiniMax M1 80k API。
在长数学链上,别的模型会漂移,MiniMax M1 80k API 依旧保持连贯。
混合注意力意味着 MiniMax M1 80k API 上的长上下文没有让我们的延迟爆掉。
切到 MiniMax M1 80k API 只改了一个字符串,延展推理很值。
我们把深度推理任务路由到 MiniMax M1 80k API,一切保持在一把密钥之内。
MiniMax M1 80k API —— 常见问题
把流量导过来之前该知道的。
VibeToken 对 80K 思考预算档 MiniMax-M1 的托管接入——一个开源权重的混合注意力推理模型,通过兼容 OpenAI 的端点提供。