一张角色定妆图,十个场景,主体始终是同一个人。MiniMax H3 API 让系列化内容真的能做起来。
MiniMax H3 API 用一张参考图加一段文本提示词生成动画视频——2K 画质,6 或 10 秒,七种纵横比(16:9、4:3、1:1、3:4、9:16、21:9 或 adaptive),提示词最长 7000 字符——全部通过兼容 OpenAI 的单一 REST 接口完成,按次计费。
SampleRun the model to replace this previewMiniMax H3 API:参考图生视频
用参考图锁定人物或物体,在新场景里生成视频 —— 2K,6 或 10 秒。
MiniMax H3 API(minimax/minimax-h3-r2v)用参考图约束视频里的主体:你提供一张或多张参考图,再用提示词描述一个全新的场景,模型让参考对象在那个场景里出现并保持特征一致。这是 MiniMax 自研模型,走官方渠道直接接入。image_urls 与 prompt 都是必填;时长 6 或 10 秒,默认 6 秒;画幅可选 16:9、4:3、1:1、3:4、9:16、21:9 与 adaptive,默认 16:9;输出固定 2K,提示词最长 7000 字符。
计费方式是MiniMax H3 API 按次计费:6 秒每段 ¥0.678,10 秒每段 ¥1.13,没有单次请求附加费。这让角色一致性的批量生产变得可行 —— 同一个参考对象换十个场景,成本仍在可控范围。MiniMax H3 API 异步且兼容 OpenAI:POST /v1/videos/generations 带 image_urls 与 prompt,轮询 GET /v1/videos/generations/{id} 到 status=success,从签名 CDN 链接取片。与图生视频的区别在于,参考图不是首帧,而是特征来源,画面可以完全另起一个场景。
团队选择 MiniMax H3 API 的六个理由
从提示词到 2K 成片 —— MiniMax H3 API 在生产环境里的六个特点。
锁定主体特征
参考图决定人物或物体长什么样,MiniMax H3 API 让它出现在你描述的新场景里,跨多次生成保持一致。
场景完全由提示词决定
和图生视频不同,参考图不作为首帧。画面在哪里、发生什么全部由 prompt 决定,MiniMax H3 API 接受最长 7000 字符。
MiniMax 官方渠道
H3 是 MiniMax 自研模型,官方接口直连,不经第三方转售,版本与限流跟随官方。
七种画幅
MiniMax H3 API 支持 16:9、4:3、1:1、3:4、9:16、21:9 与 adaptive 共七种,默认 16:9。角色素材通常横屏出片,竖版信息流改一个字段即可。
固定 2K 输出
MiniMax H3 API 每段都输出 2K,没有画质档。同一个参考对象在不同场景下的成片画质完全一致。
按次计费
MiniMax H3 API 按片计价:6 秒 ¥0.678、10 秒 ¥1.13,无附加费。一个角色批量铺十几个场景的成本可以提前算清。

三步开始使用 MiniMax H3 API
从拿到 key 到第一次调用,5 分钟以内。
准备参考图与场景描述
把参考图放到可公开访问的地址填进 image_urls,在 prompt 里描述你要的场景、动作与镜头。MiniMax H3 API 要求两个字段都必填。
调用 MiniMax H3 API
向 POST /v1/videos/generations 传 image_urls、prompt,以及可选的 duration 与 aspect_ratio(默认 16:9)。
轮询并取回视频
轮询 GET /v1/videos/generations/{id} 直到 status=success,从 MiniMax H3 API 返回的签名 CDN 链接下载成片。
按使用量付费
VibeToken 透传合作方价格,与模型官方公开 API 价格对比。
| 分辨率 | VibeToken |
|---|---|
| 6s / 2K | ¥0.678 |
| 10s / 2K | ¥1.130 |
本次请求费用 ¥0.678(6s / 2K)。¥1 大约可以调用本模型 1 次。
MiniMax H3 API 的价格取 MiniMax 官方公布的刊例价,按次计费,无单次请求附加费。
团队用 MiniMax H3 API 构建了什么
真实生产负载运行在 MiniMax H3 API 上。
我们用 MiniMax H3 API 给虚拟主播铺素材,场景随便换,形象保持一致。
和图生视频的分工很清楚:要画面从图里长出来用那个,要换个场景用这个。
参考图锁住外观,提示词负责剧情,MiniMax H3 API 这套组合让批量生产变得可控。
同一个 IP 形象靠 MiniMax H3 API 铺满全渠道,成本比重新建模低太多。
接入没有额外成本,MiniMax H3 API 和目录里其他视频模型共用同一套请求结构。
六秒够做短视频钩子,十秒能讲一个小段子,两种都试过就知道该用哪个。
MiniMax H3 API 按次计费,一个角色十几个场景的预算当场就能算出来。
官方渠道直连,模型迭代我们能第一时间跟上。
常见问题
关于 MiniMax H3 API 参考图生视频任务的常见问题。
你给一张参考图确定主体长什么样,再用提示词描述一个新场景,模型让这个主体在新场景里出现并保持特征一致。