video_generate.vidu_q2_t2v_novita
vidu/vidu-q2/text-to-video

Vidu Q2 API 仅凭一段文本提示词生成视频,无需图片——时长可变 1-10 秒,最高 1080p,三种纵横比(16:9/9:16/1:1),可选风格提示,支持 BGM 与音频,支持可复现 seed——全部通过兼容 OpenAI 的单一 REST 接口完成,比官方价低 15%。

输入
发送给模型的文本提示词
输出
Sample edited image — run the model to replace this previewSampleRun the model to replace this preview

Vidu Q2 API:文本生视频

用 Vidu Q2 API 仅凭一段纯文本提示词生成视频,无需图片,最高 1080p、1-10 秒。

Vidu Q2 API(video_generate.vidu_q2_t2v_novita)是文生视频模型:Vidu Q2 API 仅凭一段自然语言提示词生成视频,无需图片、也无需参考输入。你用文字描述画面,Vidu Q2 API 就渲染出最高 1080p、时长在 1 到 10 秒之间可变的片段。画面比例(16:9、9:16、1:1)、运动幅度、可选风格提示、可选音频与可选背景音乐,都可通过 Vidu Q2 API 一次兼容 OpenAI 的 REST 调用来控制。

Vidu Q2 API 的价格为每次生成 ¥0.149,比官方 ¥0.175 的刊例价低 15%。这一经济的 Q2 档位让 Vidu Q2 API 很适合低成本迭代:先草拟十几个变体、比较画面比例,并在最终渲染前锁定种子。它只用一把 VibeToken 密钥,无需单独的 SDK 或账户,同一套 JSON 结构可覆盖 200+ 其他模型。由于 Vidu Q2 API 异步且兼容 OpenAI,你可以排队文生视频任务、整晚批处理一场活动,并从签名 CDN 链接拉取成片,任一种子都能让它可复现。

为什么选这个模型

团队选择 Vidu Q2 API 的六个理由

从纯文本输入到 1080p 输出 —— Vidu Q2 API 的优势。

纯文本输入

只发一段提示词 —— Vidu Q2 API 不需要图片、参考或上传,一句话打完,创意就成了片段。

最高 1080p 分辨率

可在 540p、720p 或最高 1080p 中选择,每次调用指定分辨率,用 540p 打样、用 1080p 交付。

1-10 秒可变时长

可设置 1 到 10 秒的任意时长。Vidu Q2 API 不锁死片长,短循环或较长社媒剪辑都无需填充。

三种纵横比与运动

在单次 Vidu Q2 API 请求中选择 16:9、9:16 或 1:1,并调节运动幅度(auto、小、中、高)。

风格提示、音频与 BGM

用可选风格提示引导观感,再开关音频和背景音乐,交付听起来已完成的片段。

兼容 OpenAI 且低 15%

一个端点、一个 key,¥0.149/次,比官方价低 15%,它与每个模型同一 JSON 结构,切换只需改 model ID。

RouterBase dashboard preview
快速上手

三步开始使用 Vidu Q2 API

从注册到第一次 Vidu Q2 API 文本生视频调用,5 分钟以内。

  1. 写好提示词

    用平实语言描述画面、主体和氛围,并加上可选风格提示 —— Vidu Q2 API 只吃文本,一句具体的话就是全部输入。

  2. POST 到 Vidu Q2 API 端点

    在 JSON 里向 POST /v1/images/generations 发送 prompt 及 duration、resolution、aspect_ratio、seed 等选项。端点立即返回异步任务 id;轮询 GET /v1/images/generations/{id} 直到 status=success。

  3. 轮询并下载视频

    成功响应在 results 数组中包含签名 CDN URL。放进 <video> 标签或复制到自有存储桶,无需后处理即可使用。

定价

按使用量付费

VibeToken 透传合作方价格,与模型官方公开 API 价格对比。

分辨率VibeToken官方节省
5s / 1080p ¥0.149¥0.175−15%

本次请求费用 ¥0.1495s / 1080p)。¥1 大约可以调用本模型 6 次。

官方价 = Vidu Q2 文本生视频公开价格(¥0.175)。VibeToken 透传每次生成节省 15%。

客户故事

团队用 Vidu Q2 API 做什么

运行在 Vidu Q2 API 和 VibeToken 模型目录上的真实生产负载。

Marcus Reyes
Marcus ReyesCTO, Paradigm AI

文案打一段提示词,Vidu Q2 API 就返回片段。没有图片管线,没有上传,文本进、视频出。

Priya Lakshmi
Priya Lakshmi创始人, Quillo

一句话、一段 9:16 片段,搞定。文本生视频让社媒团队几分钟就能出短片。

Thomas Beck
Thomas Beck资深工程师, Northbeam

1-10 秒可变时长让我们不再补帧或裁剪,Vidu Q2 API 给出的正是我们要的长度。

Aoi Tanaka
Aoi TanakaML 负责人, Daybreak Robotics

我们每晚直接从提示词以 1080p 渲染并开启 BGM,每条片段到早上都已就绪。

Jonas Keller
Jonas Keller独立开发者

把风格提示和 prompt 传给 Vidu Q2 API,我的预告镜头立刻匹配上了游戏美术。

Ethan Nguyen
Ethan Nguyen工程负责人, Compound Studio

VibeToken 一把 key 搞定 200+ 模型,我们已把文本生视频设为市场团队默认。

Sophia MartinCTO, Relay

¥0.149/条,定稿前先迭代十几个变体,便宜的草稿改变了工作方式。

Lucas Fernandes
Lucas Fernandes工程经理, Light

同样的 JSON 结构,换个 model ID,Vidu Q2 API 是我们迁移中最顺的补充。

David Okonkwo
David Okonkwo联合创始人, Figment

当纯提示词工作流让你每周生成几千条片段时,Vidu Q2 API 低 15% 的价格感受就不一样。

常见问题

关于 Vidu Q2 API 文本生视频任务的常见问题。

Vidu Q2 API 文本生视频任务仅凭一段文本提示词生成片段,无需图片,也无需参考输入。你用文字描述画面,模型就渲染视频,适合创意转视频和高产量社媒片段。