DeepSeek V4 Flash API 给了我们的助手新一代的质量,速度还是用户能真切感受到的。
DeepSeek V4 Flash 是最新一代 DeepSeek 的快速低价档——为低延迟与高并发调校,编程强、工具调用可靠。在 VibeToken 上通过兼容 OpenAI 的端点提供,输入 ¥0.14 / 1M、输出 ¥0.28 / 1M,缓存输入仅 ¥0.0028;当任务需要顶配时,升级到 DeepSeek V4 Pro。
DeepSeek V4 Flash API —— DeepSeek V4 的快速低价档
DeepSeek V4 Flash API 提供 DeepSeek V4 Flash,即最新一代 DeepSeek 的速度与成本档——为延迟敏感、高并发的工作而建。
DeepSeek V4 Flash 是最新一代 DeepSeek 的 Flash 档:为低延迟、低成本调校,让一个称职的模型能坐进实时链路与高并发批处理。DeepSeek V4 Flash API 让回复保持快、账单保持小——每百万输入 token ¥0.14、输出 ¥0.28,缓存输入仅 ¥0.0028——而当某个任务需要顶配时,DeepSeek V4 Pro 只需一次调用即可。强编程加可靠的工具调用,让它成为助手与流水线务实的默认之选。
你通过 VibeToken、以 OpenAI chat-completions 协议访问 DeepSeek V4 Flash API;把模型设为 deepseek-v4-flash,客户端无需改动。DeepSeek V4 Flash API 计费为每百万输入 ¥0.14、输出 ¥0.28、缓存输入 ¥0.0028——比标价低 5%,一把密钥贯通整个目录。
DeepSeek V4 Flash API 给你什么
一个跟得上流量、又省钱的称职模型。
新一代 Flash 档
DeepSeek V4 Flash API 是最新一代 DeepSeek 的快速低价档。
为速度而建
低延迟让 DeepSeek V4 Flash API 能坐进在线请求,而不再只是后台任务。
账单小
输入 ¥0.14、输出 ¥0.28,DeepSeek V4 Flash API 便宜到足以支撑高并发——比标价低 5%。
近乎免费的缓存读取
缓存输入每百万仅 ¥0.0028,因此在 DeepSeek V4 Flash API 上重复的上下文几乎不花钱。
编程与工具
强编程加可靠的函数调用,让 DeepSeek V4 Flash API 成为助手与智能体务实的骨干。
与 V4 Pro 搭配
把日常工作路由到 DeepSeek V4 Flash API,当某个任务需要顶配时再升级到 DeepSeek V4 Pro。

三步完成对 DeepSeek V4 Flash API 的首次调用
接入快,作答也快。
创建密钥
一把 VibeToken 密钥即可访问 DeepSeek V4 Flash API 及目录里的每个模型。
指向并命名
把任意 OpenAI 客户端发往 vibetoken.cn/v1,model=deepseek-v4-flash。流式与函数调用开箱即用。
盯住延迟与成本
DeepSeek V4 Flash API 随每个响应返回用量,吞吐与花费按次可见。
按使用量付费
VibeToken 透传合作方价格,与模型官方公开 API 价格对比。
正在基于 DeepSeek V4 Flash API 构建的团队
跟得上流量的新一代质量。
输入 ¥0.14,DeepSeek V4 Flash API 让我们在每次请求上都放一个称职模型,还不用盯着账单。
缓存读取 ¥0.0028,意味着我们在 DeepSeek V4 Flash API 上重复的上下文基本免费。
日常流量跑在 DeepSeek V4 Flash API 上,只有必须时才升级到 V4 Pro。
低延迟让我们在 DeepSeek V4 Flash API 上撤掉了加载态。
函数调用很可靠,于是我们整个工具层都跑在 DeepSeek V4 Flash API 上。
相较旧模型只改了一个字符串;DeepSeek V4 Flash API 当天就更快也更便宜。
DeepSeek V4 Flash API 即便在高峰也把我们的 p95 压得很低,这正是我们选它的原因。
我们把默认对话换成 DeepSeek V4 Flash API,用户只察觉到它变快了。
DeepSeek V4 Flash API —— 常见问题
把流量导过来之前该知道的。
VibeToken 对 DeepSeek V4 Flash 的托管接入——最新一代 DeepSeek 的快速低价档,通过兼容 OpenAI 的端点提供。