chat.qwen2_5_72b_instruct
alibaba/qwen2-5-72b-instruct

Qwen2.5 72B Instruct 是阿里 Qwen 出品的稠密 72B 指令微调大模型,带 128K 上下文,多语言、编程与数学能力都很强。在 VibeToken 上通过兼容 OpenAI 的端点提供,输入 ¥0.38 / 1M、输出 ¥0.40 / 1M,比标准价低 5%。

Input
Qwen2.5 72B Instruct
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Qwen2.5 72B Instruct Online
Hi! I'm a helpful AI assistant. What can I do for you?

Qwen2.5 72B Instruct API —— 稠密 72B,128K 上下文

Qwen2.5 72B Instruct API 运行 Qwen2.5 72B Instruct,一个稠密的 72B 指令微调大模型,带 128K 上下文,在多语言对话、编程与数学上都很强。

Qwen2.5 72B Instruct API 提供 Alibaba Qwen2.5 72B Instruct,一个稠密的 720 亿参数指令微调大语言模型。专家混合(MoE)架构会让每个 token 只经过一小部分权重,而这个模型跑的是完全稠密的网络,因此每个参数都参与到每个 token。这带来跨对话、编程、数学与推理的稳定、可预期的质量,而 128K token 上下文窗口意味着长文件、对话记录与工具轨迹都能装进一次调用。你通过 VibeToken、以 OpenAI chat-completions 协议访问 Qwen2.5 72B Instruct API,因此你已经在用的客户端指过来那一刻就能原样工作。没有新 SDK 要学,也不用在不同厂商间倒腾配额——一把密钥覆盖整个目录,你在别处发的同样请求体,会从这个端点返回同样的响应结构。

在底层,Qwen2.5 72B Instruct 面向开发者真正要交付的活儿做了调优:跨 29+ 种语言的多语言助手、代码生成与审查、结构化 JSON 抽取以及多步工具调用。Qwen2.5 72B Instruct API 把这些都放在一个端点、一把密钥背后回答。计费为每百万输入 token ¥0.38、每百万输出 token ¥0.40,比 ¥0.40 输入 / ¥0.42 输出的标价低 5%,按 token 计费,无每请求费。因为模型随生成流式返回 token,并以标准 OpenAI 模式返回工具调用,你可以把 Qwen2.5 72B Instruct API 接进智能体循环、IDE 助手或批处理流水线,而不用写厂商专属的胶水代码。看重长上下文与多语言覆盖的团队往往最先选它,稠密架构让延迟与质量在你从原型扩展到生产流量时保持稳定。

稠密、长上下文、多语言

Qwen2.5 72B Instruct API 给你什么

每个 token 都是深思熟虑的质量。

稠密 72B 模型

请参见描述。Qwen2.5 72B Instruct API 跑完全稠密的 720 亿参数网络,因此在对话、编程与推理上质量一致,没有专家路由带来的意外。

128K 上下文

128K token 窗口让模型在一次调用里容纳长文件、对话记录与工具轨迹,因此你很少需要为 Qwen2.5 72B Instruct API 切分输入。

天生多语言

在 29+ 种语言上训练,Qwen2.5 72B Instruct API 能处理英语、中文以及数十种语言,用于多语言对话、翻译与支持。

编程与数学

强代码生成、审查与数学推理,让 Qwen2.5 72B Instruct API 成为开发者工具与技术助手的可靠骨干。

工具与 JSON

以标准 OpenAI 模式返回函数调用与结构化 JSON,Qwen2.5 72B Instruct API 适配智能体与数据流水线。

流式、按 token

随生成流式返回 token,按 token 计费,输入 ¥0.38、输出 ¥0.40,比标价低 5%,无请求费。

RouterBase dashboard preview
开跑

三步完成对 Qwen2.5 72B Instruct API 的首次调用

接一次线,之后随意流式。

  1. 创建密钥

    一把 VibeToken 密钥即可访问 Qwen2.5 72B Instruct API 及目录里的每个模型,没有厂商专属的东西要配置。

  2. 指向客户端

    把任意 OpenAI 客户端发往 vibetoken.cn/v1,model=qwen/qwen-2.5-72b-instruct,带上 messages 数组;Qwen2.5 72B Instruct API 在同样的 chat-completions 形态上作答。

  3. 流式并盯用量

    模型随生成流式返回 token,并按响应返回 token 用量,因此每次调用 Qwen2.5 72B Instruct API 的成本与延迟都可见。

定价

按使用量付费

VibeToken 透传合作方价格,与模型官方公开 API 价格对比。

定价

按使用量付费

VibeToken 透传合作方价格,与模型官方公开 API 价格对比。

分辨率VibeToken官方节省
Input (per 1M) ¥0.380¥0.400−5%
Output (per 1M) ¥0.400¥0.420−5%

本次请求费用 ¥0.380Input (per 1M))。¥1 大约可以调用本模型 2 次。

官方价 = Alibaba Qwen 对 Qwen2.5 72B Instruct 的标价(每百万输入 ¥0.40、每百万输出 ¥0.42)。VibeToken 以 ¥0.38 / ¥0.40 提供 Qwen2.5 72B Instruct API,比标价低 5%。

基于 Qwen2.5 交付

正在基于 Qwen2.5 72B Instruct API 构建的团队

多语言对话与编程同在一次调用背后。

Marisol ReyesHead of AI, Cardinal

我们把多语言支持机器人迁到 Qwen2.5 72B Instruct API,128K 上下文让我们一夜之间不再切分长对话历史。

Tobias FrankStaff Engineer, Halden

稠密权重让输出可预期——Qwen2.5 72B Instruct API 在每个工单上给出同样的质量,我们的评测很喜欢。

Priya DeshpandeCTO, Meridian Labs

标准模式的函数调用,意味着我们的智能体栈第一天就跑在 Qwen2.5 72B Instruct API 上,零自定义解析。

Omar HaddadFounder, Sable

输入 ¥0.38、输出 ¥0.40,Qwen2.5 72B Instruct API 让我们在一季度流量攀升时把每 token 成本压得很平。

Klara NovakBackend Lead, Vireo

从 Qwen2.5 72B Instruct API 流式很顺,我们的聊天 UI 逐 token 渲染,无需额外缓冲工作。

Daniel OkaforML Lead, Beacon Grid

我们把代码审查与 JSON 抽取交给 Qwen2.5 72B Instruct API,结构化输出每次都干净地返回。

Hana KimPrincipal Engineer, Northwind

128K 窗口让 Qwen2.5 72B Instruct API 一次读完整个服务文件加它的测试,加快了我们的评审。

Leo FontaineFounder, Coteau

从另一家切到 Qwen2.5 72B Instruct API 只改了一个字符串——OpenAI 形态完全没动。

Mateus AlvesEngineering Manager, Praia Tech

多语言覆盖正是我们统一到 Qwen2.5 72B Instruct API 的原因;葡萄牙语与英语的回答一样出色。

Qwen2.5 72B Instruct API —— 常见问题

把流量导过来之前该知道的。

它是 VibeToken 对 Alibaba Qwen2.5 72B Instruct 的托管接入——一个稠密的 72B 指令微调大模型,通过兼容 OpenAI 的端点提供。