chat.qwen3_5_35b_a3b
alibaba/qwen3-5-35b-a3b

Qwen3.5 35B A3B 是阿里 Qwen 出品的专家混合对话模型,35B 总参数、约 3B 激活,快速低成本,适合对话、编程与多语言场景。在 VibeToken 上通过兼容 OpenAI 的端点提供,输入 ¥0.213 / 1M、输出 ¥1.70 / 1M,比标准价低 15%。

Input
Qwen3.5 35B A3B
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Qwen3.5 35B A3B Online
Hi! I'm a helpful AI assistant. What can I do for you?

Qwen3.5 35B A3B API —— 高效 MoE,3B 激活

Qwen3.5 35B A3B API 运行 35B 总参数、约 3B 激活的 Qwen3.5 专家混合模型,面向快速、低成本的对话、编程与多语言场景。

Qwen3.5 35B A3B API 提供 Alibaba Qwen3.5 35B A3B,一个 350 亿总参数、每个 token 只激活约 30 亿的专家混合(MoE)大语言模型。路由器在推理的每一步只挑选一小部分最相关的专家参与计算,因此模型以小网络的延迟与成本作答,却能调用大得多的知识储备。这种平衡让 Qwen3.5 35B A3B API 非常适合高并发对话、草稿撰写、摘要、编程辅助与多语言助手,在高频调用里,速度与单价的平衡正是这类稀疏架构模型的核心价值所在。

你通过 VibeToken、以 OpenAI chat-completions 协议访问 Qwen3.5 35B A3B API,现有客户端指过来即可原样工作,一把密钥覆盖整个目录。按 token 计费,每百万输入 token ¥0.213、每百万输出 token ¥1.70,比 ¥0.25 / ¥2.00 的标价低 15%,无每请求费。流式输出与标准工具调用让你把该 API 接进智能体、IDE 助手或批处理流水线,对话历史与结构化输出都走同一个端点,而不用写任何厂商专属的胶水代码,每一次调用的用量与费用都能在控制台里一目了然地看到。

稀疏、快速、划算

Qwen3.5 35B A3B API 给你什么

大模型的知识,小模型的成本。

高效 MoE 设计

Qwen3.5 35B A3B API 跑一个 35B 总参数、约 3B 激活的专家混合网络,回答既有深度,又不用付出稠密模型的延迟。

Qwen3.5 世代

基于 Qwen3.5 系列,模型的指令遵循与推理都比早期紧凑版 Qwen 更强,端点形态保持不变。

快且省

每个 token 只激活一小部分参数,Qwen3.5 35B A3B API 延迟低,输入 ¥0.213、输出 ¥1.70,比标价低 15%。

多语言对话

模型覆盖英语、中文等多种语言,Qwen3.5 35B A3B API 适合多语言助手、翻译与客服支持。

工具与 JSON

Qwen3.5 35B A3B API 以标准 OpenAI 模式返回函数调用与结构化 JSON,适配智能体与数据流水线。

流式、按 token

响应随生成分块流式返回,按 token 计费,无请求费,成本随用随见。

RouterBase dashboard preview
开跑

三步完成对 Qwen3.5 35B A3B API 的首次调用

接一次线,之后随意流式。

  1. 创建密钥

    一把 VibeToken 密钥即可访问 Qwen3.5 35B A3B API 及目录里的每个模型,没有厂商专属的东西要配置。

  2. 指向客户端

    把任意 OpenAI 客户端发往 vibetoken.cn/v1,model=qwen/qwen3.5-35b-a3b,带上 messages 数组;Qwen3.5 35B A3B API 在同样的 chat-completions 形态上作答。

  3. 流式并盯用量

    模型随生成流式返回 token,并按响应返回用量,因此每次调用 Qwen3.5 35B A3B API 的成本与延迟都可见。

定价

按使用量付费

VibeToken 透传合作方价格,与模型官方公开 API 价格对比。

定价

按使用量付费

VibeToken 透传合作方价格,与模型官方公开 API 价格对比。

分辨率VibeToken官方节省
Input (per 1M) ¥0.213¥0.250−15%
Output (per 1M) ¥1.700¥2.000−15%

本次请求费用 ¥0.213Input (per 1M))。¥1 大约可以调用本模型 4 次。

官方价 = Alibaba Qwen 对 Qwen3.5 35B A3B 的标价(每百万输入 ¥0.25、每百万输出 ¥2.00)。VibeToken 以 ¥0.213 / ¥1.70 提供 Qwen3.5 35B A3B API,比标价低 15%。

基于 Qwen3.5 交付

正在基于 Qwen3.5 35B A3B API 构建的团队

小模型成本,大模型知识。

Ingrid Solberg平台负责人, Fjordline

我们把客服对话导到 Qwen3.5 35B A3B API,延迟降到客服都感觉不到模型在环里。

Rafael OrtegaCTO, Lumen Foundry

输入 ¥0.213、输出 ¥1.70,Qwen3.5 35B A3B API 让我们把摘要量翻三倍而预算不动。

Aisha Bello工程负责人, Kite Systems

3B 激活是关键——Qwen3.5 35B A3B API 答得像更大的模型,却几乎瞬间流回。

Petr HavelStaff Engineer, Moravia Labs

函数调用按标准模式返回,我们的智能体栈在 Qwen3.5 35B A3B API 上零自定义解析地跑了起来。

Yuki TanakaML 工程师, Harborline

我们对每个版本都做基准,Qwen3.5 35B A3B API 在当前技术栈里性价比最高。

Camille Roche创始人, Atelier Nord

从稠密模型切到 Qwen3.5 35B A3B API 只改了一个字符串,草稿工具明显更跟手了。

Sofia Marino产品工程师, Vellum Works

多语言回答同样出色,这就是我们的本地化聊天今天跑在 Qwen3.5 35B A3B API 上的原因。

Jonas Weber后端负责人, Glaswerk

从 Qwen3.5 35B A3B API 流式很顺,我们的 UI 逐 token 渲染,无需额外缓冲。

Nadia Rahman工程经理, Quill Stack

过去要大模型才能搞定的 JSON 抽取任务,现在在 Qwen3.5 35B A3B API 上用零头成本就能过。

Qwen3.5 35B A3B API —— 常见问题

把流量导过来之前该知道的。

它是 VibeToken 对 Alibaba Qwen3.5 35B A3B 的托管接入——一个 35B 总参数、约 3B 激活的专家混合对话模型,通过兼容 OpenAI 的端点提供。