chat.qwen3_5_122b_a10b
alibaba/qwen3-5-122b-a10b

Qwen3.5 122B A10B 是阿里 Qwen 出品的 MoE 大模型,122B 总参数、约 10B 激活,带 256K 上下文,推理、编程与多语言能力都很强。在 VibeToken 上通过兼容 OpenAI 的端点提供,输入 ¥0.34 / 1M、输出 ¥2.72 / 1M,比标准价低 15%。

Input
Qwen3.5 122B A10B
max_tokens4096
temperature1
top_p1
presence_penalty0
frequency_penalty0
Qwen3.5 122B A10B Online
Hi! I'm a helpful AI assistant. What can I do for you?

Qwen3.5 122B A10B API —— 122B MoE、10B 激活、256K 上下文

Qwen3.5 122B A10B API 运行 122B 总参数、约 10B 激活的 MoE 大模型,带 256K 上下文,推理、编程与多语言对话都很强。

Qwen3.5 122B A10B API 提供 Alibaba Qwen3.5 122B A10B,一个 122B 总参数、约 10B 激活的专家混合(MoE)大语言模型。稀疏路由让每个 token 只经过一小组专家,你用小模型的延迟与单 token 成本,拿到接近超大稠密网络的回答质量;256K token 上下文窗口能把长文件、对话记录与工具轨迹轻松装进一次调用,指令微调让回答直接、不跑题。你通过 VibeToken、以 OpenAI chat-completions 协议访问 Qwen3.5 122B A10B API,现有客户端指过来就能原样工作,没有新 SDK 要学,一把密钥覆盖整个目录。

在底层,Qwen3.5 122B A10B 针对多步推理、代码生成与审查、智能体工具调用、结构化 JSON 抽取以及覆盖 100+ 种语言的多语言助手做了针对性调优。计费为每百万输入 token ¥0.34、每百万输出 token ¥2.72,比 ¥0.40 / ¥3.20 的标价低 15%,按 token 计费,无每请求费,成本可预期。模型随生成流式返回 token,并以标准 OpenAI 模式返回工具调用,因此 Qwen3.5 122B A10B API 能直接接进智能体循环、IDE 助手与批处理流水线,无需编写厂商专属的胶水代码,从原型扩到生产都稳。

稀疏、长上下文、面向智能体

Qwen3.5 122B A10B API 给你什么

10B 激活预算下的旗舰级质量。

122B MoE、10B 激活

Qwen3.5 122B A10B API 让每个 token 只经过 1220 亿参数网络中的一小组专家,质量接近更大的稠密模型,延迟却保持很低。

256K 上下文

256K token 窗口让模型在一次调用里容纳长文件、对话记录与工具轨迹,因此你很少需要为 Qwen3.5 122B A10B API 切分输入。

扛得住的推理

Qwen3.5 世代强化了多步推理与指令遵循,Qwen3.5 122B A10B API 能啃下硬问题而不跑题。

编程与智能体

强代码生成、审查与智能体工具调用,让 Qwen3.5 122B A10B API 成为开发者工具与自动化流程的可靠骨干。

工具与 JSON

以标准 OpenAI 模式返回函数调用与结构化 JSON,Qwen3.5 122B A10B API 适配智能体与数据流水线。

流式、按 token

随生成流式返回 token,按 token 计费,输入 ¥0.34、输出 ¥2.72,比标价低 15%,无请求费。

RouterBase dashboard preview
开跑

三步完成对 Qwen3.5 122B A10B API 的首次调用

接一次线,之后随意流式。

  1. 创建密钥

    一把 VibeToken 密钥即可访问 Qwen3.5 122B A10B API 及目录里的每个模型,没有厂商专属的东西要配置。

  2. 指向客户端

    把任意 OpenAI 客户端发往 vibetoken.cn/v1,model=qwen/qwen3.5-122b-a10b,带上 messages 数组;Qwen3.5 122B A10B API 在同样的 chat-completions 形态上作答。

  3. 流式并盯用量

    模型随生成流式返回 token,并按响应返回 token 用量,因此每次调用 Qwen3.5 122B A10B API 的成本与延迟都可见。

定价

按使用量付费

VibeToken 透传合作方价格,与模型官方公开 API 价格对比。

定价

按使用量付费

VibeToken 透传合作方价格,与模型官方公开 API 价格对比。

分辨率VibeToken官方节省
Input (per 1M) ¥0.340¥0.400−15%
Output (per 1M) ¥2.720¥3.200−15%

本次请求费用 ¥0.340Input (per 1M))。¥1 大约可以调用本模型 2 次。

官方价 = Alibaba Qwen 对 Qwen3.5 122B A10B 的标价(每百万输入 ¥0.40、每百万输出 ¥3.20)。VibeToken 以 ¥0.34 / ¥2.72 提供 Qwen3.5 122B A10B API,比标价低 15%。

基于 Qwen3.5 交付

正在基于 Qwen3.5 122B A10B API 构建的团队

推理、智能体与对话同在一次调用背后。

Ingrid SolheimFjordline AI 负责人

我们把智能体栈迁到 Qwen3.5 122B A10B API,10B 激活预算让 p95 延迟几乎减半,质量不变。

Rafael OrtegaLumen Works 资深工程师

256K 上下文让 Qwen3.5 122B A10B API 一次读完整份设计文档加工具轨迹——再也不用切分。

Amara DialloKite Analytics CTO

标准模式的函数调用,意味着我们的智能体第一天就跑在 Qwen3.5 122B A10B API 上,零自定义解析。

Jonas Keller
Jonas KellerBrightpath 创始人

输入 ¥0.34、输出 ¥2.72,Qwen3.5 122B A10B API 让我们在流量攀升时把每任务成本保持可预期。

Mei-Ling ChouHarborlight 后端负责人

从 Qwen3.5 122B A10B API 流式很顺,我们的聊天 UI 逐 token 渲染,无需额外缓冲工作。

Viktor AntonovNorthgate 机器学习负责人

我们把代码审查与 JSON 抽取交给 Qwen3.5 122B A10B API,结构化输出每次都干净地返回。

Sofia MarchettiVellum Labs 首席工程师

推理质量让我们意外——Qwen3.5 122B A10B API 能啃下过去要用更贵模型才能做的多步工单。

Andre BoucherQuai Digital 创始人

从另一家切到 Qwen3.5 122B A10B API 只改了一个字符串——OpenAI 形态完全没动。

Lucia FerreiraMirante 工程经理

多语言覆盖正是我们统一到 Qwen3.5 122B A10B API 的原因;葡萄牙语与英语的回答一样出色。

Qwen3.5 122B A10B API —— 常见问题

把流量导过来之前该知道的。

它是 VibeToken 对 Alibaba Qwen3.5 122B A10B 的托管接入——一个 122B 总参数、10B 激活的 MoE 大模型,通过兼容 OpenAI 的端点提供。