QW

Qwen3.5 Plus

Qwen 发布 2026年2月16日 ImageTextVideoAudio qwen3-5-plus

模型简介

Qwen3.5 Plus 是 Qwen3.5 系列中的均衡版本,通常被介绍为原生视觉语言模型,并在托管服务中提供较强效率和较大上下文能力。官方和三方资料将它与图像/视频理解、通用文本任务和内置工具能力联系在一起。它处在 Flash 的速度取向和 Max 的能力取向之间。

规格与价格

上下文窗口
1M Token
最大输出
65.5K Token
输入价格
¥0.8/M
输出价格
¥4.8/M
发布日期
2026年2月16日
Token 阶梯
<=128K
输入价格
¥0.8/M
输出价格
¥4.8/M
缓存创建 5m
¥1/M
缓存读取 5m
¥0.08/M

API 能力

推理
支持
工具调用
支持
Temperature 参数
支持
附件
不支持
知识库
2025-04-01
Endpoint 协议
Completions API

模型亮点

Qwen3.5 Plus 结合原生多模态理解、通用推理与编程能力以及百万 Token 上下文,适合复杂工作负载。

Qwen3.5 Plus 模型亮点
Qwen3.5 Plus 结合原生多模态理解、通用推理与编程能力以及百万 Token 上下文,适合复杂工作负载。
通用推理
Plus 模型面向广泛的文本任务,可处理推理、指令遵循和代码生成。
原生多模态
文本、图像和视频由同一个视觉语言模型处理,可用于跨模态分析与推理。
长上下文分析
百万 Token 上下文窗口使托管模型能够关联大篇幅文档、媒体内容和对话历史中的信息。

适用场景

Qwen3.5 Plus 适合复杂研究、多模态文档处理,以及需要综合分析大量输入的软件开发任务。

Qwen3.5 Plus 使用场景
Qwen3.5 Plus 适合复杂研究、多模态文档处理,以及需要综合分析大量输入的软件开发任务。
多模态研究
综合报告、图表和视频中的信息,将不同格式的证据关联为结构化研究简报。
软件开发
分析需求和现有代码,为跨文件开发任务生成实现方案并说明修改内容。
文档智能处理
从包含文本、表格和嵌入式视觉材料的长文档中提取、比较并总结信息。

调用示例

from openai import OpenAI

client = OpenAI(
    base_url="https://api.tokiway.com/v1",
    api_key="YOUR_TOKIWAY_KEY",
)

resp = client.chat.completions.create(
    model="qwen3-5-plus",
    messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)

更多说明

Alibaba

Qwen3.8 Max

qwen3.8-max
TextImageVideo
Text

最大上下文

1M

最大输出

128K

发布日期

暂无

输入¥14 / 百万 Token
输出¥42 / 百万 Token

Qwen 的其他模型

QW
Qwen3.5 35B-A3B
Qwen
Qwen3.5 35B A3B 是一个原生视觉语言 MoE 模型,目标是在较小激活参数下接近更大模型的效果。模型卡强调混合线性注意力、稀疏专家,以及与更大 Qwen3.5 dense 版本相近的表现。它最适合被描述为兼顾效率、多模态推理和代码能力的轻量高效模型。
262.1K Token 上下文 65.5K Token 输出 2026年2月23日
输入¥0.4/M
输出¥3.2/M
QW
Qwen3.5 Flash
Qwen
Qwen3.5 Flash 是 Qwen3.5 原生视觉语言系列中的高效版本。阿里云模型列表将 Flash 定位为面向简单任务的快速、低成本选项,同时继承了 3.5 一代的多模态方向。它适合信息抽取、请求路由、轻量内容生成和高频调用。
262.1K Token 上下文 65.5K Token 输出 2026年2月23日
输入¥0.2/M
输出¥2/M
QW
Qwen3.6 35B-A3B
Qwen
Qwen3.6 35B A3B 是一个激活参数较小的 MoE 模型:相关来源描述为 35B 总参数、约 3B 激活参数,并具备可扩展到接近 1M token 的长上下文能力。官方资料还提到它在代码任务上可以与更大的 dense 模型竞争。它的核心价值是部署效率高,同时保留不错的代码和长上下文能力。
262.1K Token 上下文 65.5K Token 输出 2026年4月17日
输入¥1.8/M
输出¥10.8/M
QW
Qwen3.6 Flash
Qwen
Qwen3.6 Flash 是 Qwen3.6 系列中更强调速度的版本。相关来源提到它支持文本、图片和视频输入、Prompt Caching,以及 1M token 上下文窗口,这让它在快速模型里有较强的长上下文和多模态特征。它更适合高并发、多模态和长上下文任务中对速度与成本敏感的场景。
1M Token 上下文 65.5K Token 输出 2026年4月27日
输入¥1.2/M
输出¥7.2/M
QW
Qwen3.6 Max Preview
Qwen
Qwen3.6 Max 通常被视为 Qwen3.6 一代中更高能力的档位。可参考的三方资料强调大规模稀疏 MoE 架构、更强的 Agentic Coding,以及面向工具调用的行为。它的描述应聚焦软件工程、推理和自主工作流执行,而不是只写“更好的文本生成”。
262.1K Token 上下文 65.5K Token 输出 2026年4月20日
输入¥9/M
输出¥54/M
QW
Qwen3.6 Plus
Qwen
Qwen3.6 Plus 的介绍重点在混合线性注意力与稀疏 MoE 架构,并强调 Agentic Coding、前端开发和推理任务的提升。公开模型卡提到仓库级任务、交互式前端生成,以及 SWE 类评测表现。它的定位更接近开发者与生产力模型,而不只是普通对话助手。
1M Token 上下文 65.5K Token 输出 2026年4月2日
输入¥2/M
输出¥12/M