系统极客一直在努力
专注操作系统及软件使用技能

Qwen3.6-35B-A3B 开源:智能体编程利器

Qwen

Qwen3.6-Plus 发布之后,阿里千问正式开源了 Qwen3.6-35B-A3B。这是一款混合专家(MoE)架构的稀疏大模型,总参数量 35B,单轮激活参数仅 3B。

凭借轻量化的激活设计,Qwen3.6-35B-A3B 在智能体编程赛道实现了越级表现:

  • 核心指标大幅超越前代 Qwen3.5-35B-A3B,综合能力对标 Qwen3.5-27B、Gemma-31B 等参数量高出一个量级的稠密模型。
  • 模型原生支持多模态输入,完整保留思考/非思考双模式,现已同步上线 Qwen Studio,开放 API 调用与开源权重。
Qwen3.5-35B-A3B 基准测试
Qwen3.5-35B-A3B 基准测试

模型表现

自然语言

仅 3B 激活参数的 Qwen3.6-35B-A3B,在多项核心编程基准上实现了对 Qwen3.5-27B 稠密模型的反超。在智能体编程、长链路推理等核心任务上,其表现较前代 Qwen3.5-35B-A3B 有了显著提升。

Qwen3.5-27BGemma4-31BQwen3.5-35BA3BGemma4-26BA4BQwen3.6-35BA3B
Coding Agent
SWE-bench Verified75.052.070.017.473.4
SWE-bench Multilingual69.351.760.317.367.2
SWE-bench Pro51.235.744.613.849.5
Terminal-Bench 2.041.642.940.534.251.5
Claw-Eval Avg64.348.565.458.868.7
Claw-Eval Pass^346.225.051.028.050.0
SkillsBench Avg527.223.64.412.328.7
QwenClawBench52.241.747.738.752.6
NL2Repo27.315.520.511.629.4
QwenWebBench1068119797811781397
General Agent
TAU3-Bench68.467.568.959.067.2
VITA-Bench41.843.029.136.935.6
DeepPlanning22.624.022.816.225.9
Tool Decathlon31.521.228.712.026.9
MCPMark36.318.127.014.237.0
MCP-Atlas68.457.262.450.062.8
WideSearch66.435.259.138.360.1
Knowledge
MMLU-Pro86.185.285.382.685.2
MMLU-Redux93.293.793.392.793.3
SuperGPQA65.665.763.461.464.7
C-Eval90.582.690.282.590.0
STEM & Reasoning
GPQA85.584.384.282.386.0
HLE24.319.522.48.721.4
LiveCodeBench v680.780.074.677.180.4
HMMT Feb 2592.088.789.091.790.7
HMMT Nov 2589.887.589.287.589.1
HMMT Feb 2684.377.278.779.083.6
IMOAnswerBench79.974.576.874.378.9
AIME2692.689.291.088.392.7

视觉语言

Qwen3.6 系列原生支持多模态输入,在绝大多数视觉语言基准测试中,它的表现与 Claude Sonnet 4.5 持平,部分任务实现超越。空间智能赛道的优势尤为明显:RefCOCO 得分 92.0,ODInW13 得分 50.8。

Qwen3.5-27BClaude-Sonnet-4.5Gemma4-31BGemma4-26BA4BQwen3.5-35B-A3BQwen3.6-35B-A3B
STEM and Puzzle
MMMU82.379.680.478.481.481.7
MMMU-Pro75.068.476.9*73.8*75.175.3
Mathvista(mini)87.879.879.379.486.286.4
ZEROBench_sub36.226.326.026.334.134.4
General VQA
RealWorldQA83.770.372.372.284.185.3
MMBenchEN-DEV-v1.192.688.390.989.091.592.8
SimpleVQA56.057.652.952.258.358.9
HallusionBench70.059.967.466.167.969.8
Text Recognition and Document Understanding
OmniDocBench1.588.985.880.174.489.389.9
CharXiv(RQ)79.567.267.969.077.578.0
CC-OCR81.068.175.774.580.781.9
AI2D_TEST92.987.089.088.392.692.7
Spatial Intelligence
RefCOCO(avg)90.989.292.0
ODInW1341.142.650.8
EmbSpatialBench84.571.883.184.3
RefSpatialBench67.763.564.3
Video Understanding
VideoMME(w sub.)87.081.186.686.6
VideoMME(w/o sub.)82.875.382.582.5
VideoMMMU82.377.681.676.080.483.7
MLVU85.972.885.686.2
MVBench74.674.874.6
LVBench73.671.471.4

使用 Qwen3.6-35B-A3B

开源权重现已上线 Hugging FaceModelScope,支持完整本地部署;也可通过阿里云百炼 API 以qwen3.6-flash名称直接调用,或在 Qwen Studio 中完成开箱即用的快速体验。

模型可无缝接入 OpenClaw、Claude Code 和 Qwen Code 等主流编程助手工具链,简化开发流程,实现带完整上下文感知的编码体验。

API 使用方式

本次发布支持preserve_thinking功能:可完整保留对话历史中所有前序轮次的思维内容,推荐优先用于长链路智能体任务。

赞(0)
分享到

评论 抢沙发