系统极客一直在努力
专注操作系统及软件使用技能

Qwen3.6-Plus:走向现实世界智能体

Qwen3.6-Plus

Qwen3.6-Plus 正式上线!相较于前代模型,智能体(Agent)编程能力实现显著跃升。无论是前端网页开发,还是复杂的代码仓库级问题求解,都树立了全新的业界标杆(SOTA)。

模型对真实世界的感知更加精准,多模态推理能力也更为敏锐。它为开发者生态提供了高度稳定可靠的能力底座,也带来了真正具有变革意义的 Vibe Coding 体验。

Qwen3.6-Plus 的主要特性包括:

  • 默认支持 100 万上下文窗口
  • 大幅升级的智能体编程能力
  • 更优秀的多模态感知与推理能力
Qwen3.6-Plus 跑分

Qwen3.6-Plus 模型表现

自然语言

Qwen3.6-Plus 深度融合了推理、记忆与执行 3 大核心能力,在代码智能体、通用智能体和工具调用领域,均实现了全面跃升。

  • 在代码智能体领域:展现出了卓越的工程落地能力。它不仅在主流代码修复基准测试中紧追行业标杆,更在复杂终端操作、自动化任务执行场景中表现亮眼。
  • 在通用智能体和工具使用方面:模型实现了显著突破。它不仅在多个高难度长程规划任务中拿下了最优成绩,更在各类工具调用基准测试中也实现了全面领先。
  • 在通用能力上:Qwen3.6-Plus 依旧保持顶尖水准。无论是高难度的 STEM 推理、超长上下文的精准信息提取,还是多语言环境的广泛适配,模型都在多项关键评测中刷新了最佳表现。

Qwen3.6-Plus 的进步,不止体现在各项评测指标的全面超越,更在于它实现了深度逻辑推理、海量上下文记忆与精准工具执行能力的有机融合。这种「全能型」特质,让它能从容应对从复杂代码治理,到跨域长程规划的各类真实世界挑战,也标志着 Qwen 系列正加速向具备高度自主性的超级智能体演进。

Qwen3.6-Plus 基准测试

视觉语言

Qwen3.6-Plus 的多模态能力实现了进一步升级,核心围绕 3 大方向持续演进:推理能力增强、指令模式实用性提升、复杂任务执行能力拓展。

  • 在多模态推理方面:在复杂文档理解、物理世界视觉理解、视频推理、视觉编程等任务上,实现了稳定提升。模型能更高效地整合跨模态信息,并完成更复杂的分析与决策动作。
  • 在指令模式实用性方面:Qwen3.6-Plus 结合真实业务场景持续优化。它在指令遵循、疑难文字识别、万物识别、细粒度图像感知、真实场景理解等维度,都展现出更强的实用性与稳定性。

多模态能力的持续优化,其意义不止于提升单点任务的效果,更在于为复杂流程任务提供了更完整的能力支撑。随着理解、推理与执行能力的深度融合,Qwen3.6-Plus 正逐步演进成一个可在真实环境中持续感知、推理、行动的原生多模态智能体。

Qwen3.6-Plus 基准测试

开始使用 Qwen3.6-Plus

Qwen3.6-Plus 现已通过阿里云百炼的官方 API 正式开放。

你可以将 API 无缝集成到多款主流第三方编程助手中,包括 OpenClaw、Claude Code、Qwen Code、Kilo Code、Cline 和 OpenCode,从而简化开发流程,实现高效、具备上下文感知能力的编码体验。

API 使用方式

本次发布为 API 新增了一项核心功能,专门用来优化复杂多步任务的执行性能:

  • preserve_thinking:保留消息中所有前序轮次的思维内容,推荐用于智能体任务。
  • 该功能对智能体工作流、长周期任务尤为友好。完整的推理上下文,既能提升决策的一致性,在许多情况下还能减少重复推理,降低整体令牌消耗。
  • 该功能默认关闭(默认为false)。默认状态下,前序轮次的思维内容会被丢弃,只保留处理最新消息时生成的思维内容。
赞(0)
分享到

评论 抢沙发