阿里通义千问发布升级版推理模型 Qwen3-30B-A3B-Thinking-2507

阿里通义千问推出升级版推理模型 Qwen3-30B-A3B-Thinking-2507,在推理能力、通用能力及上下文长度上均有显著提升,支持更长的上下文理解和更复杂的推理任务。

10效率工具阿里通义千问推理模型性能提升上下文理解

模型概述

阿里通义千问近日发布了全新推理模型 Qwen3-30B-A3B-Thinking-2507,相较于之前的 Qwen3-30-A3B 模型,新模型在多个方面实现了显著进步。

性能提升

  • 在数学能力评测 AIME25 中获得 85.0 分,代码能力测试 LiveCodeBench v6 中得分 66.0,均超越 Gemini2.5-Flash(thinking)和 Qwen3-235B-A22B(thinking)。
  • 知识水平(GPQA、MMLU-Pro)较上一版本有显著提升。
  • 通用能力评测中,包括写作、Agent 能力、多轮对话和多语言指令遵循等方面均超越前代模型。

上下文理解与思考长度

新模型原生支持 256K tokens,可扩展至 1M tokens,适用于更长的上下文理解。同时,思考长度增加,官方推荐在复杂推理任务中设置更长的思考预算。

阿里通义千问推出全新推理模型 Qwen3-30B-A3B-Thinking-2507插图

部署与上线

Qwen3-30B-A3B-Thinking-2507 已在魔搭社区、HuggingFace 上开源,支持消费级硬件本地部署。同时,该模型已在 Qwen Chat 上同步上线。