阿里云Qwen3-235B-A22B-FP8旗舰版更新:性能大幅提升,超越行业标杆

阿里云近日发布了Qwen3-235B-A22B-FP8旗舰版模型,通过优化训练模式,全面提升性能,在多项测评中超越Kimi、DeepSeek等行业顶尖模型。该版本具备多语言长尾知识覆盖、用户偏好契合能力及长文本理解等优势,已在魔搭社区和HuggingFace上开源。

10效率工具阿里云Qwen3性能提升模型更新开源

性能全面升级,超越行业顶尖模型

阿里云最新发布的Qwen3-235B-A22B-FP8旗舰版模型,经过对训练模式的优化,在指令遵循、逻辑推理、文本理解等方面表现优异,超越了Kimi-K2、DeepSeek-V3等行业顶尖模型,以及Claude-Opus4-Non-thinking等领先闭源模型。

阿里云通义千问 Qwen 3 旗舰版模型宣布更新:性能全面提升,超越 Kimi、DeepSeek 等行业顶尖水平插图

功能特点与性能增强

  • 类型:因果语言模型 / 自回归语言模型
  • 训练阶段:预训练与后训练
  • 参数量:235B,激活22B
  • 层数:94
  • 上下文长度:原生支持262,144

新版本在多语言长尾知识覆盖、用户偏好契合能力以及长文本理解等方面均取得显著进步。

此外,Qwen3-235B-A22B-FP8在主观及开放性任务中表现出色,能够提供更有用的回复,生成更高质量的文本。

阿里云通义千问 Qwen 3 旗舰版模型宣布更新:性能全面提升,超越 Kimi、DeepSeek 等行业顶尖水平插图1

开源与社区

Qwen3新模型已在魔搭社区和HuggingFace上开源更新,方便用户获取和使用。