阿里巴巴发布 Qwen3.8-27B:面向本地 AI 部署的 270 亿参数开源多模态模型

新闻摘要
阿里巴巴通义千问团队发布了 Qwen3.8-27B 的开放权重,这是一个拥有 270 亿参数的稠密多模态模型,现已在 Hugging Face 和 ModelScope 上以 Apache 2.0 许可证免费提供下载。此次发布距离阿里巴巴首次开放其规模更大的旗舰模型 Qwen3.8-Max 的权重约十天时间,这款紧凑型模型的推出圆满完成了 Qwen3.8 世代的产品布局,使开发者能够在单张高端 GPU 上而非数据中心集群中运行该模型。
发布内容详情
Qwen3.8-27B 是一款稠密(非混合专家)模型,这意味着在每次推理过程中,其全部 270 亿参数均处于激活状态;相比之下,稀疏架构的 Qwen3.8-Max 在 2.4 万亿总参数中,每个 token 仅激活 950 亿参数。该模型原生支持多模态,可接受文本、图像和视频输入,并支持高达 262,144 个 token 的上下文窗口。2026 年 8 月 13 日至 14 日(美国东部时间),阿里巴巴在 Hugging Face 的官方 Qwen/Qwen3.8-27B 仓库中发布了模型权重,包括 FP8 和 NVFP4 量化版本;与此同时,社区贡献的量化版本也在发布后数小时内陆续上线。
为何 270 亿参数稠密模型至关重要
今年 AI 行业大多数显著的能力跃升主要源自庞大的混合专家系统,而这些系统通常需要多卡 GPU 服务器机架才能运行。Qwen3.8-27B 则面向不同的受众群体:研究人员、初创公司和爱好者,他们希望在现有硬件(如单张工作站 GPU)上获得强大的推理和编程性能。该模型基于早期 Qwen3.5 系列的架构基础构建,定位为一种易于部署的选项,适用于本地推理、智能体工作流以及无需 Max 级基础设施的微调实验。
基准测试表现
阿里巴巴表示,Qwen3.8-27B 相较于前代产品 Qwen3.7-Plus 有所提升,尤其在编程任务和实际办公生产力场景中表现更为突出。独立评测指出,该模型在多个基准测试套件中的成绩均优于早期的 Qwen3.6-27B,同时保持了相似的公开解码器架构,这使其成为截至 2026 年 8 月中旬 300 亿参数级别中最强的开源稠密模型之一。
背景:Qwen3.8 系列的全面推出
Qwen3.8-27B 是两轮开放权重发布计划的后半部分。阿里巴巴于 2026 年 7 月中旬首次预览了 Qwen3.8-Max,并于 2026 年 8 月 3 日(美国东部时间)发布了其开放权重,使其成为首款以开放权重形式发布的 Max 级通义千问模型。在 Terminal-Bench 2.1、OSWorld-Verified 和 OmniDocBench 等基准测试轮次中,Qwen3.8-Max 取得了可与更广泛 AI 研究社区中其他前沿模型相媲美的分数,评测人员特别强调了其在多模态文档理解和计算机操作智能体任务中的优异表现。270 亿参数版本的发布为开发者提供了一个轻量级的入门选择,与旗舰模型形成互补,从而完善了这一代产品的布局。
可用性与许可协议
Qwen3.8-27B 和 Qwen3.8-Max 均采用 Apache 2.0 许可证分发,允许商业使用、修改和再分发,且无需支付版税。用户可直接从 Hugging Face 和 ModelScope 下载模型权重,多位第三方贡献者也已发布了量化版本(包括 FP8 和 NVFP4 格式),以降低本地部署所需的内存占用。