阿里巴巴 Qwen3.8 发布:2.4万亿参数与百万Token上下文

新闻摘要
2026年8月3日美国东部时间上午9点,阿里巴巴正式发布了其最新的旗舰基础模型 Qwen3.8,将其定位为该公司迄今为止能力最强的大型语言模型。该模型的总参数量约为2.4万亿,基于稀疏混合专家架构构建。阿里巴巴表示,其基准测试结果使其跻身当前可用的最强通用模型之列,仅落后于少数来自其他实验室的领先前沿系统。
背景与发布时间线
2026年7月19日美国东部时间上午11点,阿里巴巴在一次公开技术展示会上首次预览了该模型的早期变体 Qwen3.8-Max Preview,并通过其云端Token计划为开发者提供了有限的早期访问权限。8月3日的公告标志着大约两周后的全面生产版本发布,阿里巴巴表示,随着其云生态系统中的应用不断普及,未来几周将提供更广泛的可用性并扩展工具支持。
技术能力
Qwen3.8 超越了文本处理,能够处理图像、视频和长文档,反映了行业向多模态基础模型的更广泛转变。该模型支持高达一百万Token的上下文窗口,使其能够处理冗长的文档、代码库和多轮对话,而不会丢失早期上下文。阿里巴巴强调了在编程辅助和专业办公生产力任务方面的显著提升,该公司表示,与之前的 Qwen 版本相比,这些领域在这一代中获得了最实质性的架构改进。
基准性能
在 CodeArena 排行榜(一个广泛引用的用于评估大型语言模型编程能力的社区基准测试)上,Qwen3.8 在所有测试模型中全球排名第四。在 OSWorld-Verified(一个衡量AI智能体自主操作计算机界面能力的基准测试)上,Qwen3.8-Max 变体得分为86.1,截至2026年8月初,在该特定测试中评估的主流模型中名列前茅。
定价与访问
阿里巴巴已通过其 Qwen AI 云平台以基于Token的定价计划提供该模型。据该公司称,其国际输入和输出的每Token定价远低于一些定价较高的竞争对手产品,并且该平台还为缓存的输入Token提供降价,以降低重复或上下文查询的成本。阿里巴巴表示,预计将在不久的将来发布该模型系列的轻量级开源变体(包括更小的参数配置),以扩大开发者社区的访问范围。
行业背景
此次发布是2026年中国科技公司大型模型发布浪潮的一部分,国内AI实验室继续推出强调多模态推理、编程能力和计算机使用智能体能力的旗舰系统。阿里巴巴对 Qwen 模型系列的持续投资,凸显了该公司提供具有竞争力定价和高上下文窗口模型的战略,旨在同时面向企业开发者及更广泛的全球研究社区。