模型 / 官方
首次将旗舰级模型能力开源
阿里巴巴通义团队正式推出Qwen3.8大语言模型系列,这是继Qwen3.5、Qwen3.6之后的最新一代开源模型。Qwen3.8最大的突破在于首次将Qwen-Max级别的旗舰模型能力以开源形式对外发布,目前已在Hugging Face Hub和ModelScope上提供Qwen3.8-27B及Qwen3.8-2.4T-A95B两款模型。新系列在编程、专业工作、科研以及长链路智能体任务上均有显著提升,并引入灵活的推理深度控制机制,支持通过reasoning_effort参数调节推理强度,同时通过preserve_thinking保留历史对话中的推理上下文。Qwen3.6则聚焦稳定性与实用性,重点强化了前端工作流和仓库级代码推理能力。Qwen3.5作为基础版本,支持201种语言,融合多模态训练与混合架构,为整个系列奠定技术底座。
阿里巴巴通义团队于2026年8月正式推出Qwen3.8大语言模型系列,这是该团队在Qwen3.5和Qwen3.6基础上的最新迭代。Qwen3.8最核心的意义在于,它首次将原本仅限于商业旗舰产品Qwen-Max的模型能力以开源形式向公众开放,标志着阿里巴巴在开源大模型领域迈出了重要一步。目前,Qwen3.8-27B已于8月14日上线,Qwen3.8-2.4T-A95B则于8月12日发布,均可通过Hugging Face Hub和ModelScope获取。
在核心能力方面,Qwen3.8在编程、专业工作、科研及长链路智能体任务上均实现了全面提升。模型的智能体执行能力得到强化,具备更强的自主规划能力和对环境反馈的处理能力,能够更可靠地将复杂多步骤任务执行到底。此外,Qwen3.8还扩大了对主流开发框架和工具链的兼容性,降低了开发者将其集成到现有技术栈的门槛。
Qwen3.8引入了灵活的推理控制机制,这是本次更新的一大亮点。开发者可以通过reasoning_effort参数动态调节模型的推理深度,在响应速度与推理质量之间灵活取舍。与此同时,preserve_thinking功能允许模型在多轮对话中保留历史消息中的推理上下文,避免重复推理带来的额外开销,对于需要迭代开发的场景尤为实用。
Qwen3.6作为系列中的中间版本,以稳定性和实际可用性为优先目标,重点回应了开发者社区的直接反馈。该版本在智能体编程方面表现突出,能够更流畅、精准地处理前端工作流和仓库级别的代码推理任务。新增的思维保留功能可在对话历史中持续保存推理上下文,有效简化了迭代开发流程,减少了不必要的重复计算。
作为整个系列的技术基础,Qwen3.5在多个维度实现了架构层面的突破。其统一的视觉语言基础通过在数万亿多模态token上进行早期融合训练,在推理、编程、智能体和视觉理解等基准测试上超越了此前的Qwen3-VL系列。混合架构方面,门控Delta网络与稀疏混合专家相结合,在保持高吞吐推理的同时将延迟和成本控制在较低水平。语言覆盖方面,Qwen3.5支持201种语言和方言,具备细粒度的文化与地区理解能力,为全球化部署提供了坚实支撑。
要点
- Qwen3.8首次将Qwen-Max旗舰级模型能力以开源形式发布,提供27B和2.4T-A95B两种规格,可通过Hugging Face Hub和ModelScope获取
- 新增灵活推理控制机制,支持通过reasoning_effort调节推理深度,preserve_thinking功能可跨对话轮次保留推理上下文
- Qwen3.6聚焦智能体编程场景,显著提升前端工作流和仓库级代码推理能力,并引入思维保留功能降低迭代开发成本
- Qwen3.5作为系列基础,支持201种语言,融合多模态早期融合训练与混合稀疏架构,在多项基准测试上超越前代VL模型
- 整个Qwen3.x系列均可通过Qwen Studio、Qoder等官方平台直接体验,也支持主流LLM框架本地部署
原始标题:QwenLM/Qwen3.8 — Qwen3.8 is the large language model series developed by Qwen team, Alibaba Group.
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。