产业 / 媒体
全栈国产算力训练,消费级显卡可跑
中国电信于9月17日正式发布并开源新一代星辰大模型Xing4.0-29B-A4B。该模型总参数量为29B,但激活参数仅4B,原生支持256K上下文长度,最高可扩展至512K。官方将其定位为国内首个基于国产算力与国产框架完成全流程训练、面向复杂工程任务深度优化的百亿参数大模型,从训练芯片到推理部署均采用昇腾算力与国产框架,实现全栈自主可控。在SuperCLUE智能体能力评测中,Xing4.0-29B-A4B以93.52分位列第三,与排名前两位的Qwen系列模型差距均不足1分。经4-bit量化后,模型显存占用降至15GB,RTX 3090、RTX 4090等24GB消费级显卡即可在本地运行长上下文任务。模型已同步上线HuggingFace、GitHub、魔搭、Gitee、魔乐等主流开源平台。
中国电信于9月17日发布新一代星辰大模型Xing4.0-29B-A4B,并同步在多个主流开源平台上线。该模型采用混合专家架构,总参数量达29B,但每次推理仅激活4B参数,在保持较强能力的同时大幅降低了计算开销。原生256K上下文支持、可扩展至512K的长文本处理能力,使其在处理复杂工程文档、长链路代码任务等场景中具备明显优势。
在自主可控层面,Xing4.0-29B-A4B是国内首个从训练到部署全程基于国产算力与国产框架完成的百亿参数大模型。训练阶段采用华为昇腾芯片,并完成国产框架适配;推理部署同样沿用自研架构体系。官方将这一路径概括为「昇腾训练、国产框架适配、自研架构、开源生态,一条路走通」,标志着国产大模型在全栈技术闭环上迈出实质性一步。
在第三方评测机构SuperCLUE的智能体能力榜单中,Xing4.0-29B-A4B以93.52分位列第三,与排名第一、第二的两款头部Qwen模型差距均不足1分。这一成绩表明,在Agent规划、工具调用、多步推理等核心能力维度上,星辰大模型已进入国内第一梯队,具备与主流闭源及开源旗舰模型正面竞争的实力。
在部署门槛方面,Xing4.0-29B-A4B经4-bit量化后显存占用仅为15GB,相比FP16精度节省约75%。这意味着RTX 3090、RTX 4090等24GB显存的消费级显卡即可在本地流畅运行该模型,并完成长上下文推理任务。较低的硬件门槛有助于模型在个人开发者、中小企业及科研机构中获得更广泛的落地应用。
生态兼容性方面,Xing4.0-29B-A4B对主流开源工具链进行了全面适配。微调框架支持LLaMA-Factory与MindFormers;推理框架兼容SGLang、vLLM、KTransformers;Agent框架层面则对OpenCode、Claude Code、OpenClaw、Hermes进行了定向适配调优,深度对齐各框架的格式规范。目前模型权重已上线HuggingFace、GitHub、魔搭、Gitee及魔乐等平台,开发者可直接获取使用。
要点
- Xing4.0-29B-A4B总参数29B、激活参数4B,原生支持256K超长上下文,是国内首个全栈国产算力训练的百亿参数大模型
- SuperCLUE智能体能力评测得分93.52,排名第三,与头部Qwen模型差距不足1分,进入国内第一梯队
- 4-bit量化后显存占用仅15GB,RTX 3090或RTX 4090等消费级显卡即可本地运行长上下文任务
- 全面兼容LLaMA-Factory、vLLM、SGLang等主流微调与推理框架,并对多个Agent框架进行定向适配
- 模型已在HuggingFace、GitHub、魔搭、Gitee、魔乐等平台同步开源,开发者可直接获取
原始标题:中国电信开源首个全栈国产轻量级智能体大模型 Xing4.0-29B-A4B
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。