消费级显卡就能跑!首个全栈国产轻量级智能体大模型Xing4.0-29B-A4B开源并上线魔乐社区
做大模型,一定得是大参数、贵算力、难部署吗?一定得依赖国外芯片、国外框架才能跑出好成绩吗?中国电信的人工智能公司给出了另一种答案。
9月17日,中电信人工智能科技有限公司正式发布新一代星辰大模型:Xing4.0-29B-A4B。 Xing4.0 在历经原TeleChat三代研发的基础之上全面升级,延续坚持全栈国产自主研发的技术底色,从模型架构、训练Infra到能力范式实现全面跃迁。Xing4.0-29B-A4B总参数量 29B,激活参数仅 4B,原生支持 256K 上下文,可扩展至 512K,是国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型。
Xing4.0-29B-A4B 真正做到了一张消费级显卡就能本地跑起来,同时在编码、规划、工具调用这些智能体最看重的硬功夫上,成绩单“越级”对标国际主流。更关键的是,从训练芯片到推理部署,全栈国产——昇腾训练、国产框架适配、自研架构、开源生态,一条路走通。它想做的事只有一件:让“会做事的 AI”,成为人人用得起、靠得住的标配。
该模型开源权重已同步上线魔乐社区 ,欢迎开发者下载体验!
🔗 模型权重链接:
https://modelers.cn/models/XingChen-AGI/Xing4.0-29B-A4B
01
它凭什么称“新一代”?
过去我们说大模型是“百科全书”——你问,它答。 现在我们说大模型是“执行者”——你给一个目标,它帮你把事情做完。
Xing4.0 带来的正是这种变化:从“会回答”走向“会做事”。它不再只是回答问题的助手,而是能拆任务、调工具、跑链路、交付结果的“行动大脑”。
但这并非凭空而来。从 2023 年 TeleChat 百亿参数大模型在世界人工智能大会发布、成为首个发布大模型能力的国企,到 TeleChat-7B 作为国央企首家对外开源、同步开源 1T 中文训练数据;从 TeleChat2-115B 成为首个完全国产算力训练并开源的千亿参数模型、完成万卡集群万亿参数 MOE 突破,到 TeleAI-t1 以强化学习实现推理能力跃升、评分超 o1-preview,再到 TeleChat3 系列开源首个细粒度 MoE 模型和代码模型——三代技术积累,一步一个台阶,才走到今天。

如今,Xing4.0 将这些积累凝聚于一个 29B 的轻量模型。为了让“做事”靠谱,它在架构上做了重构:采用 mHC+MLA+MTP 架构,可高效处理长程 Agent 任务,支持多步骤规划、工具调用和复杂推理链路执行,保障长会话上下文下任务逻辑连贯、执行稳定——这正是智能体场景最考验模型的地方。完成从“通用大模型”到“智能体大模型”的关键跃迁。
02
才 29B,能打吗?
小,是不是意味着弱?直接把成绩单甩出来:

-
在编码Agent方面,Xing4.0-29B-A4B 在 SWE-bench Verified(75.0)、SWE-bench Multilingual(66.0)和 Terminal-Bench 2.1(57.5) 上表现突出。其中,SWE-bench Verified(75.0)接近 Qwen3.6-35B-A3B(76.0),大幅超过 Gemma4-26B-A4B(53.0);Terminal-Bench 2.1(57.5)同时超过 Qwen3.6-35B-A3B(51.5)和 Gemma4-26B-A4B(30.0)。
-
在通用Agent方面,Xing4.0-29B-A4B 在 Claw-Eval(76.55)、DeepresearchBII(60.80)和 τ³-Bench(64.63)上展现出较强表现。其中,Claw-Eval(76.55)超过 Qwen3.6-35B-A3B(74.54)和 Gemma4-26B-A4B(71.49),DeepresearchBII(60.80)也超过 Qwen3.6-35B-A3B(59.70)和 Gemma4-26B-A4B(39.30)。

以上是针对智能体场景小尺寸模型对比结果,从 SuperCLUE 评测结果来看,在智能体能力方面,Xing4.0-29B-A4B 得分 93.52,位列第 3 名,与两款头部 Qwen 模型的差距均不足 1 分。
综合来看,Xing4.0-29B-A4B 在较小参数规模下实现了较强的智能体能力。在任务规划、工具调用、代码处理和端到端任务执行等方面表现突出,为数据处理、办公自动化等智能体应用提供了良好的模型基础。
03
它是怎样做事的?
实测两关,直接看它干活:
-
关卡 1 · 开学季:一句话生成趣味教学网页
给出一句需求,它零代码生成可直接运行的互动教学页面——老师备课、家长辅导的“手工活”变成一句话的事。

-
关卡 2 · 选型报告:一句话拆解复杂任务
让它对比两个主流大模型的 API 成本与 Agent 能力、出一份带数据表格的选型报告,普通大模型大多只会输出笼统的文字分析,数据杂乱、无落地逻辑,需要人工二次整理。而Xing4.0-29B-A4B直接将复杂需求拆解为12步闭环可执行链路,每一步精准匹配对应工具。

04
关键问题:我,用得起吗?
两个“用得起”:
-
算力上,一张显卡就够。
Xing4.0-29B-A4B 通过4-bit 量化后显存占用降低至 15GB(比 FP16 省约 75%),RTX 3090、RTX 4090 这类 24G 消费级显卡就能本地跑长上下文任务,这意味着,个人开发者、小型工作室、中小企业不用采购昂贵的 A 系列专业卡,依托现有消费级硬件就能把模型跑起来——既能完成复杂任务拆解、工具调用执行,也能保证数据安全私密、全程不出域。

-
生态兼容上,工具链也不用换。
Xing4.0-29B-A4B延续星辰大模型的开源路线,对主流开源生态做了全面兼容:支持 LLaMA-Factory、MindFormers等微调架构;适配 SGLang、vLLM、KTransformers等主流推理框架;Agent 框架对 OpenCode、Claude Code、OpenClaw、Hermes 做了定向适配调优,深度对齐各框架格式规范。
05
后盾:全链路国产,可信的底座
跑得动之外,还要靠得住。Xing4.0-29B-A4B 全栈国产化,从底层算力到应用部署,每一段,都握在自己手里。
训推链路全国产化
面向中高阶代码生成与智能体任务,Xing4.0-29B-A4B 对长程上下文理解、复杂推理规划和工具调用协同提出更高要求。从模型架构、训练 Infra、强化学习三个层面开展系统性攻坚,推动模型与国产芯片、国产框架深度适配,构建训推全链路国产化能力。
-
架构设计:面向长程 Agent 任务进行模型架构创新,引入 MLA 多头潜变量注意力压缩 KV 缓存,MTP 多 Token 预测增强生成连贯性,mHC 流形约束超连接改善深层网络训练稳定性,并结合 Muon + QK-Clip 优化器提升训练稳定性。训练采用分阶段递进策略,序列长度从 4K 逐步扩展至 32K、128K、256K,系统性构建长程上下文能力。
-
训练 Infra:基于昇腾 910C 集群开展新一代模型架构与国产算力协同优化,实现“国芯训国模”。针对 mHC 多残差连接,基于 MindSpore/MindFormers 完成特性适配、跨框架精度对齐及融合算子开发;针对 64 路由专家、Top4 激活的细粒度 MoE,围绕专家负载均衡、Grouped GEMM、共享专家计算与 All-to-All 通信重叠进行优化,并结合 DVM 图算自动融合,降低通信长尾与碎片化算子开销;进一步采用层级 + 算子级选择性重计算,以及 Ascend C 定制 mHC 融合算子,持续提升计算与显存效率。经过模型架构、编译、算子与硬件的多层次协同,整网训练吞吐较开箱性能提升约 96%,接近翻倍。
-
多专家强化学习:依托昇腾生态完成 Slime 强化学习框架适配,面向 Agent、Coding、Reasoning 等复杂任务开展多专家强化学习训练,并通过 MOPD 技术实现多专家能力高效融合,进一步强化复杂推理、长程任务规划与工具协同能力。
通过模型架构、训练 Infra 与强化学习三个层面的协同攻坚,Xing4.0-29B-A4B 打通从模型架构适配、国产算力训练到强化学习能力增强的完整技术链路,实现模型与国产芯片、国产框架的深度融合,形成“国芯训国模”的新路径。
FlagOS跨芯统一适配
基于智源 FlagOS 统一开源 AI 软件栈,Xing4.0-29B-A4B 已在昇腾、沐曦、摩尔线程、平头哥、海光等多家国产芯片跨芯适配、精度对齐与部署验证,适配镜像已上线魔搭、HuggingFace,提供开箱即用部署方案。此外,FlagOS 技术栈为 Xing4.0-29B-A4B 提供了统一支持多种 AI 芯片的推理插件,包括 vLLM-plugin-FL 和 SGLang-plugin-FL 两种推理框架插件。依托 FlagOS 的异构抽象层与统一运行时,模型可实现跨芯片架构的无缝迁移与一键部署,真正打破算力边界,让异构多元算力开箱即用。
06
面向未来,让智能真正进入生产环境
Xing4.0-29B-A4B 只是起点。未来,中电信人工智能公司将持续推进模型能力、开源生态与产业应用的深度融合。更大参数量的模型也将陆续与大家见面,敬请期待。
中电信人工智能公司期待与开发者、科研机构及企业伙伴共同探索 AI 在真实业务场景中的更多可能,让模型能力真正走向产业,让开放生态汇聚更多创新,让人工智能成为推动产业升级和高质量发展的新型生产力。
Xing4.0-29B-A4B开源权重已上线魔乐社区,开发者可直接前往模型页面下载体验:
模型地址:
https://modelers.cn/models/XingChen-AGI/Xing4.0-29B-A4B
更多推荐




所有评论(0)