中国电信开源 Xing4.0-29B-A4B:全栈国产,消费级显卡跑 512K 上下文

中国电信把”全栈国产”四个字走成了闭环。9 月 17 日,中国电信端出新一代星辰大模型 Xing4.0-29B-A4B:总参数 29B、激活参数仅 4B,原生吃下 256K 上下文、还能扩展到 512K,是国内首个从训练芯片到推理部署全程国产的百亿参数大模型,主攻复杂工程任务。更务实的是,4-bit 量化后显存占用压到 15GB,一块 24G 的 RTX 3090/4090 消费级显卡就能在本地跑起长上下文。

一、规格速览

规格 Xing4.0-29B-A4B
总参数 / 激活参数 29B / 4B
上下文 原生 256K,可扩 512K
量化后显存 15GB(4-bit,较 FP16 省约 75%)
部署门槛 24G 消费级显卡(RTX 3090/4090)可跑
自主程度 训练芯片到推理部署全栈国产

二、”全栈国产”到底意味着什么

官方把这条路走成了闭环:昇腾芯片负责训练,国产框架做适配,架构自研,生态开源——从底层算力到上层工具链,没有一处依赖海外供应链。对长期被算力”卡脖子”的赛道而言,把整条链路攥在自己手里,比单纯堆参数更有分量。

三、成绩单与性价比

在 SuperCLUE 评测中,其智能体能力拿到 93.52 分,排第 3,与前两名的头部 Qwen 模型差距不到 1 分,说明这个”轻量级”选手在工程任务上已经贴到第一梯队身后。而 4B 的激活参数 + 4-bit 量化,让它把显存压到 15GB,比 FP16 省约 75%——个人与中小团队不用堆服务器、不用租云卡,也能在本地玩转长上下文。

四、适合谁用

  • 个人开发者 / 中小团队:一块消费级显卡即可本地部署长上下文任务;
  • 对供应链自主有要求的行业:金融、政务、能源等更看重全栈可控;
  • 工程任务场景:长文档理解、代码与工具链协作等复杂任务。

常见问题(FAQ)

中国电信 Xing4.0 支持多长上下文?

原生支持 256K 上下文,并可扩展到 512K,适合长文档与长程工程任务。

消费级显卡能跑吗?

可以。4-bit 量化后显存占用约 15GB(较 FP16 省约 75%),一块 24G 的 RTX 3090 或 RTX 4090 即可在本地运行。

它是全栈国产吗?

是的。从昇腾芯片训练、国产框架适配、自研架构到生态开源,训练芯片到推理部署全程国产,是国内首个全栈国产的百亿参数大模型。

小结

Xing4.0-29B-A4B 的价值不在参数规模,而在”自主 + 亲民“的组合:全栈国产解决了供应链安全,4B 激活 + 4-bit 量化解决了落地成本。当一块消费级显卡就能跑起 512K 上下文的国产大模型,长上下文能力终于有机会从云端 Demo 走进行业与个人开发者的真实工作流。

消息来源:aibase — 中国电信开源 Xing4.0-29B-A4B:从昇腾芯片到框架全栈国产(数据以原报道为准)。

相关阅读

这条线上还有几篇站内文章可以接着看: