中国电信把”全栈国产”四个字走成了闭环。9 月 17 日,中国电信端出新一代星辰大模型 Xing4.0-29B-A4B:总参数 29B、激活参数仅 4B,原生吃下 256K 上下文、还能扩展到 512K,是国内首个从训练芯片到推理部署全程国产的百亿参数大模型,主攻复杂工程任务。更务实的是,4-bit 量化后显存占用压到 15GB,一块 24G 的 RTX 3090/4090 消费级显卡就能在本地跑起长上下文。
一、规格速览
| 规格 | Xing4.0-29B-A4B |
|---|---|
| 总参数 / 激活参数 | 29B / 4B |
| 上下文 | 原生 256K,可扩 512K |
| 量化后显存 | 15GB(4-bit,较 FP16 省约 75%) |
| 部署门槛 | 24G 消费级显卡(RTX 3090/4090)可跑 |
| 自主程度 | 训练芯片到推理部署全栈国产 |
二、”全栈国产”到底意味着什么
官方把这条路走成了闭环:昇腾芯片负责训练,国产框架做适配,架构自研,生态开源——从底层算力到上层工具链,没有一处依赖海外供应链。对长期被算力”卡脖子”的赛道而言,把整条链路攥在自己手里,比单纯堆参数更有分量。
三、成绩单与性价比
在 SuperCLUE 评测中,其智能体能力拿到 93.52 分,排第 3,与前两名的头部 Qwen 模型差距不到 1 分,说明这个”轻量级”选手在工程任务上已经贴到第一梯队身后。而 4B 的激活参数 + 4-bit 量化,让它把显存压到 15GB,比 FP16 省约 75%——个人与中小团队不用堆服务器、不用租云卡,也能在本地玩转长上下文。
四、适合谁用
- 个人开发者 / 中小团队:一块消费级显卡即可本地部署长上下文任务;
- 对供应链自主有要求的行业:金融、政务、能源等更看重全栈可控;
- 工程任务场景:长文档理解、代码与工具链协作等复杂任务。
常见问题(FAQ)
中国电信 Xing4.0 支持多长上下文?
原生支持 256K 上下文,并可扩展到 512K,适合长文档与长程工程任务。
消费级显卡能跑吗?
可以。4-bit 量化后显存占用约 15GB(较 FP16 省约 75%),一块 24G 的 RTX 3090 或 RTX 4090 即可在本地运行。
它是全栈国产吗?
是的。从昇腾芯片训练、国产框架适配、自研架构到生态开源,训练芯片到推理部署全程国产,是国内首个全栈国产的百亿参数大模型。
小结
Xing4.0-29B-A4B 的价值不在参数规模,而在”自主 + 亲民“的组合:全栈国产解决了供应链安全,4B 激活 + 4-bit 量化解决了落地成本。当一块消费级显卡就能跑起 512K 上下文的国产大模型,长上下文能力终于有机会从云端 Demo 走进行业与个人开发者的真实工作流。
消息来源:aibase — 中国电信开源 Xing4.0-29B-A4B:从昇腾芯片到框架全栈国产(数据以原报道为准)。
相关阅读
这条线上还有几篇站内文章可以接着看:
- PrismML 推出 Bonsai Image 4B:开源画图模型,0.93GB 塞进 iPhone
- 启元机器人接入腾讯云WorkBuddy:AI首次从屏幕"走"进物理世界,Q1/T1成具身智能首例
- 字节跳动 DreamLite:首个「端侧统一」图生成编辑模型,0.39B 参数跑赢 Server 级模型
延伸阅读
- 千问 Qwen3.8-Omni-Flash 全模态上线:音频输入降价 98%,1M 上下文与评测提升 26%3 天前
- QwenBook 与 Googlebook 相继亮相:AI 原生电脑开战,Googlebook 899 美元起售2 小时前
- 阿里真武V900发布:算力达M890三倍,单集群50万卡20 小时前
- 宇树宣布完全开源 UnifoLM-WLA-1.0:6B 参数、2500 小时真机数据,一个模型统筹 64 项任务1 周前
