Token导航 LogoToken导航TokenDH.com

中国电信开源 Xing4.0-29B-A4B:从昇腾芯片到框架全栈国产,消费级显卡也能跑长上下文

更新时间 2026-09-20来源 AIBase正文 718字阅读约 3分钟2 张图片

中国电信在9月17日端出了新一代星辰大模型 Xing4.0-29B-A4B。它总参数29B、激活参数只有4B,原生吃下256K 上下文、还能扩展到512K,是国内第一个从训练芯片到推理部署全程国产、又专门冲着复杂工程任务打磨的百亿参数大模型。

最硬的一点是"全栈国产"四个字。官方把这趟路走成了闭环:昇腾芯片负责训练,国产框架做适配,架构自研,生态开源——从底层算力到上层工具链,没有一处要依赖海外供应链。对动辄被卡脖子的算力赛道来说,这种把整条链路攥在自己手里的姿态,比单纯堆参数更有分量。

image.png

成绩单也撑得住门面。SuperCLUE 评测里,它的智能体能力拿到93.52分,排第3,和前两名的头部 Qwen 模型差距都不到1分,说明这个"轻量级"选手在工程任务上已经贴到了第一梯队身后。

更讨开发者喜欢的是它的亲民门槛。经过4-bit 量化后,显存占用压到15GB,比 FP16省了约75%,意味着一块24G 的 RTX3090或 RTX4090这类消费级显卡,就能在本地跑起长上下文任务——不用堆服务器、不用租云卡,个人和中小团队也用得起来。

image.png

开源姿态也很彻底。它顺着星辰既有的开源路线,把主流生态全接了一遍:微调上支持 LLaMA-Factory、MindFormers;推理上适配 SGLang、vLLM、KTransformers;Agent 框架更对 OpenCode、Claude Code、OpenClaw、Hermes 做了定向调优,把各家的格式规范对齐到位。模型已经陆续上线 HuggingFace、GitHub、魔搭、Gitee 和魔乐等社区,开发者随时可以拉下来改、拉下来跑。一个全程国产训出来的智能体模型,就这样把自己摆进了和全球开源生态同台竞技的牌桌上。

资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多