中国电信在 9 月 17 日端出了新一代星辰大模型 Xing4.0-29B-A4B。它总参数 29B、激活参数只有 4B,原生吃下 256K 上下文、还能扩展到 512K,是国内第一个从训练芯片到推理部署全程国产、又专门冲着复杂工程任务打磨的百亿参数大模型。
最硬的一点是 " 全栈国产 " 四个字。官方把这趟路走成了闭环 : 昇腾芯片负责训练,国产框架做适配,架构自研,生态开源——从底层算力到上层工具链,没有一处要依赖海外供应链。对动辄被卡脖子的算力赛道来说,这种把整条链路攥在自己手里的姿态,比单纯堆参数更有分量。

成绩单也撑得住门面。SuperCLUE 评测里,它的智能体能力拿到 93.52 分,排第 3,和前两名的头部 Qwen 模型差距都不到 1 分,说明这个 " 轻量级 " 选手在工程任务上已经贴到了第一梯队身后。
更讨开发者喜欢的是它的亲民门槛。经过 4-bit 量化后,显存占用压到 15GB,比 FP16 省了约 75%,意味着一块 24G 的 RTX3090 或 RTX4090 这类消费级显卡,就能在本地跑起长上下文任务——不用堆服务器、不用租云卡,个人和中小团队也用得起来。

开源姿态也很彻底。它顺着星辰既有的开源路线,把主流生态全接了一遍 : 微调上支持 LLaMA-Factory、MindFormers; 推理上适配 SGLang、vLLM、KTransformers;Agent 框架更对 OpenCode、Claude Code、OpenClaw、Hermes 做了定向调优,把各家的格式规范对齐到位。模型已经陆续上线 HuggingFace、GitHub、魔搭、Gitee 和魔乐等社区,开发者随时可以拉下来改、拉下来跑。一个全程国产训出来的智能体模型,就这样把自己摆进了和全球开源生态同台竞技的牌桌上。


登录后才可以发布评论哦
打开小程序可以发布评论哦