中国电信在9月17日端出了新一代星辰大模型 Xing4.0-29B-A4B。它总参数29B、激活参数只有4B,原生吃下256K 上下文、还能扩展到512K,是国内第一个从训练芯片到推理部署全程国产、又专门冲着复杂工程任务打磨的百亿参数大模型。
最硬的一点是”全栈国产”四个字。官方把这趟路走成了闭环:昇腾芯片负责训练,国产框架做适配,架构自研,生态开源——从底层算力到上层工具链,没有一处要依赖海外供应链。
成绩单也撑得住门面。SuperCLUE 评测里,它的智能体能力拿到93.52分,排第3,和前两名的头部 Qwen 模型差距都不到1分。
更讨开发者喜欢的是它的亲民门槛。经过4-bit 量化后,显存占用压到15GB,比 FP16省了约75%,意味着一块24G 的 RTX3090或 RTX4090这类消费级显卡,就能在本地跑起长上下文任务。