中国电信开源星辰Xing4.0:4B激活跑出93.52分,全栈国产大模型塞进一张游戏显卡

9月17日,中电信人工智能科技有限公司发布并开源新一代星辰大模型Xing4.0-29B-A4B。这款模型总参数量29B,每个Token仅激活4B参数,原生支持256K上下文窗口,最高可扩展到512K。

真正让业界侧目的信息藏在幕后。官方确认,这是国内首个基于国产算力与国产框架完成训练、面向复杂工程任务深度优化的百亿参数大模型。训练跑在华为昇腾超节点上,适配层用国产框架,架构自研,最后以开源形式交还社区。从芯片到工具链,整条供应链没有一处依赖海外产品。

93.52分,距离第一梯队不到1分

SuperCLUE评测给出了硬数据。Xing4.0-29B-A4B的智能体能力拿到93.52分,排名第3,与头部Qwen模型的差距不到1分。对一个走轻量级路线的模型来说,这个成绩说明它已经贴住第一梯队。

产品定位也换了打法。Xing4.0系列把重心从”问答”挪到”执行”:复杂任务理解、任务规划、工具调用、自主执行,四项能力打包训练。长上下文下的任务连贯性和执行稳定性显著提升。用官方的说法,星辰大模型正从”会回答”走向”会做事”,从信息助手升级为任务执行者。

15GB显存,一张3090就能跑

轻量化是这款模型最讨开发者喜欢的地方。MoE架构让29B总参数只激活4B,推理成本随之大幅下降。经过4-bit量化,显存占用压到15GB,比FP16省了约75%。

一块24GB显存的RTX 3090或RTX 4090,就能在本地跑起256K长上下文任务。不用堆服务器,不用租云上算力,个人开发者和中小团队都摸得到门槛。

生态兼容一次到位

开源姿态相当彻底。模型已上线Hugging Face、GitHub、魔搭、Gitee和魔乐等社区,随时可下载可修改。

工具链兼容清单同样拉满。微调环节支持LLaMA-Factory和MindFormers;推理环节适配SGLang、vLLM、KTransformers;Agent框架层面,官方对OpenCode、Claude Code、OpenClaw、Hermes做了定向调优,各家格式规范全部对齐。

能干什么

工作场景里,用户提出数据分析、材料整理、信息研究等目标,Agent自主读取文件、分析数据、调用工具并生成结果。生活场景同样覆盖:积分兑换、观影推荐、游戏选择、出行规划,模型理解意图后调用相关服务完成任务。

对被算力账单压得喘不过气的团队来说,这个方案的吸引力很具体:国产芯片训练、消费级显卡部署,两头都在省钱。运营商亲自下场做大模型,还把全栈国产这条最难走的路跑通了,这个信号比跑分本身更有分量。

下一步

官方已明确,更大参数规模的Xing4.0系列模型正在路上。开源社区的微调与二次开发动向,可以持续盯下去。


评论

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

苏ICP备2025163703号-2   警徽苏公网安备32010502011527号