智能体框架ModelScope上手难度 🔧 进阶#大模型#MoE#国产算力#昇腾#智能体#中国电信#全栈国产#ModelScope
Xing4.0-29B-A4B · 中电信星辰 4.0 轻量 Agent 大模型
全栈国产轻量 Agent 模型:29B MoE 激活仅 4B,昇腾训练,SuperCLUE Agent 93.52 分,消费级显卡 15GB 跑长上下文
指标同步中,请稍后刷新查看 在 ModelScope 查看
5 分钟上手
4-bit 量化 15GB 显存(RTX 3090/4090),全精度需 24GB+# Hugging Face 下载
pip install transformers huggingface-hub
huggingface-cli download XingChen-AGI/Xing4.0-29B-A4B --local-dir ./xing4
# 配合 vLLM 部署
vllm serve XingChen-AGI/Xing4.0-29B-A4B --port 8000
# Ollama
ollama run xing4.0项目速览
Xing4.0-29B-A4B 是中电信人工智能科技有限公司于 2026 年 9 月 17 日正式发布的新一代星辰大模型,是国内首个基于国产算力(昇腾 Atlas 900 A3 SuperPoD)与国产框架(昇思 MindSpore)完成全栈训练、面向复杂工程任务深度优化的百亿参数大模型。采用 MoE 架构,总参数 29B、激活仅 4B,原生支持 256K 上下文。在 SuperCLUE 智能体能力评测中以 93.52 分位列第三,与两款头部 Qwen 模型差距不足 1 分。4-bit 量化后显存仅 15GB,RTX 3090/4090 即可本地跑长上下文。
能做什么
- 复杂任务理解与规划:根据目标自主规划任务路径、调用工具并完成复杂任务
- Agent 框架深度适配:对 OpenCode、Claude Code、OpenClaw、Hermes 做了定向适配调优
- 代码开发与数据分析:中高阶代码生成与智能体执行能力突出
- 256K→512K 长上下文:长程 Agent 任务的连贯性与执行稳定性显著提升
怎么部署
开源社区(Hugging Face / ModelScope / GitHub / Gitee / 魔乐)同步上架。支持 vLLM / SGLang / KTransformers 主流推理框架,兼容 LLaMA-Factory / MindFormers 微调架构。量化版 15GB 显存即可本地运行。
适合谁
需要全栈国产 Agent 模型的企业与开发者、关注昇腾生态的信创替代场景、需要消费级显卡本地跑 Agent 长上下文任务的个人开发者。
✅ 优点
- •全栈国产(昇腾训练+MindSpore+自研架构),一条路走通
- •29B 激活仅 4B,4-bit 量化后 15GB 显存消费级可跑
- •SuperCLUE Agent 93.52 分,与头部模型差距不足 1 分
- •Agent 框架深度适配 OpenCode/Claude Code/OpenClaw/Hermes
⚠️ 局限与坑
- •29B 总参数在极端复杂推理上不如更大模型
- •昇腾生态的社区工具链还在完善中
- •中文主导,英文与多语言能力未特别优化
💼 典型应用场景
- 1.企业 Agent 应用的国产化替代底座
- 2.消费级显卡本地运行长上下文 Agent 任务
- 3.信创场景的 AI 基础设施选型
🔗 资源直达
不想部署?试试同类在线工具
智能体框架· 同类项目推荐
返回全部开源项目指标每周自动更新