首页/AI 开源项目/Xing4.0-29B-A4B
智能体框架ModelScope上手难度 🔧 进阶#大模型#MoE#国产算力#昇腾#智能体#中国电信#全栈国产#ModelScope

Xing4.0-29B-A4B · 中电信星辰 4.0 轻量 Agent 大模型

全栈国产轻量 Agent 模型:29B MoE 激活仅 4B,昇腾训练,SuperCLUE Agent 93.52 分,消费级显卡 15GB 跑长上下文

指标同步中,请稍后刷新查看 在 ModelScope 查看

5 分钟上手

4-bit 量化 15GB 显存(RTX 3090/4090),全精度需 24GB+
# Hugging Face 下载
pip install transformers huggingface-hub
huggingface-cli download XingChen-AGI/Xing4.0-29B-A4B --local-dir ./xing4
# 配合 vLLM 部署
vllm serve XingChen-AGI/Xing4.0-29B-A4B --port 8000
# Ollama
ollama run xing4.0

项目速览

Xing4.0-29B-A4B 是中电信人工智能科技有限公司于 2026 年 9 月 17 日正式发布的新一代星辰大模型,是国内首个基于国产算力(昇腾 Atlas 900 A3 SuperPoD)与国产框架(昇思 MindSpore)完成全栈训练、面向复杂工程任务深度优化的百亿参数大模型。采用 MoE 架构,总参数 29B、激活仅 4B,原生支持 256K 上下文。在 SuperCLUE 智能体能力评测中以 93.52 分位列第三,与两款头部 Qwen 模型差距不足 1 分。4-bit 量化后显存仅 15GB,RTX 3090/4090 即可本地跑长上下文。

能做什么

  • 复杂任务理解与规划:根据目标自主规划任务路径、调用工具并完成复杂任务
  • Agent 框架深度适配:对 OpenCode、Claude Code、OpenClaw、Hermes 做了定向适配调优
  • 代码开发与数据分析:中高阶代码生成与智能体执行能力突出
  • 256K→512K 长上下文:长程 Agent 任务的连贯性与执行稳定性显著提升

怎么部署

开源社区(Hugging Face / ModelScope / GitHub / Gitee / 魔乐)同步上架。支持 vLLM / SGLang / KTransformers 主流推理框架,兼容 LLaMA-Factory / MindFormers 微调架构。量化版 15GB 显存即可本地运行。

适合谁

需要全栈国产 Agent 模型的企业与开发者、关注昇腾生态的信创替代场景、需要消费级显卡本地跑 Agent 长上下文任务的个人开发者。

✅ 优点

  • •全栈国产(昇腾训练+MindSpore+自研架构),一条路走通
  • •29B 激活仅 4B,4-bit 量化后 15GB 显存消费级可跑
  • •SuperCLUE Agent 93.52 分,与头部模型差距不足 1 分
  • •Agent 框架深度适配 OpenCode/Claude Code/OpenClaw/Hermes

⚠️ 局限与坑

  • •29B 总参数在极端复杂推理上不如更大模型
  • •昇腾生态的社区工具链还在完善中
  • •中文主导,英文与多语言能力未特别优化

💼 典型应用场景

  • 1.企业 Agent 应用的国产化替代底座
  • 2.消费级显卡本地运行长上下文 Agent 任务
  • 3.信创场景的 AI 基础设施选型

不想部署?试试同类在线工具

返回全部开源项目指标每周自动更新