开源大模型Hugging Face上手难度 ⚡ 入门#端侧大模型#百万上下文#科大讯飞#国产算力#混合注意力#Hugging Face
Spark-X2.5-4B · 讯飞星火 X2.5-4B 端侧百万Token大模型
端侧唯一百万 Token 上下文:4B 参数混合注意力架构,智能体/代码/数学专项优化,Hugging Face 1,150+ 赞
指标同步中,请稍后刷新查看 在 Hugging Face 查看
5 分钟上手
4B 模型约 8GB 显存(消费级 GPU),1.7B 版可在智能家居设备运行# Ollama 一键部署
ullama run spark-x2.5-4b
# 或 Hugging Face 下载
huggingface-cli download XHToken/Spark-X2.5-4B --local-dir ./spark-x25项目速览
Spark-X2.5-4B 是科大讯飞旗下词元星火于 2026 年 9 月 1 日开源的新一代端侧通用大模型,是端侧模型中唯一原生支持 100 万 Token 上下文窗口的产品。采用混合注意力架构设计,围绕智能体、代码、数学和指令遵循等核心能力进行专项优化。使用约 20 万亿 Token 多样化数据进行预训练,基于全国产算力平台完成全流程训练。在 Hugging Face 上获得 1,150+ 点赞,持续出现在本周热门榜单。
能做什么
- 百万 Token 上下文:一份几十页的产品手册可一次读完并提炼重点,产品售后场景中跨章节关联推理
- Agent/代码/数学专项优化:在智能体规划、代码生成、数学推理等场景表现突出
- 端到端办公:从原始数据分析到双语报告交付的全流程
- 智能家居控制:端侧 1.7B 版在 Domux 测试集上控制指令正确率 90.3%
怎么部署
支持英伟达、华为、海光及后摩等硬件平台,兼容 vLLM、SGLang、llama.cpp 等主流推理框架,可通过 Ollama、LM Studio 等工具快速部署。API 已上线讯飞星辰 MaaS 平台,限时免费调用。
适合谁
需要端侧大模型且要求超长上下文的开发者、做智能家居/机器人边缘推理的硬件团队、关注国产端侧模型的 AI 研究者。
✅ 优点
- •端侧唯一百万 Token 上下文,长文档处理能力领先
- •4B 参数轻量部署,消费级硬件即可运行
- •国产算力全流程训练,信创友好
⚠️ 局限与坑
- •4B 参数在复杂推理上不如更大模型
- •百万 Token 上下文下推理速度显著下降
- •中文为主,英文能力未特别优化
💼 典型应用场景
- 1.产品售后手册的端侧智能问答
- 2.个人办公场景的数据分析到报告全流程
- 3.智能家居/机器人端侧控制指令执行
🔗 资源直达
不想部署?试试同类在线工具
开源大模型· 同类项目推荐
返回全部开源项目指标每周自动更新