开源大模型#大模型#国产#开源权重#多语言

Qwen3 · 阿里通义千问开源大模型

阿里通义团队旗舰开源模型系列,多语言能力强,支持思考/非思考双模式切换

28k stars 2.1k forksPython 最近提交 2026-01-09本周 +1 在 GitHub 查看源码

快速上手

pip install -U transformers
python -c "from transformers import AutoModelForCausalLM, AutoTokenizer;
tok = AutoTokenizer.from_pretrained('Qwen/Qwen3-8B');
model = AutoModelForCausalLM.from_pretrained('Qwen/Qwen3-8B', device_map='auto');
print('模型加载完成')"

项目速览

Qwen(通义千问)是阿里巴巴通义实验室开源的大语言模型系列,长期占据开源模型榜单头部位置。Qwen3 引入「思考模式 / 非思考模式」双形态:同一模型可在深度推理与快速响应之间切换,覆盖从端侧小模型到千亿参数 MoE 的完整尺寸谱系。

能做什么

  • 中文与多语言对话、写作、代码生成,中文场景普遍优于同级国际模型
  • 支持函数调用、结构化输出、长上下文(原生支持超长窗口),可直接接入应用
  • 提供 Instruct 与 Thinking 多个版本,按显存预算选型

怎么部署

权重在 Hugging Face / ModelScope 免费下载,支持 vLLM、SGLang、llama.cpp 量化跑法;不想自己部署可直接调用阿里云百炼 API(本站实测见 通义千问工具页)。

适合谁

需要中文能力强、可私有化部署的基座模型的个人开发者与企业团队。不知道选哪家模型可看 大模型选型对比教程

不想部署?试试同类在线工具

返回全部开源项目指标每周自动更新,数据来自 GitHub API