推理部署#本地部署#推理工具#入门必备

Ollama · 本地大模型一键运行工具

一条命令在 Mac/Windows/Linux 本地跑大模型,开源模型本地化的事实标准

180k stars 18k forksGo MIT 最近提交 2026-09-09 在 GitHub 查看源码

快速上手

# 安装后直接运行
ollama run qwen3:8b

# 查看本机可用模型
ollama list

项目速览

Ollama 把「下载-量化-起服务-接应用」整套流程压缩成一条命令,是目前在本地运行开源大模型最流行的工具。内置模型仓库覆盖 Llama、Qwen、DeepSeek、GLM 等主流开源模型,自动匹配你机型的量化版本。

能做什么

  • 一行命令拉起任意主流开源模型,自动生成 OpenAI 兼容 API 端点
  • Modelfile 机制可以像 Dockerfile 一样定制自己的模型(系统提示词、参数)
  • 与各类本地应用(绘图、编程助手、RAG)无缝集成

怎么部署

官网下载安装包即用,支持 Mac(Apple Silicon 优化)、Windows、Linux。配合 Open WebUI 可获得 ChatGPT 风格界面。

适合谁

想在无网络/零成本环境下跑大模型、重视数据隐私的所有用户。

不想部署?试试同类在线工具

返回全部开源项目指标每周自动更新,数据来自 GitHub API