推理部署上手难度 🔧 进阶#推理#自托管#OpenAI API#Docker#LLM

LocalAI · 自托管 AI 推理平台

30k 星 自托管OpenAI兼容API,本地运行LLM和图像/语音模型

指标同步中,请稍后刷新查看 在 GitHub 查看源码

5 分钟上手

CPU 可用,有 GPU 更佳
docker run -d -p 8080:8080 -v $PWD/models:/models localai/localai:latest

项目速览

LocalAI 是开源自托管的 AI 推理平台,提供与 OpenAI API 完全兼容的 REST 接口。能在自己的硬件上运行 LLM、图像生成、语音识别和音频生成模型。支持 gguf、PyTorch 等多种模型格式,涵盖 LLaMA、Mistral、Phi 等主流开源模型。可直接替代现有项目中的 OpenAI API 调用。

能做什么

  • LLM 推理:兼容 OpenAI Chat Completions API
  • 图像生成:兼容 OpenAI Images API
  • 语音识别:Whisper 引擎集成
  • 多后端支持:llama.cpp、Transformers、Diffusers

怎么部署

Docker 一键部署,支持 CPU 和 GPU 模式。

✅ 优点

  • 完美兼容 OpenAI API 零代码迁移
  • CPU 推理即可运行无需 GPU
  • Docker 部署一键启动

⚠️ 局限与坑

  • CPU 推理速度慢于 GPU
  • 模型管理需一些学习成本
  • 高并发不如 vLLM

💼 典型应用场景

  • 1.OpenAI 项目的本地化替代
  • 2.企业 AI API 私有部署
  • 3.边缘设备 AI 推理服务

不想部署?试试同类在线工具

返回全部开源项目指标每周自动更新,数据来自 GitHub API