推理部署上手难度 🔧 进阶#推理#自托管#OpenAI API#Docker#LLM
LocalAI · 自托管 AI 推理平台
30k 星 自托管OpenAI兼容API,本地运行LLM和图像/语音模型
指标同步中,请稍后刷新查看 在 GitHub 查看源码
5 分钟上手
CPU 可用,有 GPU 更佳docker run -d -p 8080:8080 -v $PWD/models:/models localai/localai:latest项目速览
LocalAI 是开源自托管的 AI 推理平台,提供与 OpenAI API 完全兼容的 REST 接口。能在自己的硬件上运行 LLM、图像生成、语音识别和音频生成模型。支持 gguf、PyTorch 等多种模型格式,涵盖 LLaMA、Mistral、Phi 等主流开源模型。可直接替代现有项目中的 OpenAI API 调用。
能做什么
- LLM 推理:兼容 OpenAI Chat Completions API
- 图像生成:兼容 OpenAI Images API
- 语音识别:Whisper 引擎集成
- 多后端支持:llama.cpp、Transformers、Diffusers
怎么部署
Docker 一键部署,支持 CPU 和 GPU 模式。
✅ 优点
- •完美兼容 OpenAI API 零代码迁移
- •CPU 推理即可运行无需 GPU
- •Docker 部署一键启动
⚠️ 局限与坑
- •CPU 推理速度慢于 GPU
- •模型管理需一些学习成本
- •高并发不如 vLLM
💼 典型应用场景
- 1.OpenAI 项目的本地化替代
- 2.企业 AI API 私有部署
- 3.边缘设备 AI 推理服务
不想部署?试试同类在线工具
推理部署· 同类项目推荐
返回全部开源项目指标每周自动更新,数据来自 GitHub API