ODS 是一套能让你在 PC、Mac 或 Linux 电脑上,通过一条命令就把整个本地 AI 服务器跑起来的系统
ODS (Osmantic Deployment System) 私有 AI 服务器详细部署教程
ODS 是一套能让你在 PC、Mac 或 Linux 电脑上,通过一条命令就把整个本地 AI 服务器跑起来的系统。它集成了本地模型推理、ChatGPT 风格的 Web 界面、语音、智能体、工作流、RAG 和图像生成等功能,开箱即用。本教程将指导你完成部署。
📋 目录
- ODS 是什么
- 硬件要求与准备
- 一键安装(推荐)
- 手动安装(源码)
- 首次启动与配置
- 核心功能与使用
- 模型管理
- 扩展与自定义
- 更新与卸载
- 常见问题排查
ODS 是什么
ODS 不是一个单一软件,而是一个本地 AI 应用栈。它把多个优秀的开源 AI 工具整合在一起,并处理好了它们之间的配置和通信。
你得到的是一整套:
- 聊天界面:功能完整的 Open WebUI。
- 模型推理:通过 llama-server 运行 GGUF 格式模型,支持 NVIDIA、AMD、Apple Silicon 和 Intel Arc GPU。
- 语音能力:Whisper(语音转文字)和 Kokoro(文字转语音)。
- 智能体:Hermes Agent (默认) 用于自主任务,n8n 用于工作流自动化。
- RAG 与搜索:Qdrant 向量数据库、SearXNG 元搜索引擎。
- 图像生成:ComfyUI。
- 控制面板:用于监控 GPU、管理模型和服务的 Web 仪表板。
- 隐私与运维:PII 过滤、Token 监控、Langfuse 追踪等。
核心原则:本地优先,数据归你。所有处理默认在本地完成。可选云端 API 模式。
硬件要求与准备
基本要求
- 操作系统:Linux(Ubuntu 24.04/22.04、Debian 12、Fedora 41+ 等)、Windows(需 Docker Desktop + WSL2)、macOS(Apple Silicon M1+)。
- Docker:必需,且必须正在运行。
- Windows:安装 Docker Desktop,并启用 WSL2 后端。在普通的 PowerShell(非管理员)中运行。
- macOS:安装 Docker Desktop。
- 网络:需要互联网连接以下载安装脚本和模型文件。
硬件建议
- 内存:至少 8GB(16GB+ 更佳,用于运行较大模型)。
- GPU(可选但强烈推荐):NVIDIA、AMD、Apple Silicon 或 Intel Arc 显卡可大幅提升推理速度。无 GPU 也可运行(纯 CPU 模式或云端模式)。
- 存储:至少 20GB 可用空间(模型文件通常数 GB)。
一键安装(推荐)
这是最快的方式,脚本会自动检测硬件、下载模型、配置并启动所有服务。
Linux 或 macOS
打开终端,执行以下命令:
1 | curl -fsSL https://install.osmantic.com/ods.sh | bash |
脚本运行过程中,会检测你的 GPU 并自动下载适配的模型。
Windows (PowerShell)
确保 Docker Desktop 已启动,然后打开普通的 PowerShell 窗口,复制并执行以下完整命令块:
1 | $ProgressPreference = "SilentlyContinue" |
安装完成后,桌面上会创建一个 Dashboard 快捷方式。
手动安装(源码)
如果一键安装不适合,或你想使用特定分支,可以手动克隆并运行。
Linux / macOS:
1 | git clone https://github.com/Osmantic/ODS.git |
Windows (PowerShell):
1 | git clone https://github.com/Osmantic/ODS.git |
首次启动与配置
安装成功后,脚本会自动启动所有服务。
- 访问 Web UI:打开浏览器,访问 http://localhost:3000。你会看到 Open WebUI 的登录界面。
- 注册账户:首次访问需要创建管理员账户。按照页面提示设置用户名和密码。
- 开始聊天:登录后,你已可以直接在 Web 界面与默认加载的模型进行对话了。
可选:切换到云端模式
如果你想用 OpenAI、Anthropic 等云端模型,可以在安装时添加 --cloud 参数,或在安装后使用 CLI 切换:
1 | ods mode cloud # 切换到云端模式 |
核心功能与使用
使用 ods CLI 管理服务
安装后,ods 命令会添加到 PATH。你可以在终端中管理整个 stack:
1 | ods status # 查看所有服务状态和 GPU 信息 |
访问各个服务
- 聊天界面:
http://localhost:3000(Open WebUI) - 控制面板:通过 Open WebUI 界面左下角的设置进入,或访问
http://localhost:3000/admin - ComfyUI (图像生成):默认端口未直接映射,可通过仪表板或
ods enable comfyui启用并访问对应端口。 - n8n (工作流):
http://localhost:5678(若已启用)
模型管理
ODS 会自动为你的硬件选择并下载合适的模型。
查看和切换模型
1 | ods model current # 查看当前运行的模型 |
手动下载模型
如果想提前下载另一个层级的模型:
1 | ./scripts/pre-download.sh --tier 3 |
使用自己的 GGUF 文件
将你的 .gguf 文件放入 ods/data/models/ 目录,然后打开 Dashboard (Web UI 的设置) -> Models -> 加载本地模型,或手动更新 .env 文件中的 GGUF_FILE 变量。
扩展与自定义
ODS 设计为高度可扩展。每个服务都是一个扩展,位于 ods/extensions/services/ 目录下。
启用/禁用扩展:
1 | ods enable n8n # 启用 n8n 工作流服务 |
创建自己的扩展:只需在 extensions/services/ 下创建一个包含 manifest.yaml 和 compose.yaml 的文件夹即可。manifest.yaml 描述元数据,compose.yaml 定义 Docker 服务。
更新与卸载
更新 ODS
- 进入 ODS 安装目录(默认是用户目录下的
ods或~/ods):cd ~/ods - 拉取最新代码:
git pull(若通过源码安装) - 运行更新脚本:
./install.sh(会自动检测并升级) - 重启服务:
ods restart
卸载 ODS
Linux / macOS:
1 | cd ~/ods |
Windows (PowerShell):
1 | cd ~\ods |
此命令会停止并移除所有相关的 Docker 容器,并删除安装目录。
常见问题排查
问题:安装后无法访问 http://localhost:3000。
- 解决:确认 Docker 正在运行。检查服务状态:
ods status。查看日志:ods logs llm或ods logs open-webui。
问题:Windows 安装失败,提示 Docker 未运行。
- 解决:确保 Docker Desktop 已启动,并启用了 WSL2 后端。在 PowerShell 中运行
docker ps验证。
问题:模型下载缓慢或失败。
- 解决:模型文件较大,请确保网络稳定。可以尝试设置环境变量使用镜像源,或手动下载 GGUF 文件放入
data/models/目录。
问题:运行本地模型时显存不足 (OOM)。
- 解决:ODS 会根据你的 GPU 选择模型,但可手动切换更小的模型:
ods model swap T2。也可在.env文件中调整MAX_CONTEXT值。
问题:在 Linux/macOS 上使用 curl ... | bash 安装有安全顾虑。
- 解决:该命令会立即执行远程脚本。你可以先下载脚本检查:
curl -fsSL https://install.osmantic.com/ods.sh -o inspect.sh && less inspect.sh,确认后再运行。或使用源码手动安装。
通过以上步骤,你应能成功部署一个功能完整的私有 AI 服务器。ODS 把所有复杂配置都封装好了,让你能专注于使用 AI。如果想深入了解每个组件的配置或进行二次开发,可以查阅项目中的 docs/ 目录或访问其官方网站。


