Open WebUI 部署完全指南:一键 Docker 拉起自托管 AI 聊天界面,零门槛接入 Ollama 与 OpenAI

发布时间:2026/8/28 10:39:02

Open WebUI 部署完全指南:一键 Docker 拉起自托管 AI 聊天界面,零门槛接入 Ollama 与 OpenAI
Open WebUI 部署完全指南一键 Docker 拉起自托管 AI 聊天界面零门槛接入 Ollama 与 OpenAI【免费下载链接】open-webuiUser-friendly AI Interface (Supports Ollama, OpenAI API, ...)项目地址: https://gitcode.com/GitHub_Trending/op/open-webui上次搭 AI 聊天界面我在一条环境变量上耗了两小时——其实是端口被占了。今天把 Open WebUI 部署的坑一次说清它是一套自托管的 LLM 聊天界面支持 Ollama、OpenAI 兼容 API 等本地与云端模型数据不出你机器。跟着走3 条命令内即可离线跑通。3 分钟跑通Docker 一键部署的最快路径先花 10 秒确认端口3000 没被别的程序占用被占就用OPEN_WEBUI_PORT换一个。环境门槛只有两样装了 Docker 和docker composeCompose v2 随 Docker 自带内存 4GB 起、10GB 空余磁盘。git clone https://gitcode.com/GitHub_Trending/op/open-webui cd open-webuidocker compose up -d等几十秒docker compose ps看到open-webui和ollama两个容器都是 Up 状态即成功——这套配置会同时起一个 Ollama 容器跑本地模型的引擎模型数据存在ollama卷里重启不丢。浏览器打开http://localhost:3000首次访问是注册页注册出来的账号就是管理员。容器里的 Ollama 还没模型拉一个小的试试docker compose exec ollama ollama pull qwen3:4b看到success结尾即完成回聊天页模型列表里选qwen3:4b发消息。按场景选路4 种部署方式各适合谁一条命令只是最省事的入口换场景换一条命令即可。一台机器、图省事compose 全家桶就是上面那套。WebUI 与 Ollama 同网段OLLAMA_BASE_URL已指向http://ollama:11434模型和聊天数据分别落在两个命名卷里docker compose down一条命令全停up -d再拉起。手头有 GPUGPU 加速版有 NVIDIA 显卡且装好了nvidia-container-toolkit的人换一条命令docker compose -f docker-compose.gpu.yaml up -d区别只有 Ollama 容器被允许用 GPU 推理nvidia driver 声明在 deploy 配置里推理速度是纯 CPU 的数倍命令执行后docker compose ps依旧看 Up 状态。不装本地模型、只接云端仅 API 版不想在本机跑模型只接 OpenAI 或任意兼容 API 的话docker compose -f docker-compose.api.yaml up -d区别是 WebUI 不再依赖 Ollama11434 端口暴露给宿主机上的独立 Ollama如果你还需要的话。完整字段含义直接看仓库里的docker-compose.api.yaml不赘述。上了 K8s、要弹性多人使用、要副本和高可用时走仓库的kubernetes/目录kubectl apply打 base 清单或helm install装 chartGPU 节点加一个 nodeSelector 即可。让界面连上模型后端服务起来了接下来是让页面真正有脑子可问。入口都在右上角头像 →Settings。接 Ollama 本地模型确保 Ollama 在跑ollama serveSettings OllamaAPI URL 填地址——本机http://localhost:11434compose 网络内http://ollama:11434远程机器http://内网IP:11434保存后回Models页能看到ollama pull过的模型即接上了。现象Models 页空白报连接错误。排查宿主机ollama ps确认服务活着docker compose exec open-webui env | grep OLLAMA核对容器里实际生效的地址。修复容器访问宿主机的 Ollama 时地址用http://host.docker.internal:11434仍不通就改用--networkhost起容器此时 WebUI 端口变成 8080。接 OpenAI 兼容 APISettings OpenAI兼容服务商通用填 API Key 和 Base URL如https://api.openai.com/v1或 Groq、Mistral 的对应地址在聊天框随便发一条消息能收到流式回复即成功。两条安全底线不想让人随意注册就关掉公开注册环境变量ENABLE_SIGNUPFalse之后账号由管理员手动建多用户或暴露到内网时给WEBUI_SECRET_KEY设一个强随机值并为 API 调用开启端点限制ENABLE_API_KEY_ENDPOINT_RESTRICTIONS防止密钥被拿来打任意接口。跑起来了吗3 步验证 日志排查打开 http://localhost:3000 登录后按这三步过一遍Models页能看到至少一个模型卡片选模型发一句你好几秒内收到回复且 token 计数在动上传一个 PDF 或 TXT追问文件里的内容确认 RAG 检索生效。三步都过部署就算成了。日志就两个入口Docker 部署docker logs -f open-webui手动部署tail -f backend/open_webui/logs/app.log。现象长文本生成到一半断开。排查看日志里有没有 timeout 字样。修复默认 5 分钟超时对大模型偏短加环境变量AIOHTTP_CLIENT_TIMEOUT300以上再重启。现象升级版本后启动即退出日志报数据库版本不兼容。排查确认ENABLE_DB_MIGRATIONS没被手动关掉。修复进容器或 backend 目录执行alembic upgrade head再启动。上生产前看一眼事项怎么做备份数据整个backend/data目录compose 卷即/app/backend/data整体打包即可数据库是其中的db.sqlite3换端口起容器前设OPEN_WEBUI_PORT映射到 3000 之外的端口品牌定制WEBUI_NAME改站点名WEBUI_CUSTOM_CSS_URL指一个自定义 CSS装插件代码丢进backend/plugins/目录重启后在Settings Plugins里启用更完整的开关清单几十项持久化配置在backend/open_webui/config.py里翻一遍就有官方文档站 docs.openwebui.com 与源码目录是后续遇到问题时的第一站。Open WebUI 把私有数据 灵活模型源这两件事压成了三条命令的事部署完成只是开始模型与插件才是玩法。 用着不顺或想提需求项目仓库的 Issues 页或直接进官方 Discord 社区喊人。【免费下载链接】open-webuiUser-friendly AI Interface (Supports Ollama, OpenAI API, ...)项目地址: https://gitcode.com/GitHub_Trending/op/open-webui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

OpenCode 全攻略:3 步在终端里跑通 20+ 编程工具(新手版)

OpenCode 全攻略:3 步在终端里跑通 20+ 编程工具(新手版)

2026/8/28 10:39:02

OpenCode 全攻略:3 步在终端里跑通 20 编程工具(新手版) 【免费下载链接】opencode The open source coding agent. 项目地址: https://gitcode.com/GitHub_Trending/openc/opencode OpenCode 是一个跑在终端里的开源 AI 编程代理&…

企业私有化AI技能平台部署:用 skills 技能包搭建自己的 AI 能力中心

企业私有化AI技能平台部署:用 skills 技能包搭建自己的 AI 能力中心

2026/8/28 10:29:02

企业私有化AI技能平台部署:用 skills 技能包搭建自己的 AI 能力中心 【免费下载链接】skills Public repository for Agent Skills 项目地址: https://gitcode.com/GitHub_Trending/skills3/skills skills 是 Anthropic 开源的 Agent Skills 技能包仓库&…

从Geometry Shader到Compute Shader:Realistic-Real-Time-Grass-Rendering-With-Unity的性能演进路线图与Unity草地渲染未来

从Geometry Shader到Compute Shader:Realistic-Real-Time-Grass-Rendering-With-Unity的性能演进路线图与Unity草地渲染未来

2026/8/28 10:29:02

从Geometry Shader到Compute Shader:Realistic-Real-Time-Grass-Rendering-With-Unity的性能演进路线图与Unity草地渲染未来 【免费下载链接】Realistic-Real-Time-Grass-Rendering-With-Unity Realistic Real Time Grass Rendering With Unity. Using the Geometry…

如何用 Everything Claude Code 的 frontend-slides 生成 HTML 演示文稿和 PPTX 转换完整指南

如何用 Everything Claude Code 的 frontend-slides 生成 HTML 演示文稿和 PPTX 转换完整指南

2026/8/28 11:59:06

如何用 Everything Claude Code 的 frontend-slides 生成 HTML 演示文稿和 PPTX 转换完整指南 【免费下载链接】ECC The agent harness performance optimization system. Skills, instincts, memory, security, and research-first development for Claude Code, Codex, Openc…

RoboCom国赛战利品分配:从多背包问题到公平分配的算法实战

RoboCom国赛战利品分配:从多背包问题到公平分配的算法实战

2026/8/28 11:59:05

1. 赛题背景与核心挑战解析 “战利品分配”这个题目,乍一看像是某种资源调度或者背包问题的变种,但结合“RoboCom世界机器人开发者大赛”的背景,尤其是本科组国赛的级别,它绝不会是一个简单的算法应用题。这类竞赛的题目往往融合了…

四条原则让AI一次写出简洁代码:andrej-karpathy-skills 完整指南

四条原则让AI一次写出简洁代码:andrej-karpathy-skills 完整指南

2026/8/28 11:59:05

四条原则让AI一次写出简洁代码:andrej-karpathy-skills 完整指南 【免费下载链接】andrej-karpathy-skills A single CLAUDE.md file to improve Claude Code behavior, derived from Andrej Karpathys observations on LLM coding pitfalls. 项目地址: https://g…

蓝桥杯国赛C++核心算法精讲:从动态规划到并查集的实战解析

蓝桥杯国赛C++核心算法精讲:从动态规划到并查集的实战解析

2026/8/28 11:59:05

1. 赛题核心与备战价值解析 又到一年备赛时,对于很多C选手来说,蓝桥杯国赛B组的题目,既是技术实力的试金石,也是思维能力的磨刀石。第十二届的题目,在我看来,很好地延续了蓝桥杯“重基础、考思维、贴近应用…

从零造出会听话的智能机器人:build-your-own-x 三步上手完整指南

从零造出会听话的智能机器人:build-your-own-x 三步上手完整指南

2026/8/28 11:59:05

从零造出会听话的智能机器人:build-your-own-x 三步上手完整指南 【免费下载链接】build-your-own-x Master programming by recreating your favorite technologies from scratch. 项目地址: https://gitcode.com/GitHub_Trending/bu/build-your-own-x 想让…

happy-llm实战:本地大模型部署、RAG与API调用全流程

happy-llm实战:本地大模型部署、RAG与API调用全流程

2026/8/28 11:49:05

datawhalechina/happy-llm 这个项目,看名字就知道目标:把 LLM 学习这件事做得轻松一点。它是 Datawhale 社区维护的开源仓库,围绕大语言模型的入门、部署、应用开发整理了一套内容。跟那种只丢论文链接和概念图的教程不同,happy-l…

[光学原理与应用-521]:对光的错误理解与纠偏

[光学原理与应用-521]:对光的错误理解与纠偏

2026/8/27 11:10:02

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

SIP通话转接原理与REFER方法实战解析

SIP通话转接原理与REFER方法实战解析

2026/8/27 7:25:23

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

2026/8/28 7:34:42

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

基于Claude Code的开源AI求职框架:从职位搜索到Offer的全自动化闭环

基于Claude Code的开源AI求职框架:从职位搜索到Offer的全自动化闭环

2026/8/28 0:08:32

当AI助手能够独立完成从职位匹配、简历定制到面试准备的全链路求职流程时,求职不再是一场信息战,而是一场工程化战役。框架概述:本地运行的AI求职引擎这是一个构建在Claude Code之上的开源AI求职框架,核心理念是"在工作者的机…

Godot 4 仿 agar.io:相机缩放被 max_zoom 卡死,窗口越大球越小的根因与修复

Godot 4 仿 agar.io:相机缩放被 max_zoom 卡死,窗口越大球越小的根因与修复

2026/8/28 0:08:32

1. 问题现象 在 Godot 4 仿 agar.io 的 2D 项目中,相机缩放设计为「由球组整体尺寸决定」,世界可见高度恒定,窗口只作为视口裁剪。默认小窗口 1280x720 时相机高度正常;但窗口最大化到 2940x1912 后,视角被明显拉远、…

从软件测试大赛到实战:Java+Selenium自动化测试进阶指南

从软件测试大赛到实战:Java+Selenium自动化测试进阶指南

2026/8/28 0:08:32

1. 缘起:从校园到赛场,我的软件测试之路几年前,我还是一个在校园里对着Java课本和“Hello World”程序挠头的普通学生。软件测试对我来说,只是一个在开发流程末尾、用鼠标点点按钮的模糊概念。直到我偶然在学校的公告栏上看到了“…

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

2026/8/28 7:35:26

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…

导师推荐!2026最新AI论文工具测评与实用推荐

导师推荐!2026最新AI论文工具测评与实用推荐

2026/8/28 7:34:51

2026年真正好用的AI论文工具,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

告别游戏崩溃:XCOM 2模组管理器的智能革命

告别游戏崩溃:XCOM 2模组管理器的智能革命

2026/8/28 7:34:35

告别游戏崩溃:XCOM 2模组管理器的智能革命 【免费下载链接】xcom2-launcher The Alternative Mod Launcher (AML) is a replacement for the default game launchers from XCOM 2 and XCOM Chimera Squad. 项目地址: https://gitcode.com/gh_mirrors/xc/xcom2-lau…