WeKnora 部署指南:从克隆到上线,跑通 RAG 知识库、Agent 推理与 Wiki 生成

发布时间:2026/9/6 22:11:19

WeKnora 部署指南:从克隆到上线,跑通 RAG 知识库、Agent 推理与 Wiki 生成
WeKnora 部署指南从克隆到上线跑通 RAG 知识库、Agent 推理与 Wiki 生成【免费下载链接】WeKnoraOpen-source LLM knowledge platform: turn raw documents into a queryable RAG, an autonomous reasoning agent, and a self-maintaining Wiki.项目地址: https://gitcode.com/GitHub_Trending/we/WeKnoraWeKnora 是一个开源的 LLM 知识管理平台把 PDF、Word、网页等原始文档变成可提问的 RAG 知识库、会自主调用工具的推理 Agent以及一套 Agent 自己维护的 Wiki。你读完这篇部署指南后能完成 WeKnora 的容器化部署、配置好模型与向量检索、验证 RAG 问答真的能跑并把它推到生产环境。 第一次上手体验四条命令之后你能看到什么装完后打开浏览器访问http://localhost你会先遇到注册页创建账号后自动进入初始化向导website-docs/public/screenshots/quickstart-register.png、quickstart-init-wizard.png记录了这两步的样子。向导里填入 LLM 与 Embedding 模型信息接着建一个知识库、拖入几份文档几分钟后就能在对话页对着文档提问答案会带可点击的引用来源。整条链路——解析、切块、向量化、检索、生成——都在这个默认部署里。最短部署路径就四步docker compose up -d会拉起核心服务前端、API、文档解析器、PostgreSQL、Redisgit clone https://gitcode.com/GitHub_Trending/we/WeKnora cd WeKnora cp .env.example .env # 按注释编辑文件里有全部参数说明 docker compose pull docker compose up -d启动成功判据docker compose ps里WeKnora-app状态为 healthycompose 内置了 30 秒一次的健康检查探测http://localhost:8080/health。如果你更喜欢带自检的入口./scripts/start_all.sh --check会先检查环境--all则连 Ollama 一起拉起。 系统是怎么搭起来的六个容器各司其职这一节帮你建立「哪个容器坏了影响哪块功能」的直觉。WeKnora 用 Docker Compose 编排默认栈的核心角色是frontend80 端口Nginx 托管 UI同时把/api反向代理到后端相当于前台兼网关。app8080 端口Go 写的 API 服务承载会话、检索编排、Agent 循环和任务调度是唯一的业务大脑。docreadergRPC 50051 端口独立的文档解析工作间PDF、Word、EPUB、Excel 都在这里拆成文本和分块app 通过 gRPC 调用它。postgresParadeDB 镜像一个库身兼两职——关系数据用户、知识库、任务和向量检索。混合检索靠 BM25 关键词召回 pgvector 稠密向量召回再用 Rerank 模型精排。redis既做流式响应后端也做 Asynq 任务队列——文档解析、摘要、图谱抽取都排队走它避免大文件卡死在线问答。sandboxprofile 可选Agent 执行技能代码的隔离沙箱。理解这张图有个省事的角度它不是一堆必须同时起的服务而是「核心栈 按需插件」。Neo4j、MinIO、Qdrant、Milvus、Langfuse、SearXNG 都挂在 Compose profile 后面不启动就不占资源。⚙️ 哪些配置值得动四个高频参数与两个坑默认值能跑但有几处你会在真实使用里很快碰到。参数全貌在.env.example按 A-J 十组分类注释写得很细这里只挑关键项。# .env 关键项默认值 → 何时改 DB_DRIVERpostgres # 数据库轻量玩法可换 sqlite 配 memory 流后端见 .env.lite.example RETRIEVE_DRIVERpostgres # 向量检索后端默认 pgvector可切 qdrant/milvus/weaviate 等 8 种 MAX_FILE_SIZE_MB50 # 单文件上传上限改完必须同时重启 app/frontend/docreader 四层 CONCURRENCY_POOL_SIZE5 # Embedding 并发模型服务返回 429 限流时调小另外两个高频坑Embedding 向量维度必须与模型一致常见 768/1536。在 UI 向导或config/builtin_models.yaml里配错症状是入库后检索结果乱——维度对不上时向量检索等于在噪音里捞针。切块参数在config/config.yaml默认chunk_size: 512、chunk_overlap: 50。多数文档不用动如果大量长表格或代码文档检索不准再按 docs/CHUNKING.md 的思路调。文档解析超时默认单文档 2 小时WEKNORA_DOCUMENT_PROCESS_TIMEOUT几百页的扫描版 PDF 才需要碰它。✅ 怎么判断部署成功三步验证与高频故障「容器全绿」只是及格线真正的验收是问答链路。curl -f http://localhost:8080/health # 期望 HTTP 200 docker compose logs -f app docreader postgres # 看是否有 ERROR然后走一遍完整闭环注册账号 → 建知识库 → 上传一份你熟悉的 PDF → 等状态从processing变completed→ 问一个只有这份文档里才有的问题答案应带引用浮层。三个最高频故障的排查路径完整版在 docs/QA.md文档一直处理失败/上传报错九成是 LLM 或 Embedding 模型没配好。看 app 日志里的ERROR核对.env中模型地址与 API KeyOllama 用户先确认ollama serve在跑。图片显示无效链接默认本地存储STORAGE_TYPElocal下图片走后端代理若换了 MinIO 却忘了启动它docker compose --profile minio up -d或 IM 场景下没设APP_EXTERNAL_URL让图片对外可达都会出现破图。升级后版本不对只跑docker compose up -d会复用本地缓存镜像必须docker compose pull后再起.env里用WEKNORA_VERSION固定到具体 release tag。 走向生产环境变量开关与多副本从「能用」到「敢上线」差别集中在几个开关上。生产最小改动集# .env 生产环境最小改动 GIN_MODErelease # 禁用 Swagger、降低日志噪音 LOG_LEVELinfo # 默认 debug 太吵 DISABLE_REGISTRATIONtrue # 生产建议关闭开放注册走邀请制 WEKNORA_TENANT_ENABLE_RBACtrue # 默认即 true设 false 是「只记录不拦截」的观察模式资源与扩展方面两条实用事实任务队列按「核心解析 / 后处理 / 摘要等多模态富化 / 长耗时维护 / 弹性共享」五池隔离变量如WEKNORA_ASYNQ_CORE_CONCURRENCY默认 8/2/12/4/6并且支持在系统设置页运行时改并发、不用重启。队列深度和失败任务在管理端的任务队列面板可查可重试。app 是多副本安全的Asynq 各池并发数按「每副本保底值 × 副本数」叠加副本间通过共享 Redis 分发任务。Kubernetes 部署用仓库里的 helm/ Chartvalues.yaml对应同一套环境变量。可选组件按需求加 profile要知识图谱--profile neo4j要对象存储--profile minio要自托管链路追踪--profile langfuse全量功能--profile full。️ 安全与可观测默认给你的和要自己补的WeKnora 默认已经做了一批防护API Key 与数据源凭据用 AES-256-GCM 落盘加密、出站 HTTP 有 SSRF 校验向量库等外部地址过校验时可用SSRF_WHITELIST_EXTRA放行内网服务、空间级 RBAC 是四级角色矩阵Owner/Admin/Contributor/Viewer加每空间审计日志默认保留 90 天。需要你亲手补的SYSTEM_AES_KEY必须是 32 字节且妥善保存——它丢了库里所有加密字段API Key、模型凭证无法解密JWT_SECRET同理生产别用模板默认值。docreader 与 app 之间的 gRPC 默认走内网明文可开GRPC_TLS_ENABLED加认证 tokenGRPC_AUTH_TOKEN托管 Redis 则开REDIS_USE_TLS。有统一登录需求时支持 OIDCOIDC_AUTH_ENABLEtrue配置细节见 docs/OIDC认证调用流程.md。可观测性靠 Langfuse.env里同时填LANGFUSE_PUBLIC_KEY和LANGFUSE_SECRET_KEY即自动启用连云版或--profile langfuse自建的都可之后每次 chat、embedding、rerank、VLM 调用的耗时和 token 消耗都有追踪高流量下用LANGFUSE_SAMPLE_RATE控采样。配合队列面板和docker stats延迟和瓶颈基本都能定位。 延伸阅读深入哪个方向看哪份文档部署跑通后按你的关注点继续完整产品文档站在 website-docs/VitePress覆盖约 360 个 API 端点与 150 个环境变量cd website-docs npm run dev可本地预览接口逐个查 docs/api/README.md向量库选型看 docs/使用其他向量数据库.mdRBAC 细节看 docs/RBAC说明.md。遇到问题先翻 docs/QA.md那里按「现象 → 排查步骤」整理好了最常见的坑。【免费下载链接】WeKnoraOpen-source LLM knowledge platform: turn raw documents into a queryable RAG, an autonomous reasoning agent, and a self-maintaining Wiki.项目地址: https://gitcode.com/GitHub_Trending/we/WeKnora创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

witr 终极指南:快速完成进程分析,追踪任意进程、端口与文件的启动链路

witr 终极指南:快速完成进程分析,追踪任意进程、端口与文件的启动链路

2026/9/6 22:11:19

witr 终极指南:快速完成进程分析,追踪任意进程、端口与文件的启动链路 【免费下载链接】witr Why is this running? Trace any process, port, container, or file back to what started it - CLI TUI. 项目地址: https://gitcode.com/GitHub_Trend…

猫抓插件:浏览器里的网页视频嗅探工具,把看不见的媒体资源存下来

猫抓插件:浏览器里的网页视频嗅探工具,把看不见的媒体资源存下来

2026/9/6 22:11:19

猫抓插件:浏览器里的网页视频嗅探工具,把看不见的媒体资源存下来 【免费下载链接】cat-catch 猫抓 浏览器资源嗅探扩展 / cat-catch Browser Resource Sniffing Extension 项目地址: https://gitcode.com/GitHub_Trending/ca/cat-catch 想保存网页…

如何用一条脚本跑完 ChatGPT 类模型的 RLHF 训练:DeepSpeed-Chat 与 Hybrid Engine 实战指南

如何用一条脚本跑完 ChatGPT 类模型的 RLHF 训练:DeepSpeed-Chat 与 Hybrid Engine 实战指南

2026/9/6 22:11:19

如何用一条脚本跑完 ChatGPT 类模型的 RLHF 训练:DeepSpeed-Chat 与 Hybrid Engine 实战指南 【免费下载链接】DeepSpeed DeepSpeed is a deep learning optimization library that makes distributed training and inference easy, efficient, and effective. 项…

Puppeteer Awaitable 类型详解:`T | PromiseLike<T>` 如何支撑整个 API 的同步/异步双形态

Puppeteer Awaitable 类型详解:`T | PromiseLike<T>` 如何支撑整个 API 的同步/异步双形态

2026/9/6 23:11:21

Puppeteer Awaitable 类型详解&#xff1a;T | PromiseLike<T> 如何支撑整个 API 的同步/异步双形态 【免费下载链接】puppeteer JavaScript API for Chrome and Firefox 项目地址: https://gitcode.com/GitHub_Trending/puppeteer1/puppeteer Puppeteer 中大量的…

Data-Science-For-Beginners 第10课实战:用直方图与密度曲线可视化数据分布(Matplotlib + Seaborn 详解)

Data-Science-For-Beginners 第10课实战:用直方图与密度曲线可视化数据分布(Matplotlib + Seaborn 详解)

2026/9/6 23:11:21

Data-Science-For-Beginners 第10课实战&#xff1a;用直方图与密度曲线可视化数据分布&#xff08;Matplotlib Seaborn 详解&#xff09; 【免费下载链接】Data-Science-For-Beginners 10 Weeks, 20 Lessons, Data Science for All! 项目地址: https://gitcode.com/GitHub_…

WSL2 + Ubuntu 20.04 + Docker 在 Windows 10 上的完整配置与避坑指南

WSL2 + Ubuntu 20.04 + Docker 在 Windows 10 上的完整配置与避坑指南

2026/9/6 23:11:21

简介&#xff1a;Windows10下通过WSL2安装Ubuntu20.04并配置Docker环境&#xff0c;是开发者搭建跨平台开发与容器化部署的常见需求。这份PDF资源面向已具备基本Windows操作基础、希望快速上手WSL2与Docker的中初级开发者&#xff0c;完整梳理了从版本检查、启用Windows功能、安…

通达信价格变异率主图指标:从原理到源码实战

通达信价格变异率主图指标:从原理到源码实战

2026/9/6 23:11:21

简介&#xff1a;通达信价格变异率主图指标源码解析文档&#xff0c;面向股票技术分析者与通达信公式编写初学者&#xff0c;重点讲解如何用通达信指标语言计算价格变异率并绘制主图。压缩包内为1个doc文件&#xff0c;整体仅241KB&#xff0c;但内容紧凑&#xff0c;涵盖完整公…

TES被WE零封:从版本理解到战术执行的系统性溃败复盘

TES被WE零封:从版本理解到战术执行的系统性溃败复盘

2026/9/6 23:11:21

2025年7月20日晚&#xff0c;LPL夏季赛登峰组的一场常规赛打出了比季后赛还高的讨论度&#xff1a;排名登峰组第一的TES被WE干净利落地以2比0零封。比赛的高热度不只来自爆冷本身&#xff0c;还来自“榜首对垫底”“老东家对上单”“赢一场就重回第一”等多层叙事叠加。赛后数小…

Python入门:字符串类型

Python入门:字符串类型

2026/9/6 23:01:21

文章目录1. 字符串基础1.1 字符串创建1.2 转义字符1.3 原始字符串1.4 字符串拼接和重复1.5 字符串长度1.6 字符串的不可变性2. 访问字符串2.1 使用索引访问单个字符2.2 使用切片访问子字符串3. 字符串常用内置方法3.1 大小写转换相关方法3.2 查找与替换相关方法3.3 编码与解码相…

中国人民大学杨琳团队《Nature Communications》 | 全球潮汐湿地土壤有机碳时空格局与环境驱动:一项2009-2020年的全球评估

中国人民大学杨琳团队《Nature Communications》 | 全球潮汐湿地土壤有机碳时空格局与环境驱动:一项2009-2020年的全球评估

2026/9/6 1:19:56

本文首发于“生态学者”&#xff01;从“湿地面积”到“土壤碳密度”&#xff1a;为什么需要重新认识潮汐湿地蓝碳变化&#xff1f;潮汐湿地位于陆地与海洋的交汇地带&#xff0c;包括红树林、盐沼和潮滩&#xff0c;是全球重要的蓝碳生态系统。其土壤能够长期储存大量有机碳&a…

adb抓包

adb抓包

2026/9/6 1:19:56

前言 本文介绍如何通过 tcpdump 在 Android 手机上抓取网络数据包&#xff0c;并在电脑端使用 Wireshark 进行分析。适用于需要排查 App 网络请求、分析接口调用或调试网络问题的开发与测试场景。1. 手机要有 root 权限2. 下载 tcpdump3. adb push C:\Users\zhangkuixun\Downlo…

大模型推理镜像极简瘦身:从 25GB 巨无霸到 3GB 精简镜像实战

大模型推理镜像极简瘦身:从 25GB 巨无霸到 3GB 精简镜像实战

2026/9/6 1:19:56

大模型推理镜像极简瘦身&#xff1a;从 25GB 巨无霸到 3GB 精简镜像实战 在云原生基础设施中&#xff0c;容器镜像体积直接决定了服务的部署速度与弹性扩容敏捷度。对于传统的 Go / Java 微服务&#xff0c;镜像体积通常被严格控制在 50MB 到 200MB 以内&#xff0c;拉取镜像只…

中国人民大学杨琳团队《Nature Communications》 | 全球潮汐湿地土壤有机碳时空格局与环境驱动:一项2009-2020年的全球评估

中国人民大学杨琳团队《Nature Communications》 | 全球潮汐湿地土壤有机碳时空格局与环境驱动:一项2009-2020年的全球评估

2026/9/6 1:19:56

本文首发于“生态学者”&#xff01;从“湿地面积”到“土壤碳密度”&#xff1a;为什么需要重新认识潮汐湿地蓝碳变化&#xff1f;潮汐湿地位于陆地与海洋的交汇地带&#xff0c;包括红树林、盐沼和潮滩&#xff0c;是全球重要的蓝碳生态系统。其土壤能够长期储存大量有机碳&a…

adb抓包

adb抓包

2026/9/6 1:19:56

前言 本文介绍如何通过 tcpdump 在 Android 手机上抓取网络数据包&#xff0c;并在电脑端使用 Wireshark 进行分析。适用于需要排查 App 网络请求、分析接口调用或调试网络问题的开发与测试场景。1. 手机要有 root 权限2. 下载 tcpdump3. adb push C:\Users\zhangkuixun\Downlo…

大模型推理镜像极简瘦身:从 25GB 巨无霸到 3GB 精简镜像实战

大模型推理镜像极简瘦身:从 25GB 巨无霸到 3GB 精简镜像实战

2026/9/6 1:19:56

大模型推理镜像极简瘦身&#xff1a;从 25GB 巨无霸到 3GB 精简镜像实战 在云原生基础设施中&#xff0c;容器镜像体积直接决定了服务的部署速度与弹性扩容敏捷度。对于传统的 Go / Java 微服务&#xff0c;镜像体积通常被严格控制在 50MB 到 200MB 以内&#xff0c;拉取镜像只…

远程协作的工作台整理

远程协作的工作台整理

2026/9/3 6:56:24

远程协作的工作台整理远程协作的核心不是再加一个工具&#xff0c;而是让交接信息足够完整。异步任务要写明目标、输入位置、完成标准和需要决策的人。 工作台的最小配置 将日程、待办、代码和沟通入口收拢到少数固定位置&#xff1b;通知按紧急程度分层。工作台不需要模仿办公…

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

2026/9/4 7:42:10

持续集成 流水线自动化与 声明式交付 实践&#xff1a;原型怎样变成可用功能分类&#xff1a;[AI/大模型]细分主题&#xff1a;AI 增强型 CI/CD 流水线自动化与 GitOps 实践&#xff1a;Agent 工作流、工具调用与任务拆解&#xff1a;从原型到生产的验收清单很多团队在尝试用大…

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

2026/9/5 23:14:13

容器编排 生产环境运维与排障实战&#xff1a;复盘记录怎样真正派上用场分类&#xff1a;[工程技术]细分主题&#xff1a;Kubernetes 生产环境运维与排障实战&#xff1a;可复制的项目复盘模板与决策记录大部分团队的事故复盘报告&#xff0c;最后都变成了躺在 Confluence 或钉…