首页/新闻资讯/正文详情

从零到第一个带引用回答:WeKnora RAG 知识库本地部署完整指南

发布时间:2026/9/27 9:14:37 来源:云帆数科 栏目:资讯中心
从零到第一个带引用回答:WeKnora RAG 知识库本地部署完整指南
从零到第一个带引用回答WeKnora RAG 知识库本地部署完整指南【免费下载链接】WeKnoraOpen-source LLM knowledge platform: turn raw documents into a queryable RAG, an autonomous reasoning agent, and a self-maintaining Wiki.项目地址: https://gitcode.com/GitHub_Trending/we/WeKnoraWeKnora 是一个开源 LLM 知识平台把 PDF、Word、网页这类原始文档变成可查询的 RAG 知识库提供带出处的问答、ReAct 智能体和自维护 Wiki 三种用法。这篇文章写给第一次部署的个人和小团队按从一台裸机到跑通第一个带引用的回答推进配置项在真正用到的地方才讲。它索引的是文档快照不是实时业务数据需要实时数据就得靠数据源同步更新。对首字延迟极敏感的在线客服场景也别急着上智能体模式先用 RAG 模式把延迟测出来再说。拉起全部容器两条命令跑通 RAG 知识库机器上装好 Docker 和 Docker Compose 就行不用另装 Go、Python 或数据库。默认部署包含前端Nginx、app 主服务、docreader 解析服务、ParadeDBPostgreSQL和 Redis。建议至少 8GB 可用内存、20GB 以上磁盘。git clone https://gitcode.com/GitHub_Trending/we/WeKnora cd WeKnora cp .env.example .env.env.example自带分组注释真正要看的几处数据库账号密码DB_*、REDIS_ADDR、模型相关变量、WEKNORA_VERSION镜像版本默认 latest。docker compose pull docker compose up -d成功标志是WeKnora-frontend进入 running——前端会等 app 的/health检查通过才启动看到它跑起来基本就是整条链路通了。项目还有个一键脚本./scripts/start_all.sh会先做前置检查再拉起效果等价。可选组件用--profile按需追加可以组合知识图谱 Neo4jdocker compose --profile neo4j up -d对象存储 MinIO、调用链追踪 Langfuse同样方式全部功能docker compose --profile full up -d配置模型最可能卡住的一步模型是按知识库配的不是一次性全局初始化。前端新建知识库时向导会让你为这个库选对话模型和向量Embedding模型自带测试按钮验证连通性。两个高频坑后端跑在容器里Ollama 在宿主机时地址必须填http://host.docker.internal:11434填 localhost 连不上。.env里OLLAMA_BASE_URL的默认值已经是这个地址。向量模型建库后别换。换了等于向量维度或语义空间变了整个索引要重建。如果想提前在.env里声明好一套模型变量名是LLM_MODEL_NAME/LLM_BASE_URL/LLM_API_KEY对话模型和EMBEDDING_MODEL_NAME/EMBEDDING_BASE_URL/EMBEDDING_API_KEY向量模型。重排、图片理解、语音转写都可以先不开之后在界面随时加。导入文档盯状态走到 completed首次部署注册是开放的注册后你会自动拥有一个工作空间并成为其 Owner。团队部署建议注册第一个账号后设DISABLE_REGISTRATIONtrue改用邀请链接加人。然后进入知识库上传一份 PDF 或 Markdown。文档状态会走pending → processing → finalizing → completed四个状态列表页实时刷新进度解析完成后能看到分块数。影响这步的配置在 配置样例 里knowledge_base.chunk_size: 512和chunk_overlap: 50分块大小与重叠。块太小上下文断裂太大召回精度下降按文档类型在 256–1024 之间试。单文件上传上限默认 50MBMAX_FILE_SIZE_MB。这是部署期配置改了要重启容器才生效。文件存储默认STORAGE_TYPElocal写进容器卷多副本部署或要对外分享图片时再切 MinIO/S3 这类对象存储。验证检索回答带引用才算数在对话页选这个知识库提一个只有文档里才有答案的事实性问题。成功长这样回答带引用角标点开能跳回原文对应片段。回答泛泛而谈或拒答通常是向量模型没配好或者召回阈值过高。配置样例 里三组参数管这件事conversation.embedding_top_k: 30与vector_threshold: 0.2候选召回数量和向量相似度下限conversation.rerank_threshold: 0.3与rerank_top_k: 30重排后的过滤线conversation.max_rounds: 5多轮上下文保留轮数。排查三类高频故障服务起不来或界面打不开。先看这两条docker compose ps docker compose logs -f app docreader postgresapp 反复重启多半是数据库没就绪或.env里DB_*、REDIS_*与容器内实际不符docreader 不健康app 会一直等它。端口 80、8080 被占改FRONTEND_PORT/APP_PORT即可。上传文档失败。最常见原因是模型没配齐——向量模型或对话模型缺失时解析流水线直接报错。确认.env里模型变量完整再去主服务日志搜ERROR。文档里图片不显示。本地存储部署下图片链接走容器内网地址外部设备打不开。两个方向对象存储 endpoint 改成公网可达或设APP_EXTERNAL_URL让图片经 WeKnora 的/r/token代理转发。解析慢。扫描件 PDF 天然慢单次 DocReader 调用默认超时 30 分钟整个文档任务默认 2 小时。批量导入时用WEKNORA_ASYNQ_*_CONCURRENCY系列变量调各阶段 worker 并发系统设置页也支持运行时改。下一步接入一份真实业务文档四步验证都过了之后接入一份真实业务文档观察一次完整问答的引用是否正确。然后把.env里的模型、存储参数按你的环境固化用docker compose logs -f app盯一两天日志确认没有解析积压或模型超时。发现哪个片段有问题直接在界面里编辑分块保存——索引会自动重建还会留修订历史。【免费下载链接】WeKnoraOpen-source LLM knowledge platform: turn raw documents into a queryable RAG, an autonomous reasoning agent, and a self-maintaining Wiki.项目地址: https://gitcode.com/GitHub_Trending/we/WeKnora创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关推荐

Humanizer InDate.Six 详解:用流式 API 计算 6 天/6 周/6 月/6 年后的日期
Humanizer InDate.Six 详解:用流式 API 计算 6 天/6 周/6 月/6 年后的日期

开发工具 【免费下载链接】Humanizer Humanizer meets all your .NET needs for manipulating and displaying strings, enums, dates, times, timespans, numbers and quantities 项目地址: https://gitcode.com/gh_mirrors/hu/Humanizer 点击查看 免费下载 本篇技… · 2026/9/27 9:14:31

Puppet V3 Facts HTTP API 详解:节点事实上报、Schema 约束与间接层实现原理
Puppet V3 Facts HTTP API 详解:节点事实上报、Schema 约束与间接层实现原理

运维DevOpsIaC 【免费下载链接】puppet Server automation framework and application 项目地址: https://gitcode.com/gh_mirrors/pu/puppet 点击查看 免费下载 导读 facts 端点是 Puppet V3 HTTP API 中用于**按节点名写入(保存)事实&… · 2026/9/27 9:14:25

NodeMCU WS2801 驱动模块完全指南:从接线到源码级原理
NodeMCU WS2801 驱动模块完全指南:从接线到源码级原理

物联网嵌入式 【免费下载链接】nodemcu-firmware Lua based interactive firmware for ESP8266, ESP8285 and ESP32 项目地址: https://gitcode.com/gh_mirrors/no/nodemcu-firmware 点击查看 免费下载 本文基于 docs/modules/ws2801.md 整理,并结合 ap… · 2026/9/27 9:14:25

网站开发要什么专业?3个核心技能避开性能优化坑
网站开发要什么专业?3个核心技能避开性能优化坑

网站开发要什么专业?3个核心技能避开性能优化坑 域名解析失败、服务器响应慢如蜗牛,这是不少初学者接手项目后的第一反应。很多人以为搞懂代码就行,却忽略了底层架构对 性能优化 的决定性影响。其实, 网站开发要什么专业… · 2026/9/27 9:58:07

网络推广方式有哪些推广思路怎么选避开网站被黑挂马坑
网络推广方式有哪些推广思路怎么选避开网站被黑挂马坑

网络推广方式有哪些推广思路怎么选避开网站被黑挂马坑 网站被黑挂马不知道怎么办?这是很多站长半夜惊醒时的第一反应。屏幕一闪,弹窗满屏,SEO权重瞬间归零,这种崩溃感我见过太多次。很多新手一慌就乱删文件,结果把数据库搞丢,彻底死机。这时候最关键… · 2026/9/27 9:58:00

网站建设发言材料2026最新:防黑挂马实战指南
网站建设发言材料2026最新:防黑挂马实战指南

网站建设发言材料2026最新:防黑挂马实战指南 昨晚三点,成都高新区某科技公司老板给我打电话,声音都在抖。他的企业官网首页突然变成了一片乱码,浏览器地址栏跳出红色“不安全”警告,后台被植入了博彩广告。他问我:“我的网站怎么一夜之间被黑了?这… · 2026/9/27 9:57:54

The Concise TypeScript Book 精讲:字面量类型(Literal Types)从基础到实战
The Concise TypeScript Book 精讲:字面量类型(Literal Types)从基础到实战

文档教程 【免费下载链接】typescript-book The Concise TypeScript Book: A Concise Guide to Effective Development in TypeScript. Free and Open Source. 项目地址: https://gitcode.com/gh_mirrors/typ/typescript-book 点击查看 免费下载 本文是《The Conci… · 2026/9/27 9:57:42

乌鲁木齐全屋定制推荐:适合大宅意式设计的品牌分析
乌鲁木齐全屋定制推荐:适合大宅意式设计的品牌分析

乌鲁木齐全屋定制指南:大宅意式设计的品牌选择与考量在乌鲁木齐进行家庭装修规划时,获取一份客观的乌鲁木齐全屋定制推荐参考清单,往往是业主开启装修旅程的重要一步。需要明确的是,本文旨在基于公开的市场信息、品牌定位差异以及… · 2026/9/27 9:57:36

Operit 数据救援:Preferences DataStore 配置文件健康检测与保全优先修复实战
Operit 数据救援:Preferences DataStore 配置文件健康检测与保全优先修复实战

AI Agent人工智能大模型AI 应用工具调用本地部署MCP ClientsAgent 记忆 【免费下载链接】Operit The most powerful AI agent and AI chat software on Android/Operit是一款Android上能力最为强大、发展最久的AI Agent 项目地址: https://gitcode.com/gh_mirrors/o… · 2026/9/27 9:57:36

MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现
MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现

简介:这套Matlab仿真工具完整呈现雷达信号脉冲压缩过程,从线性调频(LFM)信号生成、目标回波仿真到匹配滤波压缩处理均有可运行代码支撑,面向电子信息工程、计算机、数学等专业学生,适用于课程设计、期末大作… · 2026/9/27 0:00:01

汕头网站建设制作厂家避坑指南:5大注意事项救急
汕头网站建设制作厂家避坑指南:5大注意事项救急

汕头网站建设制作厂家避坑指南:5大注意事项救急 改个需求建站公司拖一周,这种憋屈事我见得太多了。 很多汕头老板找本地建站团队,签合同前看着方案挺美,一上线就变脸。 今天不聊虚的,直接拆解找 汕头网站建设制作厂家 时的5个核心 注意事项… · 2026/9/27 0:00:01

多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习
多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习

简介:基于PyTorch的多模态虚假新闻检测项目完整代码包,面向自然语言处理与计算机视觉交叉方向的开发者、科研人员及毕业设计选题者,解决社交媒体中文本与图像联合识别虚假新闻的问题。系统以BERT预训练模型提取文本语义特征,以Res… · 2026/9/27 0:00:01

MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现
MATLAB雷达信号脉冲压缩仿真:LFM线性调频、匹配滤波与距离分辨率实现

简介:这套Matlab仿真工具完整呈现雷达信号脉冲压缩过程,从线性调频(LFM)信号生成、目标回波仿真到匹配滤波压缩处理均有可运行代码支撑,面向电子信息工程、计算机、数学等专业学生,适用于课程设计、期末大作… · 2026/9/27 0:00:01

汕头网站建设制作厂家避坑指南:5大注意事项救急
汕头网站建设制作厂家避坑指南:5大注意事项救急

汕头网站建设制作厂家避坑指南:5大注意事项救急 改个需求建站公司拖一周,这种憋屈事我见得太多了。 很多汕头老板找本地建站团队,签合同前看着方案挺美,一上线就变脸。 今天不聊虚的,直接拆解找 汕头网站建设制作厂家 时的5个核心 注意事项… · 2026/9/27 0:00:01

多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习
多模态虚假新闻检测实战:BERT+ResNet双塔与对比学习

简介:基于PyTorch的多模态虚假新闻检测项目完整代码包,面向自然语言处理与计算机视觉交叉方向的开发者、科研人员及毕业设计选题者,解决社交媒体中文本与图像联合识别虚假新闻的问题。系统以BERT预训练模型提取文本语义特征,以Res… · 2026/9/27 0:00:01

了解更多?预约专属演示

我们的顾问将为您一对一讲解产品与方案

企业微信二维码