RAG知识库系统WeKnora本地部署

半年前,我曾经尝试在本地笔记本上部署 UltraRAG 系统,但过程中遇到了一些配置上的问题。当时由于对 Embed 和 Re-rank 等关键概念理解不深,加上缺少现成的 Web 界面可供调试,最终只能暂时搁置这个计划。

最近,得知腾讯开源了一款名为 WeKnora 的知识库管理系统,网上也涌现了不少详细的部署和配置教程。有腾讯的技术背书,再加上众多网友的实践验证,我决定直接“拿来主义”,通过安装 WeKnora 来正式开启我的 RAG 学习之旅。


部署 WeKnora

最权威的文档请参考:WeKnora GitHub 主页。

Step 1:环境准备
在安装 WeKnora 之前,请确保本地已安装 Docker、Docker Compose 和 Git。由于我的机器上已经装有 Docker Desktop、Git、Ollama 以及部分预下载的大模型,这一步我就直接跳过了。

Step 2:克隆代码库

bash

git
 clone https://github.com/Tencent/WeKnora.git

cd
 WeKnora

Step 3:配置环境变量
主要需要关注 Ollama 的地址信息,以及各服务的端口配置(如果本地端口未被占用,可直接使用默认配置):

bash

# 复制环境变量示例文件

cp
 .env.example .env

# 编辑 .env 文件,按需修改配置

# 所有变量的说明均可在 .env.example 的注释中找到

Step 4:启动服务
可以使用脚本或直接运行 Docker Compose 命令来构建并启动服务:

bash

# 方式一:使用脚本启动所有服务(包括 Ollama 与后端容器)

./scripts/start_all.sh

# 或

make
 start-all

# 方式二:使用docker compose

# 启动Ollama服务 (可选)

ollama serve 
>
 /dev/null 
2>
&1
&
# 启动WeKnora服务
do
cker
 
compose 
up
 
-d

Step 5:访问服务
启动成功后,可通过以下地址访问各服务:

  • Web UI: http://localhost
  • Backend API: http://localhost:8080
  • Jaeger Tracing: http://localhost:16686

配置 WeKnora

通过访问 http://localhost 进入 WeKnora 的 Web 界面。首次使用需要注册账号并登录。在 WeKnora 中,知识库归属于用户,每个用户可以创建多个知识库,每个知识库需单独配置所使用的模型及相关参数。

在深入配置之前,我们先来了解一下 WeKnora 的技术架构。

WeKnora 采用了流水线处理框架,大部分处理引擎(如 Embedding、Re-rank 等)均可通过配置进行指定或替换,具有良好的扩展性和灵活性。其配置流程主要包含以下步骤:

Step 1:模型检测
WeKnora 会根据配置的 Ollama 服务地址,自动检测已安装的大模型。

Step 2:填写知识库基本信息
设置知识库的名称、描述等基础信息。

Step 3:配置大语言模型 (LLM)
你可以选择 Ollama 中已安装的模型,也可以配置任何支持 Remote API 访问的外部大模型服务。

Step 4:配置 Embedding 嵌入模型
同样支持选择 Ollama 本地模型或配置外部 API 服务。请注意:一旦知识库中有文件开始使用,Embedding 模型将无法再修改。

Step 5:配置 Rerank 重排模型
Rerank 模型需通过 API 方式接入。我在 Ollama 的模型库中没有找到合适的 Rerank 模型,因此选择在本地 Docker Desktop 中部署 fastgpt/bge-rerank-base:v0.1 镜像来提供该服务。

Step 6:多模态配置
你可以选择是否启用多模态图片信息提取功能,此功能主要用于处理输入信息中包含图片的情况。

  • 启用后,需指定所使用的视觉语言模型 (VLM)。
  • 同时需要配置对象存储服务。WeKnora 安装包已内置 MinIO 对象存储,我直接使用了它;你也可以选择接入云服务商的对象存储。

Step 7:配置文档分割方式
在此步骤中,你可以根据需求设置文档的分割策略与规则。

Step 8: 保存设置

保存设置后,就可以开始使用了。

使用体验

完成全部配置后,我尝试将几篇 AI 相关的技术文档上传到知识库中,随后基于这些文档提出了几个简单的问题。系统运行顺利,能够快速返回基于知识库内容的准确回答,初步验证了整个 RAG 流程的成功打通。


大模型全套学习教程资料点击这里获取NO米!
欢迎朋友们关注、留言,感谢点“赞”,点“推荐”,点“分享”。

Logo

中国智能体开发者社区,聚焦智能体与大模型开发,提供前沿资讯、实用工具链、开源项目及行业案例。通过技术沙龙、开发者大赛等活动,促进经验交流与协作,助力开发者快速构建创新智能应用。

更多推荐