WeKnora本地部署教程:3条命令跑通离线文档问答知识库

📅 发布时间:2026/9/13 19:21:01
WeKnora本地部署教程:3条命令跑通离线文档问答知识库
WeKnora本地部署教程3条命令跑通离线文档问答知识库【免费下载链接】WeKnoraOpen-source LLM knowledge platform: turn raw documents into a queryable RAG, an autonomous reasoning agent, and a self-maintaining Wiki.项目地址: https://gitcode.com/GitHub_Trending/we/WeKnoraWeKnora 是一个开源 LLM 知识平台把零散文档灌进去变成可检索的离线知识库再由你本机的模型基于这份知识库作答。跟着本文做一遍 WeKnora 本地部署你最终会拿到一个可对外提供文档问答的 Web 实例数据全程留在自己的磁盘上。本文以零外部依赖的 Lite 版为主线走完全程。WeKnora Lite版和标准版怎么选先定形态再对硬件先给结论只要需求是自己的文档、自己问答选 Lite 就够了。Lite 是一个单二进制文件内置 SQLite单空间、免注册、默认仅本机可访问标准版是 Docker Compose 多容器栈多了共享空间、注册体系和可插拔的解析引擎面向多人协作。两种形态的硬件与软件门槛如下先对表再动手。项目最低档推荐档CPU / 内存4核 8GB跑 Lite8核 16GB跑标准版 本地8B模型磁盘20GB 可用50GB模型文件与解析图片增长快GPU不需要CPU 可推理8GB 以上显存Ollama 推理明显更快软件Docker ComposeLite 自行构建需 Go 与 Node 工具链用本地模型再加装 Ollama标准版有一条隐性网络要求组件本身都在本机但首次docker compose pull需要拉镜像。Lite 构建完成后则完全无需公网。WeKnora Lite本地部署的最小步骤动手前确认一件事Ollama 已启动且模型已拉好例如先执行ollama pull qwen2.5:7b。之后下面 3 条命令就完成 WeKnora Lite 本地部署。第 1 步拿到代码。git clone https://gitcode.com/GitHub_Trending/we/WeKnora cd WeKnora执行完当前目录多出 WeKnora 文件夹后续命令都在它里面执行。第 2 步生成配置文件并改 3 项。cp .env.lite.example .env.lite命令执行后打开.env.liteOLLAMA_BASE_URL指向你的 Ollama默认已是127.0.0.1:11434同机可不动TENANT_AES_KEY与JWT_SECRET改成自己的值生产环境必须改。第 3 步构建并启动。make run-lite这条命令先构建前端、再构建 Go 二进制完成后自动加载.env.lite启动服务首次构建需要几分钟等终端打印出本机访问地址浏览器打开即进入初始化向导。标准版流程与之同构cp .env.example .env后执行docker compose pull docker compose up -d前端在http://localhost后端 API 在 8080 端口知识图谱、对象存储等组件按 profile 叠加启动细节见 README_CN.md 的快速开始一节。WeKnora离线知识库跑起来后的三个典型场景启动后先完成初始化注册账号在模型列表里把 Ollama 的本地模型设为问答引擎建第一个知识库。在模型配置页把本地模型设为问答引擎链路是平台用一句话试探请求测连通性通过后保存模型配置后续所有推理请求只发往127.0.0.1。体验上的直接收益是API Key、请求和语料都不出机器内网环境照常用。问制度类问题时答案带来源引用链路是输入一句话后系统并行做向量与关键词检索取回带出处的原文片段再由模型基于片段组织回答。感受是制度、SOP 这类要求口径统一的材料答完能点开核对依据段落误答一眼可见。批量资料打标签后重新入库链路是批量上传时可打标签已解析的文档触发重新解析后更新分块并重建索引。感受是一批规范文档改版后重新入库即可下一次检索立刻生效不需要手工清库。WeKnora本地部署高频报错对照表现象可能原因处理方法Web页面打不开端口被占或前端未构建完成核对终端实际打印的地址端口冲突时在.env改端口重启模型测试失败Ollama 未启动或地址不对先跑ollama serveLite 指向127.0.0.1:11434标准版容器内指向宿主机网关地址文档一直停在处理中解析任务超时或队列积压先看后端日志对照 docs/QA.md 第 14 条处理图片显示为无效链接存储后端对外不可达改用本地存储STORAGE_TYPElocal或给 MinIO 配外部可达地址刚保存的配置几秒后消失登录账号与空间归属不一致确认在正确的空间下操作参考 docs/QA.md 第 7 条WeKnora本地部署提速的三项参数调整项调法理由加大向量批量BATCH_EMBED_SIZE设为 64批量入库时减少与 Ollama 的往返次数提高解析并发DOCREADER_GRPC_MAX_WORKERS设为 CPU 核数文档解析是 CPU 密集并行度直接缩短排队时间收敛任务并发CONCURRENCY_POOL_SIZE在 3 到 8 之间避免任务突进占满内存拖慢在线问答用 8B 级本地模型时记住这个取舍在模型参数里加num_ctx扩大上下文单条回答质量更高降并发、分批入库吞吐更好——两头通常不能同时要满。WeKnora本地部署延伸材料docs/QA.md20 条官方高频问题日志查看、上传失败、图片链接、权限处理都有现成答案。docs/LITE.mdLite 与标准版逐维度差异对照表评估是否升级时读它。docs/RBAC说明.md空间角色与权限模型开多人访问前先读。client/example.goGo 客户端示例自己写上传与检索程序时直接参考。WeKnora Lite 是把内部文档问答知识库放在一台机器上的最低成本形态。给你一个最小下一步先导入十到二十份高频文档用真实问题校准检索命中率与回答质量跑顺了再决定是否升级到标准版多容器部署。【免费下载链接】WeKnoraOpen-source LLM knowledge platform: turn raw documents into a queryable RAG, an autonomous reasoning agent, and a self-maintaining Wiki.项目地址: https://gitcode.com/GitHub_Trending/we/WeKnora创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考