ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

WeKnora 本地化部署:30 分钟在离线服务器上跑通 RAG 知识库问答

WeKnora 本地化部署:30 分钟在离线服务器上跑通 RAG 知识库问答 WeKnora 本地化部署30 分钟在离线服务器上跑通 RAG 知识库问答【免费下载链接】WeKnoraOpen-source LLM knowledge platform: turn raw documents into a queryable RAG, an autonomous reasoning agent, and a self-maintaining Wiki.项目地址: https://gitcode.com/GitHub_Trending/we/WeKnora内网服务器上搭文档问答系统最常见的卡壳不是代码而是模型调用全部失败.env 填完容器起来了一问答就报连不上 Ollama。WeKnora 是一个开源 LLM 知识平台把 PDF、Word 变成可检索的 RAG 知识库配一个能自主推理的问答 Agent。这篇带你把 WeKnora 本地化部署完整跑通拔网线也照跑。先做个决定动手前花 30 秒回答三件事文档能不能出机器涉密文档走第三方 API 过不了合规——不能出才需要私有化部署要不要多人共享空间标准版带多空间协作只给一个人用的话先去看单应用、零依赖、无需注册的 Lite 版本见 docs/LITE.md机器够不够吃8 核 CPU 32GB 内存起步7B 模型推理时内存是主要瓶颈。三条都不命中的话停在这最省事——继续往下说明你就是那台必须自己扛推理的服务器。上图是标准版的完整容器化组成文档解析、混合检索、向量存储、本地模型服务各占一栏你要跑的就是中间那几组容器。动手前清点物料条件要求说明软件Docker ≥ 20.10 Compose v2 GitOllama 不用提前装启动脚本会自动处理硬件8 核 CPU 32GB 内存跑 7B 对话模型建议留 16GB 以上空闲磁盘预留 200GB镜像、模型权重、解析产物都往盘上写网络首次拉镜像和拉模型必须联网无其他要求⚠️ 无网机器的正确做法找一台联网机器拉好全部镜像和模型docker save/ 模型导出打包拷过去再导入不要在目标机上现拉。把代码和配置模板拉下来git clone https://gitcode.com/GitHub_Trending/we/WeKnora cd WeKnora cp .env.example .env整个部署只有一个配置入口就是.env数据库密码、存储类型、Ollama 地址都在这一个文件里模板每项都带注释。先跑一次./scripts/start_all.sh -c做环境自检它能替你检查 Docker、Compose、磁盘和内存缺什么一目了然见 scripts/start_all.sh。做对了的标志ls .env能看到新文件自检命令打印环境检查完成。改 .env 里的三处必改项打开.env其余保持默认只盯这三处STORAGE_TYPE保持默认local文件直接落容器挂载的本地目录不引入对象存储OLLAMA_BASE_URL单机部署写默认值http://host.docker.internal:11434即可——容器内用localhost指向的是容器自己必须用host.docker.internal才能找到宿主机上的 OllamaDB_PASSWORD、REDIS_PASSWORD、SYSTEM_AES_KEY换成自己生成的值模板里的示例值别沿用。想调解析和检索行为时直接改config/config.yaml见 config/config.yaml它会挂进 app 容器改完重启容器生效不用重建镜像。做对了的标志三个密钥不再是示例值.env能保存无告警。给 Ollama 备好两个模型RAG 问答要两个模型一个嵌入模型把文档变成向量一个对话模型负责推理。ollama pull bge-m3 ollama pull qwen2.5:7b第一个是嵌入模型第二个是对话模型换成你已有的模型名也行。ollama list做对了的标志列表里能看到这两个模型。⚠️ 离线机器这两步在联网机器上做模型导出后拷到目标机导入模型没就位 app 只告警不崩但问答功能暂时用不了。一条命令把服务拉起来./scripts/start_all.sh --no-pull脚本会先确认 Ollama 在跑、检查.env是否齐全再用 Compose 拉起前端、app、postgres、docreader、redis 这批容器。--no-pull表示跳过联网拉镜像、直接用本地已有的——离线部署的关键开关第一次在有网机器上装就去掉这个参数。做对了的标志终端打印前端界面: http://localhost和API接口: http://localhost:8080然后开始滚动容器日志。一条链路验到底从浏览器入口到带引用的回答5 项全过才算跑通#检查项怎么做通过标准1容器状态docker compose ps全部 Up重点看 WeKnora-app、WeKnora-postgres、WeKnora-docreader2后端健康curl -f http://localhost:8080/health返回 2003Web 界面浏览器打开http://localhost出现注册页注册并登录第一个账号4文档入库新建知识库上传一份 PDF解析状态变为完成5问答带引用问一句这份文档主要讲什么回答下方带引用出处翻车自救手册现象根因处理app 反复重启日志刷 Ollama 连不上容器里localhost指向的是容器自己不是宿主机宿主机执行curl http://localhost:11434/api/tags确认 Ollama 活着再把.env的OLLAMA_BASE_URL改回host.docker.internal文档上传直接被拒超过MAX_FILE_SIZE_MB默认上限 50MB在.env调大该值并重启 app 与 frontend上传成功但解析失败格式不受支持或解析服务异常看docker compose logs docreader报错会指明具体格式问答响应慢无 GPU 时推理全压在 CPU 上换更小的对话模型或把BATCH_EMBED_SIZE调小省内存更多故障排查见 docs/QA.md。到这里文档解析、向量检索、模型推理全落在本机数据不出机器。下一步做两件具体的事给数据卷挂独立磁盘并配定期备份把OLLAMA_BASE_URL指到内网显存最大的那台机器分担推理压力。【免费下载链接】WeKnoraOpen-source LLM knowledge platform: turn raw documents into a queryable RAG, an autonomous reasoning agent, and a self-maintaining Wiki.项目地址: https://gitcode.com/GitHub_Trending/we/WeKnora创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表