
PrivateGPT内置工具全家桶Web搜索、网页抓取与代码执行沙箱一文精通【免费下载链接】privateGPTComplete API layer for private AI applications on local models: RAG, skills, tools, MCP, text-to-sql, and more. Works with any OpenAI-compatible inference server.项目地址: https://gitcode.com/GitHub_Trending/pr/privateGPTPrivateGPT 是一套运行在本地模型之上的完整 AI API 层它的内置工具全家桶——Web 搜索web_search_v1、网页抓取web_fetch_v1与代码执行沙箱code_execution_v1能让你的本地大模型既能实时联网查资料又能安全地运行 bash 命令和 Python 脚本。本文带你快速看懂这三大工具的开启方法、配置项与最佳实践让私有 联网 会写代码的 AI 应用一步到位 全家桶速览三大内置工具一次看懂工具类型工具标识能力依赖安装 Web 搜索web_search_v1联网搜索并聚合摘要、返回带引用的答案tool-web-scraping/tools/core 网页抓取web_fetch_v1抓取任意 URL 并提取干净正文文本同上⚙️ 代码执行code_execution_v1沙箱内跑 bash、编辑文件、产出可下载成果物核心包自带无需额外依赖三个工具都可以通过两种方式使用在/v1/messages请求的tools数组中交给模型自主调用或者直接调用独立端点/v1/tools/web-search、/v1/tools/web-fetch。完整请求示例见官方文档 tools.mdx。一键开启settings.yaml 里的关键配置所有开关都集中在 settings.yaml 中支持环境变量覆盖配置段关键项默认值作用web_fetchenabledfalse开启网页抓取搜索也依赖它web_searchenabled/providerfalse/mock开启联网搜索指定搜索提供商braveapi_key空Brave Search API 密钥code_executioninternet_enabled/timeoutfalse/60秒沙箱是否允许外网、命令超时bashcpu_limit_seconds/memory_limit_mb30/512子进程 CPU 与内存上限最小可用配置长这样web_fetch: enabled: true web_search: enabled: true provider: brave brave: api_key: ${PGPT_BRAVE_API_KEY:} 注意web_search依赖web_fetch.enabled: true两项必须同时打开。详细字段说明见 web-tools.mdx。Web 搜索让本地模型实时联网搜索流程由 WebSearchService 驱动整体是三段式流水线搜索—— 调用搜索提供商内置brave与mock两种最多抓取num_links个结果筛选—— 通过处理器策略默认best_links挑选最相关的链接并控制 token 预算context_token聚合—— 抓取正文、生成摘要最终返回带引用来源的结构化答案。几个实用调参建议追求速度mode_quality: fast默认并行抓取、少引用追求质量mode_quality: accurate会提高引用数与抓取超时省钱缓存cached: true可对重复查询走缓存限流保护brave.rate_limit控制相邻请求最小间隔。网页抓取从 URL 到干净文本web_fetch_v1旧别名web_extract_v1仍受支持把任意 URL 变成模型可直接消化的纯文本。抓取能力位于 private_gpt/components/web/scraper/核心特性包括浏览器渲染基于 Playwright先执行playwright install下载浏览器可处理需要 JS 渲染的页面连接池复用pool_size默认 8个会话池 pool_idle_timeout_seconds空闲回收连续抓取不重复起浏览器批量合并batch_size/batch_wait_ms把短时间内的多个抓取请求合并执行减少延迟超时兜底timeout_seconds默认 15 秒防止慢页面拖垮整个会话。在 API 层一次抓取调用非常直接{ model: qwen3.5:35b, messages: [{role: user, content: 抓取并总结 https://example.com/article}], tools: [{name: fetch_url, type: web_fetch_v1}] }调试工具行为时Workbench 内置的API Debugger可以实时查看每一次/v1/...请求的时间线、Header 与响应体排查搜索/抓取问题非常顺手。代码执行沙箱安全地跑 bash 和 Python代码执行是全家桶里最硬核的部分源码位于 private_gpt/components/code_execution/。模型调用code_execution_v1后服务端会自动展开为bash_v1text_editor_v1后者再展开为查看、替换、创建、插入四个文件子工具并可选暴露present_files_v1交付文件与present_server_v1把沙箱里跑起来的 Web 服务暴露成可访问链接。它的安全设计值得逐个了解会话级隔离每个聊天会话拥有独立工作区模型只看到规范路径如/home/agent/workspace/真实主机路径会被自动屏蔽OS 级资源限制通过setrlimit限制 CPU 时间、虚拟内存、文件大小、子进程数量超时对整个进程组SIGKILLLinux/macOS 下全套生效默认断网internet_enabled: false时系统提示词会明确告诉模型无法联网、不能装包避免模型尝试 pip install预装生态默认已备好 pandas、numpy、matplotlib 等数据科学包以及 unzip、rg、fd、sqlite3 等常用 CLI 工具会话生命周期空闲 30 分钟自动回收工作区文件保留沙箱进程意外退出时透明重建。完整的路径布局、资源限制与平台兼容性说明见 code-execution.mdx沙箱底层抽象位于 private_gpt/components/sandbox/。新手上手三步走装对依赖Web 工具需要private-gpt[tool-web-scraping]或直接tools/core全家桶代码执行无需额外安装改好配置按上一节在 settings.yaml 打开web_fetch.enabled与web_search.enabled填入 Brave API Key发个请求试试在聊天消息里带上web_search_v1或code_execution_v1问一句最近有哪些开源大模型新闻帮我总结观察工具调用与引用返回。常见问题FAQ为什么搜索工具没反应检查web_fetch.enabled是否也为true以及brave.api_key是否注入。抓取总是超时调大web_fetch.timeout_seconds或确认目标站可被 Playwright 正常渲染。代码执行会污染服务器吗默认不会写操作只允许在工作区与 outputs 目录外网默认关闭资源有硬性上限。Windows 下资源限制还有效吗子进程隔离与资源限制在 Windows 上会被优雅跳过其余功能不受影响。 延伸阅读Web Tools 文档 · 代码执行文档 · 内置工具总览【免费下载链接】privateGPTComplete API layer for private AI applications on local models: RAG, skills, tools, MCP, text-to-sql, and more. Works with any OpenAI-compatible inference server.项目地址: https://gitcode.com/GitHub_Trending/pr/privateGPT创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考