# 在 llama-server 网页里用原生工具做联网资料检索的实操分享

> 原标题：How I do use the recent llama.cpp native tools to do web rag a.k.a. web_fetch (or anything else for the matter) directly from inside the llama-server's webui

- 来源：r/LocalLLaMA
- 发布时间：2026-05-24T11:02:32.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/26440
- 原文：https://www.reddit.com/r/LocalLLaMA/comments/1tm93ng/how_i_do_use_the_recent_llamacpp_native_tools_to/

## 摘要

一位 Reddit 用户分享了怎么在 llama-server 自带的网页界面里，直接用 llama.cpp 的原生工具实现联网资料检索（也就是 web RAG）。他的做法分七步：先开启 get_datetime 和 exec_shell_command 这两个工具，然后让模型通过 firejail 沙箱、一个独立的 Linux 用户以及一个 Alpi...

## 推荐理由

这是一篇社区教程，不是模型发布或产品更新，所以权威性和覆盖面有限，但实操价值高。H、K、R 三项都成立：动手门槛低、步骤清晰、切中本地部署的痛点。我会先打个折，因为来源是个人帖子，验证强度弱，但信息量足够放进精选。

## 锐评

这条帖子讲的是怎么在 llama-server 的网页界面里，直接用 llama.cpp 的原生工具实现联网资料检索。作者给了一套七步操作，包括开启 get_datetime 和 exec_shell_command 两个工具，再通过 firejail 沙箱、独立 Linux 用户和 Alpine OCI 虚拟机来跑 wget 抓网页，安全隔离做得挺细。

但问题是，Reddit 原文返回了 403，我们拿到的只有“你被网络安全屏蔽了”的提示，正文完全缺失。所以上面这些步骤是从摘要里拼出来的，具体配置参数、命令写法、模型选型（摘要提到 Qwen）以及实际效果，正文都没披露。

对想复现的人来说，这条信息目前只能当个方向参考。安全隔离的思路值得看，但能不能跑通、延迟多大、检索质量如何，都得等原文恢复或者作者补发才能判断。
