搜索#网页爬取

Fetch MCP Server:让智能体读任意网页的官方参考实现

MCP 官方仓库里的 Fetch 服务。只有一个 fetch 工具,把网页转成 Markdown 并分段读取,免费、免密钥,是联网读网页的最小方案。

项目与安装文档

查看项目

https://github.com/modelcontextprotocol/servers

很多时候智能体只需要读懂用户贴过来的一个链接,不需要搜索 API,也不需要爬整站。Fetch MCP Server 就做这一件事:抓取网页,把 HTML 转成 Markdown 交给模型。它在 MCP 官方的 modelcontextprotocol/servers 仓库里,和协议一起维护,该仓库截至 2026-10-06 约 9.1 万 star。

能做什么

  • 抓取网页:fetch 接收网址,返回 Markdown;raw 设为 true 时返回原始内容。
  • 分段读取:默认最多返回 5000 字符,用 start_index 从指定位置继续读,长页面可以一段一段找需要的信息。
  • 遵守 robots.txt:模型发起的请求默认遵守 robots.txt,--ignore-robots-txt 可关闭;--user-agent、--proxy-url 可自定义请求头和代理。
  • 提示词入口:同名的 fetch 提示词让用户手动指定网址抓取。
  • 多种安装方式:除了 uvx,也能 pip install mcp-server-fetch 后用 python -m mcp_server_fetch 运行,或者直接用官方 Docker 镜像 mcp/fetch。

适合谁

  • 想给 Claude Desktop 或其他客户端加上“读这个链接”能力、又不想申请任何 API 的人。
  • 写自己的 MCP 服务前,想找一个结构清楚的官方范例参考的开发者。

接入方式

需要 uv(装了 Node.js 时会用更稳的 HTML 简化器)。客户端配置:

{
  "mcpServers": {
    "fetch": {
      "command": "uvx",
      "args": ["mcp-server-fetch"]
    }
  }
}

编辑点评

它是联网读网页的基准线:免费、免密钥、只有一个工具,几乎不占上下文。和 Firecrawl 比,它不渲染 JavaScript、不爬整站,遇到单页应用常常只拿到空壳,这时该换浏览器或 Firecrawl 一类工具。官方 README 用醒目的警告提示,它能访问本地和内网 IP 地址,在公司网络里使用时要防止智能体被诱导去读内部服务。另外它依赖 MCP Python SDK 1.x(mcp>=1.29.0,<2),迁到 SDK 2.0 的工作还在进行中,暂时不能装最新版 SDK 的环境里混用。许可证为 MIT。