云运维

Grafana MCP:让智能体查仪表盘、指标和日志

Grafana 官方 MCP:智能体能搜仪表盘、跑 PromQL 和 LogQL、查告警规则和值班表、处理事故,一个入口连通多种数据源。

项目与安装文档

查看项目

https://github.com/grafana/mcp-grafana

线上告警响了,值班的人要先打开 Grafana 找对应的仪表盘,再去 Prometheus 写 PromQL、去 Loki 翻日志,一圈下来十几分钟。Grafana MCP 让智能体通过你的 Grafana 实例完成这些查询:搜仪表盘、跑指标和日志查询、看告警和值班信息,数据源的认证由 Grafana 负责,凭据不经过 MCP 服务器。它由 Grafana Labs 官方维护,截至 2026-10-06 约 3500 star。

能做什么

  • 仪表盘:按标题、文件夹、标签搜索仪表盘;get_dashboard_summary 返回精简概览,get_dashboard_property 用 JSONPath 只取需要的部分,避免整份 JSON 撑爆上下文。
  • 指标与日志查询:执行 PromQL(含直方图分位数)、LogQL,读取标签和元数据,查看 Loki 识别出的日志模式。
  • 更多数据源:按需开启 ClickHouse、Snowflake、PostgreSQL 等 SQL 数据源,以及 CloudWatch、Elasticsearch、InfluxDB、Graphite 等工具。
  • 告警与值班:查看告警规则状态和通知策略,查询 Grafana OnCall 的排班和当前值班人,搜索、创建、更新 Grafana Incident 事故。
  • 按类别开关:--disable-write 关掉所有写工具,--disable-<category> 关掉整类工具。

适合谁

  • 值班时想让智能体先把相关指标、日志和告警汇总一遍的 SRE。
  • 用 Grafana 看监控、希望智能体改完代码后顺手核对线上指标的开发者。

接入方式

需要 Grafana 9.0 或更新版本、一个服务账号令牌,以及 uv:

{
  "mcpServers": {
    "grafana": {
      "command": "uvx",
      "args": ["mcp-grafana"],
      "env": {
        "GRAFANA_URL": "http://localhost:3000",
        "GRAFANA_SERVICE_ACCOUNT_TOKEN": "<your service account token>"
      }
    }
  }
}

Grafana Cloud 用户把 GRAFANA_URL 换成自己的实例地址;README 还提供 Docker、二进制和 Helm 的部署方式。

编辑点评

可观测性 MCP 里,Grafana 的位置特殊:很多团队的 Prometheus、Loki、Elasticsearch 都挂在 Grafana 下面,接一个服务器就能查到大部分监控数据,不必为每个后端单独配一个 MCP。它在上下文控制上花了心思,仪表盘摘要、JSONPath 取值、结果截断都是为此设计。要注意它默认包含写工具,可以修改仪表盘、创建和删除告警规则、创建事故,只想查询就加 --disable-write,服务账号也按最小权限创建。匿名使用统计默认开启,会每 4 小时向 Grafana Labs 报告调用了哪些工具,用 --usage-stats=disabled 或 DO_NOT_TRACK=1 关闭。许可证为 Apache-2.0。