Agent Skills
› grafana/skills
grafana/skills
GitHub提供 grafana-app-sdk 中准入控制(验证与变更)的实现指南,涵盖 Validator/Mutator 接口定义、示例代码及脚手架生成方法。
Install All Skills
npx skills add grafana/skills --all -g -y
Skills in Collection (50)
提供 grafana-app-sdk 中准入控制(验证与变更)的实现指南,涵盖 Validator/Mutator 接口定义、示例代码及脚手架生成方法。
实现资源验证逻辑
添加 mutating webhook
编写 admission handler
npx skills add grafana/skills --skill admission-control -g -y
Grafana Loki标签策略专家评估工具,用于审计、设计和优化标签架构。通过基数评分和访问模式对齐,解决查询缓慢问题,平衡存储成本与性能。
评估或审计Loki标签策略
设计新的Loki标签方案
诊断Loki查询性能慢的原因
npx skills add grafana/skills --skill loki-label-analyzer -g -y
指导将应用指标、日志、追踪和配置文件发送至 Grafana Cloud。涵盖凭证获取、Alloy 管道配置、Prometheus/Loki 直连及 OTLP SDK 集成,用于实现可观测性数据接入。
配置 Grafana Cloud 数据源
设置 Prometheus Remote Write
集成 OpenTelemetry SDK
配置 Alloy 采集管道
npx skills add grafana/skills --skill send-data -g -y
根据插件名称生成Grafana数据源配置代码(YAML/Terraform)。自动解析插件ID、获取最新版本及配置Schema,输出标准化的基础设施即代码文件。
用户希望以代码形式配置或供应Grafana数据源
用户提供插件名称但未明确提及provisioning
需要为特定插件生成datasource yaml或terraform脚本
npx skills add grafana/skills --skill datasources-provisioning -g -y
Grafana Loki日志聚合技能,涵盖LogQL语法、查询构建、解析器配置及管道调试。用于编写日志查询、分析结构化数据及排查日志流水线问题。
编写LogQL查询语句
配置Loki日志管道
解析JSON或logfmt日志格式
排查日志采集与处理故障
npx skills add grafana/skills --skill loki -g -y
提供Prometheus与Grafana指标监控指南,涵盖PromQL查询语法、聚合函数、告警规则配置及Recording Rules优化。适用于编写监控查询、设置告警路由及分析系统性能指标等场景。
编写或调试PromQL查询语句
配置Prometheus告警规则和Alertmanager路由
优化指标采集和Dashboard性能
讨论监控系统架构与最佳实践
npx skills add grafana/skills --skill prometheus -g -y
使用 pnpm 审计并精简 JavaScript 依赖,移除无用包、去重版本、分析传递依赖并报告替换或移除建议,适用于清理依赖和缩小 node_modules。
清理 pnpm 依赖
减少 lockfile 大小
缩小 Grafana 插件的 node_modules
npx skills add grafana/skills --skill audit-and-reduce-dependencies -g -y
用于审计JS/TS项目的npm/yarn/pnpm供应链安全,检查工具版本、禁用生命周期脚本、限制不安全依赖协议及设置最小发布年龄。
用户请求审计包管理器安全性
/check-npm命令
涉及Grafana插件或JS/TS项目的供应链加固
npx skills add grafana/skills --skill check-npm -g -y
提供Grafana相关的专业知识,涵盖核心概念、常用配置模式及最佳实践。适用于用户咨询Grafana监控指标(如PromQL语法)、仪表盘配置或排查常见陷阱的场景,旨在补充AI对特定监控工具的理解。
查询Grafana配置
编写PromQL查询
Grafana仪表盘设置
监控指标分析
npx skills add grafana/skills --skill your-skill-name -g -y
Grafana App SDK 入门技能,涵盖项目初始化、脚手架生成、部署模式选择及 CUE 到 Go/TS 代码生成的核心工作流。
创建新的 Grafana 应用
Grafana App Platform 初始化
选择部署模式
SDK 脚手架生成
npx skills add grafana/skills --skill app-sdk-concepts -g -y
用于为grafana-app-sdk应用编写CUE Kind定义,包括资源类型添加、版本管理、模式约束及代码生成。
添加新的资源类型
为现有Kind添加新版本
编写CUE Schema或字段约束
定义可复用的结构体类型
执行代码生成
npx skills add grafana/skills --skill cue-kind-definition -g -y
用于在 grafana-app-sdk 中实现 Reconciler 和 Watcher,处理资源生命周期事件、状态更新及控制器注册。
实现 reconciler 或 watcher
编写 reconcile 循环逻辑
处理资源创建/更新/删除事件
配置控制器选项如 namespace 过滤
npx skills add grafana/skills --skill reconciler-logic -g -y
通过自适应聚合规则降低Grafana Cloud指标成本,自动推荐高基数标签丢弃、自定义规则配置及未使用指标检测,有效减少活跃序列数量。
Grafana Cloud账单过高
指标基数爆炸或存在高基数标签
需要减少活跃序列数以降低成本
检测并丢弃未使用的指标
npx skills add grafana/skills --skill adaptive-metrics -g -y
管理Grafana Cloud账户,包括创建Stack、配置SSO/OAuth、RBAC权限分配、服务账号管理及用户团队邀请。通过API和Terraform实现自动化资源供应与审计。
设置SSO或OAuth认证
创建新的Stack实例
管理服务账号Token
分配RBAC角色或邀请用户
使用Terraform供应云资源
npx skills add grafana/skills --skill admin -g -y
提供Grafana Cloud应用、前端及AI可观测性配置方案,涵盖APM搭建、Faro SDK集成、Alloy OTLP转发及链路追踪调试。
搭建APM监控
集成前端RUM性能监控
排查服务地图缺失问题
监控LLM成本与延迟
关联前端错误与后端Trace
npx skills add grafana/skills --skill app-observability -g -y
指导如何将 AI 编码代理(如 Claude Code、Cursor)通过 MCP 协议连接至 Grafana Cloud,实现指标查询与告警管理。
配置 AI 代理访问监控数据
安装和设置 Grafana MCP 服务器
解决 AI 工具与 Grafana 的集成问题
npx skills add grafana/skills --skill assistant-mcp -g -y
配置和排障 Grafana Cloud 对 AWS、Azure 等云提供商的集成,包括设置托管导出器和 Firehose 接收器以采集监控指标与日志。
连接 AWS CloudWatch
设置 Azure Monitor
配置 Confluent Cloud 可观测性
安装 Grafana 集成
使用 AWS Firehose
云集成故障排查
npx skills add grafana/skills --skill cloud-integrations -g -y
用于管理Grafana Cloud成本,包括费用归属、降低遥测数据量(自适应指标/日志/追踪)、设置用量告警及优化检查,解决账单过高问题。
Grafana Cloud账单过高
按团队或服务归属可观测性成本
减少活跃序列/日志字节/追踪跨度
设置用量或配额告警
npx skills add grafana/skills --skill cost-management -g -y
为MySQL和PostgreSQL配置Grafana Cloud数据库可观测性,包括启用监控扩展、创建最小权限用户及配置Alloy组件。用于监控DB性能、诊断慢查询、关联APM追踪及设置告警,支持多种云托管数据库实例。
监控数据库性能
诊断慢查询
设置数据库可观测性
关联DB指标与APM
对查询延迟设置告警
npx skills add grafana/skills --skill database-observability -g -y
用于分析Grafana Cloud Prometheus账单,按DPM对指标排序以定位高基数或高成本指标。适用于排查账单过高、优化Prometheus成本及对比录制规则效果等场景。
排查Grafana Cloud账单过高
寻找高基数或噪音指标
优化Prometheus成本
对比录制规则前后的基数变化
npx skills add grafana/skills --skill dpm-finder -g -y
管理Grafana Alloy采集器集群,通过OpAMP远程推送Pipeline配置。涵盖语法验证、基于属性匹配器的目标选择、批量部署及故障排查(如REMOTE_CONFIG_STATUS_FAILED)。
配置Alloy远程策略
批量更新采集器Pipeline
排查采集器状态异常
使用OpAMP管理Agent
npx skills add grafana/skills --skill fleet-management -g -y
提供Grafana Cloud基础设施监控技能,涵盖K8s集群、Linux主机及云厂商指标的采集与接入。指导用户通过Helm Chart或Alloy配置Prometheus/Loki/Tempo数据源,实现全栈可观测性。
monitor my cluster
send K8s metrics to Grafana
scrape EC2 metrics
cluster pod logs
install the monitoring helm chart
npx skills add grafana/skills --skill infrastructure -g -y
提供Grafana Cloud的AI/ML功能集成指南,涵盖动态告警、异常检测、自动根因分析及LLM助手。支持通过API配置预测模型和RCA工作流,实现智能监控与运维自动化。
用户希望基于自然语言查询或描述创建动态告警规则
需要自动进行故障根因分析或异常点检测
意图将大语言模型(如Claude)集成到Grafana插件中
npx skills add grafana/skills --skill ml-ai -g -y
用于配置Grafana OnCall/IRM的告警路由、值班轮换、升级链及Slack ChatOps,支持Alertmanager集成与P1-P4事件生命周期管理。
配置告警路由和升级策略
设置值班轮换表
集成Alertmanager或PagerDuty
处理线上故障事件
npx skills add grafana/skills --skill oncall-irm -g -y
配置 Grafana Cloud 私有网络连接(PrivateLink/PSC),通过 VPC 端点实现指标、日志等遥测数据私网传输,规避公网暴露与出口费用,满足合规要求。
需要避免公网传输以节省 egress 费用
需满足 PCI-DSS/HIPAA 数据驻留合规
将 AWS/Azure/GCP 工作负载连接至 Grafana
npx skills add grafana/skills --skill private-connectivity -g -y
用于诊断 Prometheus 高基数问题,如内存溢出、查询慢或账单激增。提供症状排查、指标下钻及安全修复路径,防止误操作导致数据损坏。
Prometheus OOM 或内存持续增长
PromQL 查询缓慢或失败
Grafana Cloud 活跃系列或 DPM 账单异常
接收样本报错如 429 Too Many Samples
npx skills add grafana/skills --skill prometheus-cardinality-troubleshooter -g -y
Prometheus标签策略专家,审计并优化标签模式,通过控制基数和确保数据完整性来预防高基数问题。
评估或审计 Prometheus 标签策略
设计或改进 Prometheus 标签模式
询问如何从源头防止高基数
npx skills add grafana/skills --skill prometheus-label-strategy -g -y
用于编写Grafana Cloud合成监控检查,涵盖k6脚本和浏览器检查的创建、验证与部署。指导如何根据单迭代模型编写可靠性检测逻辑,选择合适检查类型,并区分其与负载测试的差异。
编写合成监控检查
将k6脚本转换为SM检查
验证用户旅程可用性
从多区域检查站点状态
npx skills add grafana/skills --skill synthetic-monitoring-checks -g -y
提供Grafana Cloud三大测试能力:Synthetic Monitoring外部探测、k6分布式负载测试及Faro前端可观测性(RUM)。用于多区域监控、发布门禁、TLS证书检查及前端性能追踪。
检查网站或API可用性
执行负载测试以验证发布条件
监控前端性能指标如Core Web Vitals
配置合成监控告警
npx skills add grafana/skills --skill testing -g -y
配置Grafana告警、事件响应管理(SLO/IRM),包括联系人、通知策略、路由及SLO定义,支持通过API/YAML自动化部署与调试。
配置告警规则或通知策略
设置SLO或多窗口燃烧率告警
调试告警路由或集成问题
建立On-call轮值与升级链
npx skills add grafana/skills --skill alerting-irm -g -y
Grafana Alloy 统一遥测采集技能,支持指标、日志、链路和性能分析的统一收集与转发。涵盖配置编写、验证、多数据源对接及故障排查,替代 Grafana Agent 或 OTel Collector。
配置 Grafana Alloy 采集指标或日志
将 OpenTelemetry 数据发送至 Prometheus/Loki/Tempo
调试遥测管道发送问题
替换旧版 Agent 或 OTel Collector
npx skills add grafana/skills --skill alloy -g -y
基于eBPF对HTTP/gRPC/DB流量进行零代码自动插桩,无需修改应用代码。支持Docker和Kubernetes DaemonSet部署,将OTLP追踪和Prometheus指标导出至Tempo或Alloy,适用于遗留系统或闭源二进制文件的可观测性接入。
添加不可重新编译服务的可观测性
使用eBPF进行零代码APM
在Kubernetes集群中滚动部署Beyla
npx skills add grafana/skills --skill beyla -g -y
通过 HTTP API 自动化创建、修改和发布 Grafana 仪表板 JSON,支持面板布局、变量模板、数据转换及 Loki/Prometheus 注解,并验证推送结果。
创建或更新 Grafana 仪表板
添加服务下拉变量
计算错误率等指标
叠加部署时间线
导出仪表板 JSON
npx skills add grafana/skills --skill dashboarding -g -y
用于配置Grafana OSS,包括通过YAML预置仪表盘和数据源、管理RBAC角色与服务账号、配置SMTP/OAuth及插件,并提供API健康检查与故障排查指南。
配置Prometheus/Loki等数据源
通过YAML或Git预置仪表盘
创建服务账号并生成Token
配置SSO或SMTP设置
npx skills add grafana/skills --skill grafana-oss -g -y
提供 OpenTelemetry 与 Grafana 集成的自动化配置方案,涵盖多语言 SDK 自动插桩、Alloy 采集器部署及 OTLP 认证调试,用于实现应用可观测性数据上报。
自动为 Java/Python 等应用添加 OpenTelemetry 支持
配置 OTLP 端点并发送指标/日志/链路到 Grafana Cloud
排查链路数据未显示或采样策略问题
npx skills add grafana/skills --skill opentelemetry -g -y
PromQL查询技能,涵盖编写、验证及优化Prometheus/Grafana指标查询。支持速率计算、直方图分位数、SLO燃烧率、录制规则转换及基数排查,解决延迟、错误率等监控问题。
编写PromQL指标查询
修复错误的p95/p99延迟计算
构建基于错误预算的告警规则
调试缓慢的查询或高基数问题
将仪表板查询迁移为录制规则
npx skills add grafana/skills --skill promql -g -y
指导编写、审计和优化Grafana Agent Skills的SKILL.md文件,确保符合Anthropic规范及CI门禁要求。涵盖触发词设计、结构分层、评分标准及验证流程。
创建新的skill
审查skill PR
Tessl评分低于75
skill描述未被Agent识别
重构长文档为bundle
询问如何编写或优化skill
npx skills add grafana/skills --skill skill-authoring -g -y
用于调查 Grafana Cloud k6 测试或运行结果的结构化工作流。支持通过 URL 识别测试、获取脚本与元数据、分析运行历史、判定通过/失败状态,并提取原始指标和日志以诊断故障原因。
用户询问特定 k6 测试或运行的状态(如是否通过)
用户提供 /a/k6-app/tests/<id> 或 /a/k6-app/runs/<id> URL
用户请求查看某次运行的指标或日志
用户询问测试失败原因或修复阈值
npx skills add grafana/skills --skill k6-cloud-investigate-test -g -y
用于编写、审查 k6 文档、TypeScript 类型定义及发布说明。涵盖 k6-DefinitelyTyped、k6-docs 和 k6 仓库,应用样式规范并验证代码示例在 master 分支的可执行性。
编写或审查 k6 相关文档
生成 TypeScript 类型定义
起草发布说明或更新变更日志
处理 k6 仓库中的任何内容
npx skills add grafana/skills --skill k6-docs -g -y
用于通过gcx CLI或curl操作Grafana Cloud k6,涵盖负载测试管理、脚本运行、指标日志查询及本地执行。
用户询问k6测试失败原因
请求获取特定运行的日志或指标
需要创建、编辑或删除k6测试/项目
要求运行k6脚本(本地或云端)
npx skills add grafana/skills --skill k6-manage -g -y
基于 k6 对公开网站进行端到端性能、负载及压力测试。生成混合测试套件、SLO 阈值及 Grafana 排查方案,确保功能测试通过后再执行负载测试。
perf test my site
load test this URL
stress test my web app
I want to load test [URL]
set up k6 against my website
npx skills add grafana/skills --skill k6-perf-test-website -g -y
用于维护和优化 k6 测试脚本的技能。涵盖阈值调整、版本迁移、服务变更适配、代码重构及最佳实践审计。通过行为感知变更控制确保测试稳定性,支持自动修复失败测试并提升脚本质量。
修复失败的 k6 测试
收紧性能阈值
迁移到新版 k6
重构测试脚本
服务变更后更新脚本
应用最佳实践
npx skills add grafana/skills --skill k6-test-maintenance -g -y
分析Grafana Cloud k6测试运行趋势,检测指标缓慢漂移(如P95延迟上升),计算阈值余量并推荐收紧。适用于性能回归检查、趋势分析及健康度评估。
用户询问测试结果趋势
用户想知道指标是否退化
用户建议收紧阈值
用户要求对特定测试进行健康检查
npx skills add grafana/skills --skill k6-trend-analysis -g -y
用于生成、验证和审查k6测试脚本的技能,支持HTTP、WebSocket、gRPC及浏览器等多种协议,涵盖负载、压力、功能测试场景。通过读取示例文件并适配需求,自动运行脚本以验证正确性,适用于各类性能与集成测试任务。
需要编写或生成k6测试脚本
请求对API或服务进行负载或压力测试
需要验证或调试现有的k6测试代码
npx skills add grafana/skills --skill k6 -g -y
提供 Grafana Mimir 的部署、配置与调试指南,支持 Prometheus/OTLP 指标存储、多租户管理及 Kubernetes/Helm 安装。
需要长期存储 Prometheus 指标
扩展 Prometheus 至单节点以上
搭建多租户指标后端
替换 Cortex
配置 remote_write 目标
npx skills add grafana/skills --skill mimir -g -y
Grafana Pyroscope持续性能分析技能,支持SDK、eBPF自动插桩及ProfileQL查询,用于CPU/内存热点定位与火焰图分析。
find what's burning CPU
flame graph this app
continuous profiling
heap hotspots
why is allocation so high
npx skills add grafana/skills --skill pyroscope -g -y
部署Grafana Tempo分布式追踪后端,支持多协议接入与对象存储。提供TraceQL查询、慢请求排查及链路/日志/指标关联分析,适用于可观测性平台搭建与性能调试。
部署 Tempo
编写 TraceQL 查询
排查无追踪数据问题
配置 S3/GCS/Azure 存储
寻找慢请求或错误服务
npx skills add grafana/skills --skill tempo -g -y
提供基于@grafana/scenes框架构建Grafana插件页面的开发指南,涵盖场景树构建、变量管理、查询执行及钻取导航等核心功能。
创建新的Grafana场景页面
添加数据面板或可视化组件
配置钻取导航和标签页
定义查询变量和运行器
npx skills add grafana/skills --skill grafana-scenes -g -y
指导优化Grafana插件包体积,通过React.lazy和Webpack代码分割减少module.js大小,提升加载性能。包含CI配置、风险分级及实施步骤。
优化插件包体积
module.js过大
插件加载慢
代码分割插件
减少初始JS负载
实现Suspense懒加载
npx skills add grafana/skills --skill plugin-bundle-size -g -y
指导将Grafana插件迁移至React 19兼容模式,包含检测上下文、扫描兼容性、更新脚手架、处理JSX运行时及修复废弃API等步骤。
用户请求更新插件以适配React 19
执行react-detect兼容性扫描
升级grafanaDependency至12.3.0
npx skills add grafana/skills --skill react-19-plugin-migration -g -y


