Agent Skills
› grafana/skills
grafana/skills
GitHub指导在 grafana-app-sdk 中实现准入控制,包括编写 Validator 和 Mutator 接口以拦截资源创建或更新请求。
Install All Skills
npx skills add grafana/skills --all -g -y
Skills in Collection (52)
Showing top 50 of 52 by quality score. Use the install list command or open individual skills for the rest.
指导在 grafana-app-sdk 中实现准入控制,包括编写 Validator 和 Mutator 接口以拦截资源创建或更新请求。
implement admission control
write a validator
add admission webhooks
validate incoming resources
npx skills add grafana/skills --skill admission-control -g -y
Grafana Loki标签策略专家评估器,用于审计、设计和优化标签模式。通过基数评分、访问模式对齐及一致性检查,解决Loki查询慢或存储成本高的问题,提供结构化建议。
评估Loki标签策略
审计日志标签设计
优化Loki查询性能
解决Loki查询缓慢问题
npx skills add grafana/skills --skill loki-label-analyzer -g -y
提供将应用或基础设施数据发送至 Grafana Cloud 的完整指南,涵盖 Metrics、Logs、Traces 及 Profiles。支持 Alloy 管道配置、Prometheus Remote Write、Loki Push 及 OTLP SDK 集成,帮助用户完成凭证获取与数据接入配置。
需要连接应用或基础设施到 Grafana Cloud
配置遥测数据(指标、日志、追踪)的发送
设置 Prometheus remote write 或 Loki push
选择并实施不同的数据摄入方法
npx skills add grafana/skills --skill send-data -g -y
根据插件名称自动生成Grafana数据源配置代码(YAML/Terraform),通过API获取最新插件ID、版本及设置Schema,实现基础设施即代码的自动化配置。
用户需要为特定插件生成数据源配置文件
用户询问如何以代码形式配置Grafana数据源
用户提供插件名称但未明确提及provisioning
npx skills add grafana/skills --skill datasources-provisioning -g -y
提供Grafana Loki日志聚合系统的LogQL语法参考、查询构建及架构配置指南,支持日志解析与管道排错。
编写或调试LogQL查询语句
配置Loki日志收集管道
分析结构化或非结构化日志数据
npx skills add grafana/skills --skill loki -g -y
利用profilecli查询Pyroscope性能数据,结合pprof与源码分析服务热点,定位CPU、内存等性能瓶颈并提供优化建议。
需要分析服务性能瓶颈
查询Pyroscope连续配置文件
排查CPU或内存占用过高问题
npx skills add grafana/skills --skill profilecli-insights -g -y
提供Prometheus和Grafana指标监控的参考,涵盖PromQL查询语法、聚合函数、常见监控模式(如错误率、CPU使用率)、告警规则配置及Alertmanager路由设置,适用于监控系统开发与维护。
编写或调试PromQL查询语句
配置Prometheus告警规则与Alertmanager路由
分析系统指标架构与最佳实践
npx skills add grafana/skills --skill prometheus -g -y
基于pnpm审计并缩减JavaScript依赖,通过移除无用包、去重版本及内联提升安全性与性能。
清理pnpm依赖
减小lockfile体积
优化Grafana插件node_modules
npx skills add grafana/skills --skill audit-and-reduce-dependencies -g -y
对JS/TS项目的npm/yarn/pnpm配置进行供应链安全审计,检查工具版本、生命周期脚本禁用、不安全依赖协议及最小发布年龄。
/check-npm
询问包管理器安全审计
npx skills add grafana/skills --skill check-npm -g -y
这是一个未填充内容的 SKILL.md 模板,旨在提供 Grafana 相关知识的结构化文档框架。当前内容仅为占位符,无实际功能描述或触发逻辑,无法用于自动加载或执行具体任务。
询问Grafana配置
需要PromQL示例
设置监控面板
npx skills add grafana/skills --skill your-skill-name -g -y
用于Grafana App SDK的脚手架、初始化及部署模式选择,涵盖CUE Schema工作流、代码生成与配置对接。
创建新的Grafana应用项目
选择独立Operator或grafana/apps部署模式
初始化SDK项目结构
配置应用特定设置
npx skills add grafana/skills --skill app-sdk-concepts -g -y
用于使用CUE语言定义Grafana应用SDK的资源类型(Kind),包括脚手架生成、版本管理、字段约束及代码生成。适用于添加新资源、扩展版本或编写Schema的场景。
添加新的资源类型
为现有Kind添加新版本
编写CUE Schema或字段约束
定义命名类型或自定义路由
用户询问如何建模资源或添加CUE模式
npx skills add grafana/skills --skill cue-kind-definition -g -y
指导实现 grafana-app-sdk 的 Reconciler 和 Watcher,涵盖类型安全模式、状态更新、事件处理及控制器注册,用于编写异步业务逻辑和资源状态同步。
编写 reconciler
实现 reconcile 循环
添加异步业务逻辑
处理资源创建/更新/删除事件
注册控制器到 app.go
npx skills add grafana/skills --skill reconciler-logic -g -y
用于降低Grafana Cloud指标存储成本,通过自动推荐或自定义规则预聚合高基数指标、丢弃无用标签和指标,减少活跃系列数。适用于账单调查、高基数排查及度量优化场景。
调查Grafana Cloud高账单
排查高基数标签(如pod_uid, version)
用户提及减少基数或节省指标费用
npx skills add grafana/skills --skill adaptive-metrics -g -y
管理Grafana Cloud账号,包括创建Stack、配置SSO/OAuth、管理RBAC角色、服务账户及用户邀请。支持通过API或Terraform进行资源自动供应与审计。
设置SSO/SAML/OAuth
创建Stack或组织
管理服务账户令牌
分配RBAC角色
邀请用户或管理团队
npx skills add grafana/skills --skill admin -g -y
提供Grafana Cloud应用、前端及AI可观测性配置指南,涵盖APM设置、Faro SDK集成、Alloy转发及故障排查。
set up APM
show service map
monitor browser perf
session replay
RUM SDK
watch our OpenAI bill
npx skills add grafana/skills --skill app-observability -g -y
指导如何将 AI 编码助手(Claude、Cursor 等)通过 MCP 协议连接至 Grafana Cloud,涵盖安装、配置及验证步骤。
配置 AI 代理访问 Grafana
设置 Grafana MCP 服务器
在 IDE 中集成监控工具
npx skills add grafana/skills --skill assistant-mcp -g -y
指导用户配置和排查 Grafana Cloud 与 AWS、Azure 等云提供商的集成,包括设置托管导出器、Firehose 接收器及权限管理。
连接 AWS CloudWatch
设置 Azure Monitor
配置 Confluent Cloud 可观测性
安装 Grafana 集成
使用 AWS Firehose
排查云集成问题
npx skills add grafana/skills --skill cloud-integrations -g -y
管理Grafana Cloud成本,通过标签分摊费用、使用自适应信号降低遥测数据量及设置用量告警。
调查高额的Grafana Cloud账单
将可观测性成本分摊到团队或服务
减少活跃序列/日志字节/追踪跨度
设置用量或配额告警
npx skills add grafana/skills --skill cost-management -g -y
为MySQL和PostgreSQL配置Grafana Cloud数据库可观测性,包括启用监控扩展、创建最小权限用户及Alloy组件配置,实现查询性能分析、慢查询诊断与APM关联。
monitoring database performance
diagnosing slow queries
setting up DB observability for RDS / Aurora / Cloud SQL / Azure Database / self-managed instances
correlating DB metrics with APM
alerting on query latency
my database is slow
find the slow queries
monitor RDS
npx skills add grafana/skills --skill database-observability -g -y
用于分析Grafana Cloud Prometheus指标DPM,定位高基数和昂贵指标以优化账单。适用于排查高额费用、寻找噪声指标或评估记录规则基数影响等场景。
排查Grafana Cloud高额账单
寻找高基数或噪声指标
优化Prometheus成本
评估记录规则基数影响
npx skills add grafana/skills --skill dpm-finder -g -y
管理 Grafana Alloy 采集器集群,通过 OpAMP 远程分发和热更新 Pipeline 配置。支持基于属性匹配器批量部署、本地语法验证及故障排查,实现集中式 Agent 配置管理。
配置或推送 Alloy 采集器管道
使用 OpAMP 进行远程配置管理
排查采集器 REMOTE_CONFIG_STATUS_FAILED 错误
在部署前验证 River 语法
npx skills add grafana/skills --skill fleet-management -g -y
诊断 Grafana Frontend RUM 会话健康状态,分析错误、根因及修复建议。支持获取遥测数据并可选深入查看重放或 Trace。
用户要求解释、诊断、分析或进行 RCA
询问会话是否健康
提供前端可观测性上下文(app id, session id)
提及 Faro, Core Web Vitals, ANR 等
npx skills add grafana/skills --skill frontend-session-rca -g -y
用于将Kubernetes集群、主机、容器及云提供商的遥测数据接入Grafana Cloud,涵盖Helm部署、Alloy配置、数据源设置及故障排查。
监控K8s集群指标或日志
安装Grafana监控Helm Chart
配置Linux主机或容器监控
拉取AWS/Azure/GCP云指标
npx skills add grafana/skills --skill infrastructure -g -y
集成Grafana Cloud的AI与ML能力,提供动态告警(Prophet预测、DBSCAN异常检测)、Sift自动根因分析、LLM插件及自然语言查询功能。适用于智能监控、自动化故障排查和NL到PromQL转换场景。
设置无需静态阈值的智能异常告警
使用自然语言生成Dashboard或查询指标
执行自动化故障根因调查
配置LLM代理以支持AI插件
npx skills add grafana/skills --skill ml-ai -g -y
配置Grafana OnCall/IRM实现告警路由、值班轮换及事件管理。支持集成Alertmanager等源,定义Jinja2路由与升级链,管理排班表及Slack ChatOps操作,覆盖P1-P4事件生命周期。
配置告警路由规则
设置值班轮换排班
创建升级策略链
接入Slack通知或ChatOps
声明或处理告警事件
npx skills add grafana/skills --skill oncall-irm -g -y
配置Grafana Cloud私有网络连接,支持AWS/Azure/GCP的PrivateLink或PSC。通过创建VPC端点、验证DNS解析及更新Alloy配置,实现遥测数据不经过公网传输,以降低Egress费用并满足合规要求。
配置云厂商私有端点以连接SaaS服务
减少云网络出口流量费用
满足PCI-DSS或HIPAA等数据驻留合规要求
防止遥测数据暴露在公共互联网
npx skills add grafana/skills --skill private-connectivity -g -y
诊断 Prometheus 高基数问题,解决慢查询、OOM、账单激增等故障。提供从症状排查到安全修复的系统化指南,严禁使用 labeldrop 破坏数据。
Prometheus OOM 或内存增长
查询缓慢或报错
Grafana Cloud Active Series 或 DPM 账单飙升
收到 too many samples 错误
npx skills add grafana/skills --skill prometheus-cardinality-troubleshooter -g -y
Prometheus标签策略专家,评估审计并设计标签架构。核心在于从源头防止高基数问题,指导应用代码和抓取目标配置,避免错误删除唯一标识标签导致数据损坏。
评估或审计 Prometheus 标签策略
设计或改进 Prometheus 标签架构
询问如何从源头预防高基数问题
npx skills add grafana/skills --skill prometheus-label-strategy -g -y
用于编写Grafana Cloud合成监控检查,覆盖k6脚本、浏览器及协议类型。强调单迭代执行模型与可用性验证,区分于负载测试,支持本地校验、多区域探测及多种部署方式。
编写合成监控检查
验证用户旅程可用性
将k6脚本转换为监控检查
查询站点在多区域的连通性
npx skills add grafana/skills --skill synthetic-monitoring-checks -g -y
基于Grafana Cloud进行前端与API测试,涵盖Synthetic Monitoring多探针探测、k6分布式负载测试及Faro前端实时用户监控(RUM),用于验证可用性、性能及错误追踪。
检查网站或API在多区域的可用性
执行发布前的负载测试门禁
监控TLS证书有效期
为React/Vue应用集成前端性能监控
追踪核心网页指标(Core Web Vitals)
将前端错误与后端链路关联
npx skills add grafana/skills --skill testing -g -y
配置Grafana告警、IRM及SLO,涵盖联系人、通知策略、On-call排班、Incident管理及多窗口燃烧率告警。支持YAML/API Provisioning,用于告警路由调试、集成验证及故障排查。
配置告警规则和通知渠道
设置On-call轮值和升级链
定义和管理SLO指标
调试告警未触发或路由错误
集成IRM系统处理事件
npx skills add grafana/skills --skill alerting-irm -g -y
用于构建基于Grafana Alloy的统一遥测管道,支持指标、日志、链路和性能数据的采集与转发。涵盖配置编写、验证及调试场景。
配置OpenTelemetry兼容的收集器
设置Prometheus/Loki/Tempo数据发送
调试遥测数据未发送问题
npx skills add grafana/skills --skill alloy -g -y
基于eBPF实现零代码修改的应用程序HTTP/gRPC/DB流量自动注入,支持Docker及Kubernetes集群部署,将遥测数据导出至Tempo或Prometheus,适用于遗留系统或闭源二进制文件的可观测性接入。
需要为无法重新编译的应用添加可观测性
使用eBPF进行无SDK的APM集成
在Kubernetes中部署集群级监控守护进程
npx skills add grafana/skills --skill beyla -g -y
通过HTTP API自动化构建、修改和发布Grafana仪表盘JSON。支持面板布局、模板变量、数据转换及Loki/Prometheus注解,并包含API推送与版本验证流程。
创建新的仪表盘
添加服务下拉变量
计算错误率列
覆盖部署注解
导出仪表盘JSON
npx skills add grafana/skills --skill dashboarding -g -y
配置 Grafana OSS,涵盖从 YAML 自动化编排仪表盘和数据源、管理 RBAC 角色与令牌,到验证健康状态的全流程。用于解决监控面板搭建、数据源集成及用户权限管理等运维基础设施任务。
配置 Prometheus/Loki 等数据源
通过 YAML 自动部署仪表盘
创建服务账号并分配角色
配置 Grafana 服务器参数 (grafana.ini)
排查仪表盘未显示或数据源连接失败
npx skills add grafana/skills --skill grafana-oss -g -y
提供OpenTelemetry与Grafana集成方案,涵盖多语言SDK自动注入、Alloy收集器配置及K8s Operator使用,支持向Grafana Cloud或自建后端发送指标、日志和追踪数据。
自动化应用代码插桩
配置OTLP端点认证
排查遥测数据未显示问题
选择采样策略
npx skills add grafana/skills --skill opentelemetry -g -y
提供PromQL查询编写、验证与优化指南,涵盖速率计算、聚合、直方图分位数及防除零等模式。用于解决查询慢、基数爆炸、SLO告警及将慢查询迁移为录制规则等场景。
编写或调试Prometheus/Grafana指标查询
优化慢查询或排查高基数问题
构建SLO错误或燃烧率告警
将Dashboard查询转换为录制规则
npx skills add grafana/skills --skill promql -g -y
提供 Grafana SKILL.md 文件的编写、审查与优化指南。涵盖 Anthropic 对齐标准、CI 门禁规则(Tessl评分)、渐进式披露结构及描述触发模式,辅助开发者创建高质量技能文档并满足合并要求。
创建新的 Grafana 技能文件
审查技能 PR 或重构长文档
技能 Tessl 评分低于 75 需修复
技能描述无法被 Agent 正确触发
询问如何编写、优化或审计技能
npx skills add grafana/skills --skill skill-authoring -g -y
针对Grafana Cloud k6测试或运行结果进行深度调查的技能。通过结构化流程分析脚本、提取指标与日志、判定通过率及失败原因,并支持安全修复脚本,适用于排查测试故障和性能诊断场景。
用户询问测试是否通过或失败原因
提供k6测试或运行的URL
请求查看特定运行的指标或日志
需要修复失败的阈值或检查项
npx skills add grafana/skills --skill k6-cloud-investigate-test -g -y
用于编写、审查和验证 k6 相关文档(用户手册、TypeScript 类型定义及发布说明),确保示例代码在 master 分支上可运行并符合规范。
编写或编辑 k6 文档
审查 k6 文档内容
生成 TypeScript 类型定义
起草或更新发布说明
npx skills add grafana/skills --skill k6-docs -g -y
管理Grafana Cloud k6服务,包括负载测试、脚本、项目及调度配置,支持通过gcx CLI或curl获取指标与日志。适用于性能测试运维及故障排查场景。
管理k6负载测试或运行任务
查询测试日志或性能指标
配置k6项目限制或调度
本地或云端执行k6脚本
npx skills add grafana/skills --skill k6-manage -g -y
用于对公开网站进行端到端性能、负载及压力测试的 k6 工作流。生成混合测试套件、SLO 阈值、监控旁路及 Grafana 排查手册,覆盖功能验证至大规模压测全流程。
perf test my site
load test this URL
stress test my web app
set up k6 against my website
npx skills add grafana/skills --skill k6-perf-test-website -g -y
维护和改进 k6 测试脚本,涵盖阈值调整、版本迁移、服务变更适配、代码重构及最佳实践审计。通过行为感知变更控制确保稳定性,严格执行验证循环以修复失败测试并优化脚本质量。
修复失败的 k6 测试
收紧阈值
迁移到新版 k6
服务变更后更新脚本
重构测试代码
应用最佳实践
npx skills add grafana/skills --skill k6-test-maintenance -g -y
分析 Grafana Cloud k6 测试运行趋势,检测指标缓慢漂移、计算阈值余量并推荐调整。用于性能回归检查及趋势评估。
询问测试趋势如 'how is my test trending'
检查性能退化如 'is P95 getting worse'
请求收紧阈值建议
查看特定测试或项目所有测试的健康状况
npx skills add grafana/skills --skill k6-trend-analysis -g -y
用于生成、验证和审查k6性能测试脚本的技能,覆盖HTTP、WebSocket、gRPC及浏览器等多种协议与执行器,支持压力、负载、冒烟等测试场景及自定义指标配置。
需要生成或编写k6性能测试脚本
对现有k6测试脚本进行验证或调试
询问关于k6执行器、阈值或扩展库的使用问题
npx skills add grafana/skills --skill k6 -g -y
用于搭建、配置和调试 Grafana Mimir,提供 Prometheus/OTLP 指标的长期存储与多租户支持。涵盖本地 Docker 启动、K8s Helm 部署、remote_write 对接及故障排查场景。
需要长期存储 Prometheus 指标
扩展 Prometheus 至单节点以上
搭建多租户指标后端
替换 Cortex 或配置 remote_write
Mimir 服务健康检查失败
npx skills add grafana/skills --skill mimir -g -y
用于应用连续性能剖析,支持多语言SDK、Alloy eBPF自动注入及ProfileQL查询。帮助用户部署监控、定位CPU/内存热点、对比性能回归及关联Trace分析。
添加服务性能剖析
部署集群级eBPF分析器
通过火焰图查找CPU或内存热点
对比两个Profile以发现性能回归
将慢速Trace与Profile关联
npx skills add grafana/skills --skill pyroscope -g -y
部署 Grafana Tempo 分布式追踪后端,支持 TraceQL 查询、多租户配置及 S3/GCS 存储集成。涵盖从本地 Docker 启动到 Kubernetes Helm 部署,以及通过 Alloy 采集链路数据的全流程。
部署 Tempo 或 Jaeger 兼容存储
编写 TraceQL 查询慢请求或错误链路
调试无 traces 显示问题
配置对象存储以存储追踪数据
npx skills add grafana/skills --skill tempo -g -y
用于构建基于@grafana/scenes框架的Grafana插件页面,支持创建场景、面板、变量及钻取导航等交互功能。
创建新的Grafana Scene页面或组件
配置查询运行器、数据转换器或可视化面板
设置钻取导航、标签页或全局变量
npx skills add grafana/skills --skill grafana-scenes -g -y


