Agent Skills
› grafana/skills
grafana/skills
GitHub提供 grafana-app-sdk 应用中准入控制(验证与变异)的实现指南,涵盖 Validator 和 Mutator 接口定义、代码示例及 Webhook 注册方式。
Install All Skills
npx skills add grafana/skills --all -g -y
Skills in Collection (51)
Showing top 50 of 51 by quality score. Use the install list command or open individual skills for the rest.
提供 grafana-app-sdk 应用中准入控制(验证与变异)的实现指南,涵盖 Validator 和 Mutator 接口定义、代码示例及 Webhook 注册方式。
实现资源验证逻辑
添加 admission webhook
编写 mutating handler
在 grafana-app-sdk 中拦截并校验/修改资源
npx skills add grafana/skills --skill admission-control -g -y
Grafana Loki标签策略专家评估工具,用于审计、设计和优化标签方案。通过基数评分、访问模式对齐及一致性检查,解决查询缓慢问题,防止高基数标签导致性能灾难,并提供结构化建议。
评估Loki标签策略
审计现有标签配置
设计新的标签架构
优化或改进标签方案
排查Loki查询缓慢原因
npx skills add grafana/skills --skill loki-label-analyzer -g -y
提供将应用指标、日志、链路追踪及性能数据发送至 Grafana Cloud 的配置指南,涵盖 Alloy 编排、Prometheus Remote Write、Loki Push 及 OpenTelemetry SDK 集成方式。
配置监控数据上报
接入 Grafana Cloud
设置遥测数据管道
npx skills add grafana/skills --skill send-data -g -y
根据Grafana插件CDN的标准配置模式,自动生成数据源基础设施即代码(YAML或Terraform)文件。支持从插件名称解析ID、获取版本及架构,实现数据源的自动化配置与 provision。
用户请求生成Grafana数据源的YAML或Terraform配置文件
用户提及特定插件(如Clickhouse, Infinity)的配置或provisioning需求
需要将现有数据源转换为代码格式
npx skills add grafana/skills --skill datasources-provisioning -g -y
Grafana Loki 日志聚合与 LogQL 查询技能。涵盖 LogQL 语法、解析器、架构及管道配置,用于编写查询、排查日志问题和分析数据。
编写 LogQL 查询语句
配置 Loki 或日志采集管道
排查日志管道故障
分析应用日志数据
npx skills add grafana/skills --skill loki -g -y
基于profilecli查询Pyroscope性能数据,结合pprof分析热点函数并与源码关联,定位服务性能瓶颈。
用户请求调查服务性能问题
需要分析CPU、内存或锁争用等运行时指标
npx skills add grafana/skills --skill profilecli-insights -g -y
提供Prometheus与Grafana指标监控技能,涵盖PromQL语法、聚合计算、告警规则配置及最佳实践,用于系统可观测性开发与运维。
编写PromQL查询语句
配置Prometheus告警规则
分析系统指标与性能瓶颈
集成Grafana Cloud监控
npx skills add grafana/skills --skill prometheus -g -y
专注于使用 pnpm 减少 JavaScript 依赖体积,通过移除未用依赖、去重版本、分析传递依赖及内联 trivial 包来优化 lockfile 和 node_modules。
清理 pnpm 依赖
减小 lockfile 大小
缩小 Grafana 插件的 node_modules
npx skills add grafana/skills --skill audit-and-reduce-dependencies -g -y
只读审计JS/TS仓库的npm/yarn/pnpm供应链安全,检查工具版本、生命周期脚本禁用、不安全依赖协议及最小发布年龄。
/check-npm命令
询问包管理器安全审计
检查lifecycle scripts
检查git依赖配置
检查ignore-scripts设置
npx skills add grafana/skills --skill check-npm -g -y
这是一个通用的技能模板,用于定义特定领域(如Grafana)的知识结构。包含概览、关键概念、常见模式及最佳实践章节,旨在指导AI助手在相关场景下提供专业支持。
用户询问特定工具或框架的使用
需要查询某领域的最佳实践
希望获取特定技术栈的配置示例
npx skills add grafana/skills --skill your-skill-name -g -y
Grafana App SDK 开发指南,涵盖 CLI 安装、项目初始化、三种部署模式(独立操作符/平台内嵌/前端)及 CUE 到 Go/TS 代码生成的工作流。
创建新的 Grafana 应用
Grafana App Platform 初始化
选择部署模式
SDK 脚手架生成
npx skills add grafana/skills --skill app-sdk-concepts -g -y
用于在 Grafana App SDK 中定义 CUE Kind,涵盖新建资源、版本管理及 Schema 约束编写。支持脚手架生成、类型约束配置及代码生成流程。
添加新的 Kind 资源
为现有 Kind 添加新版本
编写 CUE Schema 字段约束
定义可复用的 #Definition 类型
配置自定义路由或代码生成
npx skills add grafana/skills --skill cue-kind-definition -g -y
指导实现 grafana-app-sdk 的 Reconciler 和 Watcher,包括生成代码、配置选项、处理资源状态变更及注册控制器。
编写 reconciler
实现 reconcile 循环
添加异步业务逻辑
处理资源事件
注册控制器
npx skills add grafana/skills --skill reconciler-logic -g -y
通过自适应聚合规则降低Grafana Cloud指标成本,自动推荐或手动配置高基数标签丢弃与聚合策略,减少活跃序列数以优化账单。
调查高昂的Grafana Cloud账单
处理高基数标签如pod_uid或version
用户提及减少基数、系列爆炸或指标支出
npx skills add grafana/skills --skill adaptive-metrics -g -y
管理Grafana Cloud账户,涵盖组织与Stack生命周期、RBAC权限分配、SSO配置及CI/CD服务账号创建。支持通过API或Terraform进行自动化资源供应和团队入职流程。
配置单点登录(SSO/SAML/OAuth)
创建或管理Grafana Stack
设置RBAC角色和用户权限
生成CI/CD用的服务账号Token
邀请用户或管理团队
npx skills add grafana/skills --skill admin -g -y
提供Grafana Cloud应用、前端及AI可观测性配置指南,涵盖APM设置、Faro SDK集成、Alloy转发及监控验证。
setup APM
instrument frontend RUM
monitor LLM cost
debug service map
configure Alloy OTLP
npx skills add grafana/skills --skill app-observability -g -y
指导如何将 Grafana Cloud MCP Server 集成至 Claude Code、Cursor 等 AI 编程助手,支持 stdio 和 SSE 传输,涵盖安装、令牌配置及安全设置。
连接 AI 编码代理到 Grafana
配置 Grafana MCP 服务器
在 Cursor/VS Code 中使用 Grafana 工具
npx skills add grafana/skills --skill assistant-mcp -g -y
用于配置和排查 Grafana Cloud 对 AWS、Azure 等云提供商的监控集成,包括设置托管导出器和 Firehose 接收器。
AWS CloudWatch
Azure Monitor
Confluent integration
cloud integration
hosted exporter
AWS Firehose
npx skills add grafana/skills --skill cloud-integrations -g -y
用于优化Grafana Cloud账单,通过成本归属、自适应指标/日志/追踪降噪及用量告警降低遥测支出。
Grafana Cloud账单过高
按团队或服务分摊可观测性成本
减少活跃序列/日志字节/追踪跨度
设置用量或配额告警
npx skills add grafana/skills --skill cost-management -g -y
为MySQL和PostgreSQL配置Grafana云数据库可观测性,支持自托管及主流云数据库。实现查询级洞察、慢SQL诊断、APM关联及告警,无需修改应用代码。
监控数据库性能
诊断慢查询
设置数据库可观测性
关联DB指标与APM
npx skills add grafana/skills --skill database-observability -g -y
Grafana云Prometheus账单优化工具,按每分钟数据点数(DPM)对指标排序并分析基数。用于排查高消费、识别高基数噪声指标及优化Prometheus成本。
查询Grafana Cloud账单过高原因
寻找高消耗或高基数的Prometheus指标
优化Prometheus成本
分析指标基数 offender
npx skills add grafana/skills --skill dpm-finder -g -y
管理Grafana Alloy采集器集群,通过OpAMP远程分发和热更新River配置。支持批量部署、属性匹配、本地语法验证及故障排查。
配置Alloy采集器
远程推送Pipeline配置
使用OpAMP管理Agent
排查REMOTE_CONFIG_STATUS_FAILED
验证River语法
npx skills add grafana/skills --skill fleet-management -g -y
提供Grafana Cloud基础设施监控方案,涵盖K8s集群、Linux主机及云厂商指标的上报与配置。支持通过Helm Chart或Alloy进行数据采集、告警设置及数据源对接,适用于新节点接入和监控排查场景。
monitor my cluster
send K8s metrics to Grafana
scrape EC2 metrics
cluster pod logs
install the monitoring helm chart
npx skills add grafana/skills --skill infrastructure -g -y
Grafana Cloud AI与ML技能,涵盖动态告警、异常检测、自动根因分析及LLM助手集成。
创建基于Prophet或DBSCAN的动态告警规则
使用Sift进行自动化事故调查
通过自然语言生成PromQL查询或仪表盘
配置LLM插件连接外部大模型
npx skills add grafana/skills --skill ml-ai -g -y
用于配置Grafana OnCall/IRM的告警路由、值班轮换、升级链及Slack ChatOps。支持Alertmanager集成、Jinja2模板编写、调度管理及P1-P4事故生命周期处理,适用于告警接入与应急响应场景。
配置告警接收器或Webhook集成
设置值班轮换或调度表
定义升级链和通知策略
通过Slack进行事故确认或解决
调试告警路由规则
npx skills add grafana/skills --skill oncall-irm -g -y
配置AWS PrivateLink、Azure Private Link等私有连接,将遥测数据通过云厂商内网发送至Grafana Cloud,避免公网暴露与流量费用,满足合规要求。
需要降低云厂商出网流量费用
需满足PCI-DSS或HIPAA数据驻留合规要求
要求遥测数据不经过公共互联网
npx skills add grafana/skills --skill private-connectivity -g -y
诊断 Prometheus 高基数问题,解决内存溢出、查询慢及费用激增。提供症状归因、指标下钻及安全修复路径,严禁使用 labeldrop 破坏数据。
Prometheus OOM 或内存持续增长
PromQL 查询缓慢或失败
Grafana Cloud 账单(DPM/Active Series)异常飙升
收到 429 Too Many Samples 错误
npx skills add grafana/skills --skill prometheus-cardinality-troubleshooter -g -y
Prometheus标签策略专家,审计并设计标签方案以从源头预防高基数。遵循不丢弃唯一标识标签原则,指导应用代码优化与采集配置,避免数据错误与成本激增。
评估或审计Prometheus标签策略
询问如何从源头防止高基数
设计或改进标签模式
npx skills add grafana/skills --skill prometheus-label-strategy -g -y
用于编写Grafana Cloud合成监控检查,覆盖k6脚本、浏览器及协议检查。指导如何验证用户旅程、处理断言与部署,明确区分可靠性监测与负载测试场景。
编写合成监控检查
将k6脚本或OpenAPI规范转换为检查
验证生产环境中的登录或结账流程
确认站点在多区域是否可用
npx skills add grafana/skills --skill synthetic-monitoring-checks -g -y
基于Grafana Cloud提供三大测试能力:Synthetic Monitoring进行多地域可用性探测,k6执行分布式负载测试以发布门禁,Faro SDK实现前端真实用户监控及性能分析。
检查网站或API在多区域的可用性状态
在CI/CD流水线中执行负载测试以验证发布条件
监控TLS证书有效期
在前端应用中集成遥测SDK以追踪核心网页指标
关联前端错误与后端链路追踪
npx skills add grafana/skills --skill testing -g -y
配置Grafana告警、IRM及SLO,涵盖联系点、通知策略、静默、值班轮转、集成与多窗口燃烧率告警。支持YAML/API配置、路由调试及故障排查。
配置Grafana告警规则
设置通知路由和联系人
定义和管理SLO
调试告警未触发的原因
建立值班轮转和升级链
npx skills add grafana/skills --skill alerting-irm -g -y
用于构建基于Grafana Alloy的统一遥测管道,支持指标、日志、追踪和性能分析数据的采集与发送。涵盖配置编写、验证及K8s/Docker环境下的数据集成与调试。
需要配置OpenTelemetry兼容的采集器
替换旧版Agent或OTel Collector
设置Prometheus/Loki/Tempo数据源对接
调试遥测数据未发送问题
npx skills add grafana/skills --skill alloy -g -y
基于eBPF对应用进行零代码自动插桩,无需修改源码或重启即可采集HTTP/gRPC/DB的OTLP链路追踪与Prometheus指标,支持Docker及K8s集群部署。
为无法重新编译的应用添加可观测性
使用eBPF技术实现无SDK监控
向Tempo或Mimir导出RED指标和追踪数据
在Kubernetes中滚动部署Beyla DaemonSet
npx skills add grafana/skills --skill beyla -g -y
通过 HTTP API 自动化创建、修改和发布 Grafana 仪表板 JSON。支持面板配置、变量模板、数据转换及部署标注,并提供 API 推送后的版本与内容验证流程。
创建新的监控仪表板
添加服务或作业下拉变量
计算错误率等衍生指标
叠加部署时间线标注
导出或更新仪表板 JSON
npx skills add grafana/skills --skill dashboarding -g -y
配置Grafana OSS,支持从YAML预置仪表盘和数据源(Prometheus/Loki等),管理RBAC角色、Service Account令牌及插件安装,并通过API进行健康检查与故障排查。
配置数据源
预置仪表盘
创建服务账户
配置SSO/OAuth
Grafana本地部署
npx skills add grafana/skills --skill grafana-oss -g -y
提供OpenTelemetry与Grafana集成的自动化配置指南,涵盖多语言SDK自动注入、OTLP认证及Alloy采集器部署,用于实现可观测性数据上报。
配置 OpenTelemetry SDK
将 traces/logs/metrics 发送到 Grafana Cloud
使用 Alloy 或 OTel Collector 进行数据采集和转发
排查遥测数据未显示问题
npx skills add grafana/skills --skill opentelemetry -g -y
提供PromQL编写、验证与优化指南,涵盖速率计算、聚合、直方图分位数、SLO燃烧率及性能调优等模式,辅助排查查询慢、基数爆炸等问题。
编写Prometheus查询语句
修复错误的p95/p99延迟指标
构建错误预算告警
调试缓慢的监控查询
定位高基数标签
将Dashboard查询迁移为记录规则
npx skills add grafana/skills --skill promql -g -y
指导创建、审查和优化Grafana Agent技能文件,确保符合Anthropic规范及CI门禁要求。涵盖结构规范、触发词编写、渐进式披露及Tessl评分标准,帮助提升技能的可用性和触发准确率。
创建新的Agent技能
审查技能Pull Request
技能Tessl评分低于75分
优化或修复技能描述
拆分长文档为技能包
npx skills add grafana/skills --skill skill-authoring -g -y
用于调查Grafana Cloud k6测试或运行状态的结构化工作流。支持通过URL识别测试,获取脚本、运行历史、指标和日志,分析通过率及失败原因,并在必要时安全编辑测试脚本。
用户询问特定k6云测试或运行的状态(如是否通过)
用户提供/k6-app/tests/<id>或/k6-app/runs/<id>链接
用户请求查看某次运行的指标、日志或诊断失败原因
npx skills add grafana/skills --skill k6-cloud-investigate-test -g -y
负责 k6 项目文档编写、审查及 TypeScript 类型定义生成。涵盖用户文档、发布说明和 API 引用,强调示例代码在 master 分支的验证与风格规范。
编写或审查 k6 相关文档
生成 TypeScript 类型定义
起草发布说明或更新变更日志
npx skills add grafana/skills --skill k6-docs -g -y
管理Grafana Cloud k6负载测试、脚本、项目及运行状态,支持通过gcx CLI或curl调用API获取指标日志。适用于测试执行、故障排查及性能数据查询场景。
用户询问k6测试失败原因
请求列出或创建k6负载测试
需要获取特定测试运行的日志或指标
调整项目配额或调度设置
本地或云端运行k6脚本
npx skills add grafana/skills --skill k6-manage -g -y
基于k6对公开网站进行端到端性能、负载及压力测试,生成混合测试套件、SLO阈值及监控报告。
performance test my site
load test this URL
stress test my web app
npx skills add grafana/skills --skill k6-perf-test-website -g -y
维护和改进k6测试脚本,涵盖阈值调整、版本迁移、服务变更适配、代码重构及最佳实践审计。通过行为感知变更控制确保测试稳定性,包含严格的验证循环以保障脚本质量。
修复失败的k6测试
收紧阈值
迁移到新版k6
服务变更后更新脚本
重构k6测试代码
npx skills add grafana/skills --skill k6-test-maintenance -g -y
分析Grafana Cloud k6测试运行趋势,检测P95延迟等指标缓慢漂移及异常,评估阈值余量并建议收紧。适用于询问性能退化、回归检查或趋势分析场景。
how is my test trending
is P95 getting worse
check for performance regression
should I tighten thresholds
npx skills add grafana/skills --skill k6-trend-analysis -g -y
生成、验证和审查 k6 性能测试脚本,支持 HTTP、WebSocket、gRPC 及浏览器自动化等场景。通过匹配示例代码并适配需求,执行实际运行以验证脚本有效性,适用于负载、压力及功能测试。
编写或生成 k6 性能/负载测试脚本
对现有 k6 测试脚本进行验证或调试
需要针对 API 或服务进行压力测试
npx skills add grafana/skills --skill k6 -g -y
提供 Grafana Mimir 的本地启动、K8s Helm 部署、Prometheus/Alloy 指标接入及多租户配置指南,涵盖存储后端选择与常见故障排查。
需要长期 Prometheus 存储
扩展 Prometheus 单节点限制
Mimir 或 Cortex 部署配置
调试 Mimir 503 或 429 错误
npx skills add grafana/skills --skill mimir -g -y
提供 Grafana Pyroscope 持续性能剖析技能,涵盖多语言 SDK 集成、Alloy eBPF 自动采集及 ProfileQL 查询。用于定位 CPU/内存热点、生成火焰图及关联 Trace,支持服务性能优化与故障排查。
添加应用性能剖析
部署集群级 eBPF 分析器
通过火焰图查找 CPU/内存瓶颈
对比两个配置文件以发现回归问题
将缓慢的 Tempo 追踪与性能分析关联
npx skills add grafana/skills --skill pyroscope -g -y
提供 Grafana Tempo 分布式追踪后端的部署、配置与查询指南,涵盖本地启动、K8s Helm 部署、TraceQL 编写及链路排查。
部署分布式追踪系统
编写 TraceQL 查询慢请求或错误
排查无 traces 显示问题
配置对象存储后端
npx skills add grafana/skills --skill tempo -g -y
用于使用@grafana/scenes框架构建Grafana插件页面,支持创建场景、面板、变量及钻取导航等。
构建Grafana插件页面
添加可视化面板或变量
配置钻取导航
npx skills add grafana/skills --skill grafana-scenes -g -y
针对Grafana应用插件的包体积优化技能,指导通过React.lazy、Suspense和Webpack代码分割技术减少module.js大小,提升插件初始加载性能。
优化插件包体积
模块过大
插件加载慢
代码分割
减少JS载荷
npx skills add grafana/skills --skill plugin-bundle-size -g -y


