Agent Skills
› grafana/skills
grafana/skills
GitHub提供 grafana-app-sdk 中准入控制(验证与变更)的实现指南,涵盖 Validator 和 Mutator 接口定义、代码示例及脚手架生成方法,用于在资源持久化前拦截并处理请求。
Install All Skills
npx skills add grafana/skills --all -g -y
Skills in Collection (50)
提供 grafana-app-sdk 中准入控制(验证与变更)的实现指南,涵盖 Validator 和 Mutator 接口定义、代码示例及脚手架生成方法,用于在资源持久化前拦截并处理请求。
实现 admission control
编写 validator
添加 mutation handler
实现 admission webhooks
npx skills add grafana/skills --skill admission-control -g -y
用于评估、审计和优化Grafana Loki标签策略的专家技能。通过分析基数、访问模式和一致性,解决查询慢和性能问题,提供结构化建议。
评估Loki标签策略
审计日志标签配置
优化Loki查询性能
设计新的标签方案
npx skills add grafana/skills --skill loki-label-analyzer -g -y
指导如何将应用指标、日志、链路追踪及性能数据发送至Grafana Cloud。涵盖凭证获取、Alloy管道配置、Prometheus远程写入、Loki推送及OpenTelemetry集成,解决可观测性数据接入问题。
配置监控数据上报
设置Grafana Cloud凭证
集成OpenTelemetry
配置Alloy采集器
npx skills add grafana/skills --skill send-data -g -y
根据插件名称自动生成Grafana数据源配置文件(YAML或Terraform),支持从零开始或转换现有配置,通过API获取插件ID、版本及设置Schema以确保配置准确性。
生成Grafana数据源配置文件
将数据源作为代码进行配置
查询插件的YAML或Terraform配置模板
npx skills add grafana/skills --skill datasources-provisioning -g -y
Grafana Loki日志聚合与LogQL查询技能。涵盖LogQL语法、解析器、架构及数据摄入配置,用于编写查询、排查管道问题或分析日志。
编写LogQL查询语句
配置Loki日志管道
排查日志采集故障
分析结构化日志数据
npx skills add grafana/skills --skill loki -g -y
提供Prometheus和Grafana云指标的概览,涵盖PromQL查询语法、指标下钻、告警配置、记录规则及集成模式。适用于编写PromQL、配置告警或讨论监控架构最佳实践的场景。
编写PromQL查询
配置Prometheus告警规则
设置Alertmanager路由
创建记录规则优化性能
分析系统资源使用率
npx skills add grafana/skills --skill prometheus -g -y
使用 pnpm 审计并缩减 JavaScript 依赖,保留锁文件和布局。流程包括运行安全检查、移除未用依赖、去重版本、分析传递依赖闭包以发现可内联或替换项,最终报告影响。
清理 pnpm 依赖
减小 lockfile 体积
缩小 node_modules
npx skills add grafana/skills --skill audit-and-reduce-dependencies -g -y
对JS/TS项目的npm/yarn/pnpm配置进行供应链安全审计,检查工具版本、生命周期脚本禁用状态、不安全依赖协议及最小发布年龄。
用户调用/check-npm命令
询问包管理器安全性、生命周期脚本或git依赖配置
npx skills add grafana/skills --skill check-npm -g -y
提供Grafana监控技能模板,涵盖PromQL示例、常见配置模式及最佳实践,旨在指导Agent高效处理可观测性相关任务。
需要Grafana相关知识
编写PromQL查询
配置监控仪表板
npx skills add grafana/skills --skill your-skill-name -g -y
指导使用 Grafana App SDK 进行应用脚手架搭建、项目初始化及部署模式选择。涵盖 CLI 安装、CUE 架构生成代码、Reconciler 开发及环境配置,适用于从零创建 Grafana 插件或 Operator。
Grafana 应用脚手架
SDK 项目初始化
部署模式选择
CUE 代码生成
npx skills add grafana/skills --skill app-sdk-concepts -g -y
用于为 grafana-app-sdk 应用创建 CUE Kind 定义,涵盖资源类型脚手架、版本管理、模式约束及代码生成配置。
添加新的资源类型 (kind)
为现有 kind 添加新版本
编写 CUE schema 字段约束
定义可复用的 #Definition 类型
添加自定义路由
编辑 kinds/ 目录下的文件
npx skills add grafana/skills --skill cue-kind-definition -g -y
指导在 grafana-app-sdk 中实现 Reconciler 和 Watcher,包括生成存根、编写异步业务逻辑、处理资源状态变更及注册控制器。
编写 reconciler
实现 reconcile 循环
添加异步业务逻辑
处理 create/update/delete 事件
注册控制器到 app.go
npx skills add grafana/skills --skill reconciler-logic -g -y
用于降低Grafana Cloud指标存储成本,通过自动推荐或自定义规则预聚合高基数指标、丢弃无用标签和指标,减少活跃序列数量及账单。
调查高昂的Mimir/Grafana Cloud账单
处理高基数标签(如pod_uid, version)
用户提及减少基数、系列爆炸或节省指标费用
npx skills add grafana/skills --skill adaptive-metrics -g -y
管理Grafana Cloud账户,包括创建/删除Stack、配置SSO/SAML/OAuth、管理RBAC角色与用户邀请、通过API或Terraform进行自动化资源供应及服务账号设置。
配置SSO或OAuth
创建或销毁Stack
管理服务账号
分配RBAC权限
团队入驻流程
npx skills add grafana/skills --skill admin -g -y
配置Grafana Cloud应用、前端及AI可观测性,涵盖APM、RUM和LLM监控。用于搭建链路追踪、前端性能分析、会话回放及AI成本监控,集成Alloy与OTel实现数据上报与关联排查。
设置APM
查看服务地图
监控浏览器性能
会话回放
RUM SDK集成
监控LLM账单
npx skills add grafana/skills --skill app-observability -g -y
指导配置 Grafana MCP Server,使 AI 编码助手(如 Claude Code、Cursor)通过 Model Context Protocol 连接 Grafana Cloud。涵盖安装、Token 生成、编辑器集成及 SSE 共享模式设置,实现代码环境内的指标查询与运维操作。
连接 AI 编码工具到 Grafana
配置 MCP 服务器以访问监控数据
在 Claude/Cursor 中启用 Grafana 查询能力
团队共享 Grafana MCP 服务
npx skills add grafana/skills --skill assistant-mcp -g -y
指导配置和排查 Grafana Cloud 与 AWS、Azure 等云提供商的集成,包括安装托管导出器、设置 IAM 权限及 Firehose 接收器,实现监控数据对接。
AWS CloudWatch
Azure Monitor
Confluent integration
cloud integration
hosted exporter
AWS Firehose
npx skills add grafana/skills --skill cloud-integrations -g -y
用于管理Grafana Cloud成本,通过配置Alloy标签进行费用分摊,利用自适应功能降低指标基数、过滤日志和采样追踪,并设置用量告警以优化账单。
Grafana云账单过高
需要按团队或服务分摊可观测性成本
减少活跃序列或日志字节数
配置用量或配额告警
npx skills add grafana/skills --skill cost-management -g -y
配置Grafana Cloud数据库可观测性,支持MySQL和PostgreSQL。通过启用统计扩展、创建监控用户及配置Alloy组件,采集查询样本、执行计划与RED指标,实现慢查询诊断、性能监控及与APM链路追踪的关联分析。
监控数据库性能
诊断慢查询
设置RDS或自建库的可观测性
将DB指标与APM关联
对查询延迟设置告警
npx skills add grafana/skills --skill database-observability -g -y
分析Grafana Cloud Prometheus指标DPM,识别高基数或高成本指标,优化账单支出。
Grafana Cloud账单过高
查找最大数据点指标
优化Prometheus成本
排查高基数指标
npx skills add grafana/skills --skill dpm-finder -g -y
管理Grafana Alloy采集器集群,通过OpAMP远程推送River配置管道,支持属性匹配、本地语法校验及故障排查。
配置Alloy远程管道
批量更新采集器配置
排查REMOTE_CONFIG_STATUS_FAILED
使用OpAMP管理Agent
npx skills add grafana/skills --skill fleet-management -g -y
用于将 Kubernetes、主机、容器及云提供商的遥测数据接入 Grafana Cloud。涵盖 Helm 部署、Alloy 配置、多源数据集成及监控验证,支持集群上线与指标排查。
monitor my cluster
send K8s metrics to Grafana
scrape EC2 metrics
cluster pod logs
install the monitoring helm chart
npx skills add grafana/skills --skill infrastructure -g -y
用于在Grafana Cloud中配置AI/ML功能,包括动态告警(Prophet/DBSCAN)、Sift自动根因分析、自然语言查询及LLM插件集成。
设置基于机器学习的异常检测告警
执行自动化故障根因调查
通过自然语言生成监控仪表盘
集成大语言模型到Grafana
npx skills add grafana/skills --skill ml-ai -g -y
用于配置Grafana OnCall/IRM,实现告警路由、值班轮转、升级链及Slack ChatOps集成。处理Alertmanager对接、Jinja2模板编写及P1-P4事件生命周期管理。
配置告警接收器和路由规则
设置值班表和升级策略
集成Slack进行事件通知和确认
调试告警路由逻辑
npx skills add grafana/skills --skill oncall-irm -g -y
配置 Grafana Cloud 私有网络连接(PrivateLink/PSC),实现遥测数据通过云内网传输,消除公网暴露与出口费用,满足合规要求。
需要降低云网络出口费用
满足 PCI-DSS 或 HIPAA 等数据驻留合规要求
禁止遥测数据经过公共互联网
npx skills add grafana/skills --skill private-connectivity -g -y
用于诊断 Prometheus 高基数问题,如内存溢出、查询慢及账单激增。提供症状归因、TSDB 状态检查、指标下钻分析及安全修复方案,避免误用 labeldrop 导致数据错误。
Prometheus OOM 或内存持续增长
PromQL 查询缓慢或超时
Grafana Cloud 活跃序列或 DPM 账单异常飙升
收到 too many samples 或 out of bounds 错误
npx skills add grafana/skills --skill prometheus-cardinality-troubleshooter -g -y
评估、审计及设计 Prometheus 标签策略,防止高基数。核心原则是不在采集时删除使序列唯一的标签,而是从应用代码源头解决,避免数据错误。
评估或审计 Prometheus 标签方案
询问如何防止高基数
设计或改进标签 schema
npx skills add grafana/skills --skill prometheus-label-strategy -g -y
用于编写Grafana Cloud合成监控检查脚本,覆盖k6脚本、浏览器及协议检查。指导用户根据单迭代执行模型正确配置断言、探针和部署方式,明确区分于负载测试场景。
编写合成监控检查脚本
验证生产环境用户流程可用性
将OpenAPI规范转换为监控检查
询问站点在多区域的可达性
npx skills add grafana/skills --skill synthetic-monitoring-checks -g -y
提供Grafana Cloud三大测试能力:Synthetic Monitoring进行多地域探测,k6 Cloud执行分布式负载测试,Faro SDK实现前端真实用户监控。支持HTTP/DNS等检查、性能阈值门禁及RUM数据采集与追踪关联。
检查网站或API可用性
执行负载测试并设置发布门禁
监控TLS证书有效期
集成前端性能监控(RUM)
排查登录流程或页面加载问题
npx skills add grafana/skills --skill testing -g -y
配置Grafana告警、事件响应管理及SLO,涵盖联系点、通知策略、值班轮转及多窗口燃烧率告警的端到端 provision 和路由调试。
配置告警规则或通知策略
设置值班轮转或升级链
定义或管理SLO
调试告警路由或通知未触发问题
集成IRM或PagerDuty/Slack
npx skills add grafana/skills --skill alerting-irm -g -y
提供Grafana Alloy统一遥测管道的配置、验证与调试指南,涵盖指标、日志、追踪采集及向Grafana生态组件发送数据的工作流。
配置Telemetry Collector
编写Alloy配置文件
调试遥测数据未发送问题
替换OTel Collector或Grafana Agent
npx skills add grafana/skills --skill alloy -g -y
通过 eBPF 技术对应用进行零代码自动插桩,无需修改源码或重启即可采集 HTTP/gRPC/DB 的 OTLP 追踪和 Prometheus 指标。适用于遗留系统、闭源二进制及 Kubernetes 集群的全局可观测性部署。
添加零代码 APM
对遗留应用进行插桩
追踪未编译的二进制文件
eBPF 可观测性
无需 SDK 的监控
npx skills add grafana/skills --skill beyla -g -y
通过HTTP API自动化创建、修改和发布Grafana仪表盘JSON,支持面板布局、模板变量、数据转换及Prometheus/Loki集成,并验证推送结果。
创建新的Grafana仪表盘
通过API添加或修改变量
配置数据转换计算指标
将仪表盘JSON推送到Grafana
npx skills add grafana/skills --skill dashboarding -g -y
用于配置Grafana OSS,涵盖通过YAML自动化配置数据源、仪表盘及插件,管理服务账户与RBAC权限,调整服务器配置,并验证各项设置的健康状态。
配置Prometheus/Loki等数据源
从Git或磁盘自动配置仪表盘
创建服务账户和Token
管理用户角色和权限(RBAC)
配置SSO或SMTP
排查仪表盘未显示问题
npx skills add grafana/skills --skill grafana-oss -g -y
指导如何对各类应用进行OpenTelemetry仪器化,并将指标、日志和追踪数据发送至Grafana Cloud或自托管后端。涵盖自动注入、配置认证及Alloy采集器集成。
instrument any app with OpenTelemetry
ship metrics / logs / traces to Grafana Cloud
auto-instrument my Java app
send traces to Grafana
what env vars do I set
OTLP endpoint
Operator inject
npx skills add grafana/skills --skill opentelemetry -g -y
提供PromQL查询编写、验证与优化指南,涵盖聚合、直方图分位数、SLO燃烧率及性能调优模式,辅助解决指标查询错误与慢查询问题。
编写或调试Prometheus/Grafana查询
优化慢查询或高基数指标
计算错误率或延迟分位数
npx skills add grafana/skills --skill promql -g -y
指导编写、审查和优化 Grafana Agent SKILL.md 文件,确保符合 Anthropic 规范及 CI 门禁要求。涵盖触发描述撰写、渐进式披露结构、Rubric 评分标准及自动验证流程,适用于技能创建、PR 审查或优化场景。
创建新的 Grafana Skill
审查 Skill PR
Skill 评分低于 75 分
用户询问如何编写或优化 Skill
npx skills add grafana/skills --skill skill-authoring -g -y
针对Grafana Cloud k6测试或运行进行结构化调查,包括脚本分析、运行历史查询、通过率判定及指标日志提取。提供安全编辑脚本的规范流程,帮助用户诊断测试失败原因并验证数据准确性。
用户提供k6测试或运行的URL
询问测试是否通过或失败原因
请求查看特定运行的指标或日志
需要修复阈值或调试测试脚本
npx skills add grafana/skills --skill k6-cloud-investigate-test -g -y
用于撰写、审查 k6 文档及 TypeScript 类型定义,生成发布说明并验证代码示例。覆盖用户文档、API 参考和变更日志,确保内容符合规范且示例可运行。
撰写或编辑 k6 相关文档
审查 k6 文档或 TypeScript 类型
生成 k6 发布说明或变更日志
验证 k6 代码示例
npx skills add grafana/skills --skill k6-docs -g -y
管理 Grafana Cloud k6 负载测试、脚本、项目及运行状态,支持通过 gcx CLI 或 curl 执行本地/云端测试,并获取日志与指标。
用户询问 k6 测试失败原因或请求查看特定运行的日志和指标
用户要求创建、编辑、启动、中止测试或更新脚本
用户需要管理项目限制、调度或环境变量
npx skills add grafana/skills --skill k6-manage -g -y
用于对公开网站进行端到端性能、负载和压力测试。基于k6生成混合测试套件,包含功能与负载测试、SLO阈值及Grafana排查方案,确保在流量下验证网站表现。
perf test my site
load test this URL
stress test my web app
I want to load test [URL]
set up k6 against my website
write a k6 suite for [site]
see if my site handles N concurrent users
how does my site perform under traffic
npx skills add grafana/skills --skill k6-perf-test-website -g -y
用于维护和改进现有k6测试脚本,包括阈值调整、版本迁移、服务变更适配、代码重构及最佳实践审计。确保修改行为可控并经过严格验证。
修复失败的k6测试
收紧性能阈值
迁移到新k6版本
重构测试脚本
服务变更后更新测试
npx skills add grafana/skills --skill k6-test-maintenance -g -y
分析Grafana Cloud k6测试运行趋势,检测指标漂移、计算阈值余量并推荐调整。适用于查询性能趋势、检查退化或评估阈值收紧需求。
how is my test trending
is P95 getting worse
check for performance regression
should I tighten thresholds
are my tests degrading
show me trends for test X
analyze my k6 test runs
is my test getting slower
npx skills add grafana/skills --skill k6-trend-analysis -g -y
用于生成、验证和审查 k6 性能测试脚本的 Skill。支持 HTTP、WebSocket、gRPC 及浏览器测试,涵盖负载、压力等场景,通过运行脚本和文档工具确保代码正确性。
编写 k6 负载或压力测试脚本
验证 k6 脚本的正确性
调试性能测试问题
根据 API 描述生成测试用例
npx skills add grafana/skills --skill k6 -g -y
提供 Grafana Mimir 的部署、配置与运维指南,涵盖本地 Docker 及 K8s Helm 安装、多租户设置、Prometheus/OTLP 数据接入、存储后端配置及故障排查。
需要长期 Prometheus 存储
扩展 Prometheus 单节点限制
搭建多租户指标后端
替代 Cortex
配置 remote_write 目标
npx skills add grafana/skills --skill mimir -g -y
用于持续性能剖析应用,支持通过SDK、Alloy eBPF自动采集CPU/内存等指标,生成火焰图以定位热点、排查回归及关联Trace。
添加服务性能剖析
部署集群级eBPF监控
分析CPU或内存热点
对比两次Profile查找回归
关联慢速Trace与Profile
npx skills add grafana/skills --skill pyroscope -g -y
部署 Grafana Tempo 分布式追踪后端,支持多种协议接入与对象存储。提供 TraceQL 查询、慢请求分析、服务图谱生成及链路日志关联,涵盖本地启动、K8s Helm 部署及数据验证全流程。
部署 Tempo 或 Jaeger 兼容的追踪后端
编写 TraceQL 查询以定位慢请求或错误
配置 S3/GCS 存储或排查无追踪数据问题
生成服务调用图或关联 Traces/Logs/Metrics
npx skills add grafana/skills --skill tempo -g -y
提供基于@grafana/scenes框架构建Grafana插件页面的开发指南,涵盖场景对象树、面板构建、变量管理及钻取导航等核心功能与代码示例。
创建新的Grafana场景页面
配置数据查询与可视化面板
设置钻取或标签页导航
npx skills add grafana/skills --skill grafana-scenes -g -y
指导如何优化Grafana应用插件的包体积,通过React.lazy、Suspense和Webpack代码分割技术减少module.js大小,提升加载性能。
优化插件包体积
模块过大
插件加载慢
实施代码分割
减少初始JS负载
npx skills add grafana/skills --skill plugin-bundle-size -g -y
指导将Grafana插件迁移至React 19兼容性,涵盖检测、依赖更新及源码修复。
更新插件以适配React 19
React 19迁移
准备React 19环境
修复React 19兼容性问题
npx skills add grafana/skills --skill react-19-plugin-migration -g -y


