Agent Skills
› grafana/skills
grafana/skills
GitHub指导在 grafana-app-sdk 中实现资源准入控制,包括验证(Validator)和突变(Mutator)处理器的编写、接口定义及示例代码。
Install All Skills
npx skills add grafana/skills --all -g -y
Skills in Collection (51)
Showing top 50 of 51 by quality score. Use the install list command or open individual skills for the rest.
指导在 grafana-app-sdk 中实现资源准入控制,包括验证(Validator)和突变(Mutator)处理器的编写、接口定义及示例代码。
write a validator
implement admission control
add validation
write ingress validation
npx skills add grafana/skills --skill admission-control -g -y
用于评估、审计和优化Grafana Loki标签策略的专家技能。通过分析基数、访问模式和一致性检查,解决查询性能问题并设计高效的日志索引方案。
评估Loki标签策略
审计日志标签架构
优化Loki查询速度
解决高基数标签导致的性能问题
npx skills add grafana/skills --skill loki-label-analyzer -g -y
提供将应用指标、日志、链路追踪等遥测数据发送至 Grafana Cloud 的配置指南,涵盖 Alloy 管道、Prometheus Remote Write、Loki Push 及 OTLP SDK 集成方法。
配置 Grafana Cloud 数据源
设置遥测数据发送管道
集成 OpenTelemetry 到 Grafana
npx skills add grafana/skills --skill send-data -g -y
根据插件名称自动生成Grafana数据源配置代码(YAML/Terraform)。通过API解析插件ID、版本及设置Schema,实现基础设施即代码的配置生成。
用户需要为特定插件生成数据源配置文件
用户提到Grafana数据源配置或Provisioning
用户提供插件名称请求YAML或Terraform格式
npx skills add grafana/skills --skill datasources-provisioning -g -y
Grafana Loki 日志聚合与 LogQL 查询技能。涵盖 LogQL 语法、架构、数据摄入及排错,用于编写查询、配置 Loki 和分析日志。
编写 LogQL 查询语句
配置 Loki 或日志管道
排查日志相关故障
分析系统日志数据
npx skills add grafana/skills --skill loki -g -y
利用profilecli查询Pyroscope性能数据,结合pprof与源码分析热点函数,提供可操作的优化建议。
需要分析服务性能瓶颈
查询CPU或内存占用情况
定位代码中的热点函数
npx skills add grafana/skills --skill profilecli-insights -g -y
提供Prometheus与Grafana指标监控的参考指南,涵盖PromQL语法、聚合函数、告警规则配置及Alertmanager路由设置,辅助进行系统可观测性建设与查询优化。
编写PromQL查询语句
配置Prometheus告警规则
设计监控仪表盘指标
npx skills add grafana/skills --skill prometheus -g -y
使用 pnpm 审计并精简 JavaScript 依赖,保留锁文件与布局。通过检查、移除未用项、去重及分析传递依赖,提供保留/替换/移除建议,旨在减小 node_modules 体积。
清理 pnpm 依赖关系
减小 lockfile 大小
缩减 Grafana 插件的 node_modules
npx skills add grafana/skills --skill audit-and-reduce-dependencies -g -y
对JS/TS项目的npm/yarn/pnpm配置进行供应链安全审计,检查工具版本、生命周期脚本禁用、不安全依赖协议及最低发布年龄。只读扫描,不修改文件。
用户调用/check-npm命令
询问包管理器安全审计
涉及lifecycle scripts或unsafe dependency protocols的查询
npx skills add grafana/skills --skill check-npm -g -y
提供Grafana监控技能的通用模板,涵盖概述、关键概念(如PromQL示例)、常见模式及最佳实践。用于指导AI生成或优化Grafana相关的监控配置与查询内容。
询问Grafana配置
需要PromQL示例
设置监控面板
npx skills add grafana/skills --skill your-skill-name -g -y
提供Grafana App SDK的初始化、脚手架生成及部署模式选择指南,涵盖CLI安装、项目结构、CUE Schema到代码生成的工作流,适用于新建Grafana应用或集成SDK。
创建新的Grafana应用
初始化Grafana App Platform项目
选择部署模式(独立操作符/内置/前端)
配置SDK环境
npx skills add grafana/skills --skill app-sdk-concepts -g -y
指导如何为grafana-app-sdk应用创建CUE Kind定义,包括脚手架生成、版本管理、字段约束及代码生成。
添加新的资源类型
为现有Kind添加新版本
编写CUE Schema或字段约束
定义可复用的Named Types
配置自定义路由
npx skills add grafana/skills --skill cue-kind-definition -g -y
用于在 grafana-app-sdk 中实现 Reconciler 和 Watcher,处理资源状态变更、事件监听及控制器注册,驱动系统向期望状态收敛。
编写 reconciler 逻辑
实现 reconcile 循环
添加异步业务逻辑
处理创建/更新/删除事件
将控制器注册到 app.go
npx skills add grafana/skills --skill reconciler-logic -g -y
用于降低Grafana Cloud指标存储成本,通过自适应聚合规则减少活跃序列数。支持自动推荐、自定义标签丢弃及未使用指标检测,适用于高基数优化和账单审计场景。
调查高昂的Grafana Cloud指标账单
寻找并处理高基数标签(如pod_uid, version)
用户提到减少基数或活跃序列激增
需要预聚合计数器/仪表或丢弃未使用指标
npx skills add grafana/skills --skill adaptive-metrics -g -y
管理Grafana Cloud账号,包括创建Stack、配置SSO、管理RBAC权限及服务账户。通过API和Terraform自动化执行用户邀请、团队配置及资源供应,适用于账号与访问控制管理场景。
设置新的Stack或组织
配置SSO/SAML/OAuth认证
管理服务账户令牌
分配RBAC角色或邀请用户
通过API或Terraform进行云资源供应
npx skills add grafana/skills --skill admin -g -y
提供Grafana Cloud应用、前端及AI可观测性配置指南,涵盖APM接入、Faro SDK集成及OpenLIT监控,支持链路追踪与性能调试。
配置APM服务
前端RUM集成
LLM成本监控
排查服务拓扑缺失
npx skills add grafana/skills --skill app-observability -g -y
配置 AI 编程助手(Claude、Cursor 等)通过 MCP 协议连接 Grafana Cloud,实现指标查询与告警管理。
AI agent 接入监控数据
配置 Grafana MCP 服务器
设置 Claude/Cursor 环境变量
npx skills add grafana/skills --skill assistant-mcp -g -y
配置和故障排除 Grafana Cloud 与 AWS、Azure 等云提供商的集成,支持托管导出器和 Firehose 接收器。
AWS CloudWatch
Azure Monitor
Confluent integration
cloud integration
hosted exporter
AWS Firehose
npx skills add grafana/skills --skill cloud-integrations -g -y
用于降低Grafana Cloud账单,通过成本分摊、自适应信号优化(指标基数/日志采样/追踪采样)及用量告警实现可观测性支出管理。
调查高昂的Grafana Cloud账单
将可观测性成本分摊至团队或服务
减少活跃序列、日志字节或追踪跨度
设置用量或配额告警
npx skills add grafana/skills --skill cost-management -g -y
为 MySQL/PostgreSQL 配置 Grafana Cloud 数据库可观测性,包括启用监控扩展、创建用户及配置 Alloy,实现查询级洞察与 APM 关联。
设置数据库性能监控
诊断慢查询
RDS/Aurora 可观测性配置
数据库与 APM 指标关联
数据库延迟告警
npx skills add grafana/skills --skill database-observability -g -y
用于分析Grafana Cloud账单,通过扫描Prometheus指标按DPM排序并分解标签,定位高基数或高消耗指标以优化成本。
调查Grafana Cloud高额账单
查找高基数或噪声指标
优化Prometheus成本
比较录制规则前后的基数变化
npx skills add grafana/skills --skill dpm-finder -g -y
管理Grafana Alloy采集器集群,通过OpAMP远程分发和热更新Pipeline配置。涵盖配置验证、匹配器部署及故障排查,适用于大规模Agent集中化管理与运维。
配置Alloy远程分发
批量推送Pipeline到采集器
排查REMOTE_CONFIG_STATUS_FAILED错误
使用OpAMP管理Agent
验证River语法
npx skills add grafana/skills --skill fleet-management -g -y
用于将 Kubernetes、主机、容器及云提供商遥测数据接入 Grafana Cloud。涵盖 Helm 部署、Alloy 配置、云指标拉取及故障排查,适用于集群监控与可观测性建设。
监控我的集群
发送 K8s 指标到 Grafana
抓取 EC2 指标
安装监控 helm chart
集群 pod 日志
npx skills add grafana/skills --skill infrastructure -g -y
Grafana Cloud AI/ML技能,支持动态告警、异常检测、自动根因分析及LLM集成。用于自然语言查询、智能仪表盘生成及自动化故障排查。
用户希望基于机器学习而非静态阈值设置告警
需要自然语言查询PromQL或生成仪表盘
请求自动进行事件根因分析或异常检测
需要将大模型接入Grafana插件
npx skills add grafana/skills --skill ml-ai -g -y
配置Grafana OnCall/IRM实现告警路由、值班轮换及事件管理。支持Alertmanager集成、Jinja2路由模板、升级链、排班表及Slack ChatOps,用于处理P1-P4级事故生命周期。
配置告警接收器和路由规则
设置值班轮换和升级策略
处理线上事故通知与响应
npx skills add grafana/skills --skill oncall-irm -g -y
配置 Grafana Cloud 私有网络连接(PrivateLink/PSC),实现指标/日志等遥测数据通过云厂商内网传输,避免公网暴露及出口流量费用,满足合规要求。
需要降低云厂商出口流量费用
满足 PCI-DSS 或 HIPAA 等数据驻留合规要求
禁止遥测数据经过公共互联网
连接 AWS/Azure/GCP 工作负载到 Grafana
npx skills add grafana/skills --skill private-connectivity -g -y
诊断 Prometheus 基数过高引发的性能、内存及成本问题。提供症状归因、指标下钻分析及安全修复方案,避免错误操作导致数据损坏。
Prometheus OOM 或内存持续增长
PromQL 查询缓慢或超时
DPM 或 Active Series 费用异常飙升
出现 'too many samples' 报错
npx skills add grafana/skills --skill prometheus-cardinality-troubleshooter -g -y
Prometheus标签策略专家,审计并设计标签模式,预防高基数。核心规则是不删除使序列唯一的标签以避免数据错误,从源头优化应用代码和抓取目标标签,降低存储成本。
评估或审计Prometheus标签策略
询问如何从源头防止高基数
设计或改进Prometheus标签架构
npx skills add grafana/skills --skill prometheus-label-strategy -g -y
用于编写 Grafana Cloud 合成监控检查,涵盖 k6 脚本、浏览器及协议检查的创建、验证与部署。强调单迭代可靠性监测而非负载测试,提供执行约束、断言最佳实践及多区域可用性检测指导。
编写合成监控检查
将 k6 脚本转换为检查配置
验证用户旅程(如登录、结账)的可用性
查询站点在多区域的在线状态
npx skills add grafana/skills --skill synthetic-monitoring-checks -g -y
提供Grafana Cloud三大测试能力:合成监控探测可用性、k6分布式负载测试及Faro前端实时用户监控。支持API/网站健康检查、发布门禁负载测试及前端性能指标采集。
检查网站或API的可用性
进行负载测试以作为发布门禁
监控TLS证书过期
前端应用性能监控(RUM)
追踪核心网页指标
npx skills add grafana/skills --skill testing -g -y
配置Grafana告警、事件响应管理(SLO/IRM)及通知路由。支持创建联系人、定义SLO、设置升级链,并提供API/YAML配置指南与调试方法,用于自动化监控告警流程。
配置Grafana告警规则或通知策略
设置SLO或多窗口燃烧率告警
调试告警路由或通知未触发问题
集成IRM或配置On-call轮值
npx skills add grafana/skills --skill alerting-irm -g -y
Grafana Alloy 统一遥测管道配置指南,涵盖指标、日志、链路及性能分析采集与发送。提供 Prometheus、Loki、Tempo 集成示例,支持 K8s/Docker 发现、OTLP 接收、日志解析及调试排查。
配置 Grafana Alloy 收集指标或日志
设置 OTel Collector 替代方案
调试遥测数据未发送问题
编写 scrape 或 log 处理配置
npx skills add grafana/skills --skill alloy -g -y
通过eBPF对应用HTTP/gRPC/DB流量进行零代码自动插桩,无需修改源码或重启。支持Docker和Kubernetes DaemonSet部署,导出OTLP traces和Prometheus metrics至Grafana Cloud等后端,适用于遗留系统或闭源二进制文件的可观测性接入。
需要零代码APM监控
无法重新编译的应用插桩
追踪闭源二进制文件
集群级eBPF可观测性部署
npx skills add grafana/skills --skill beyla -g -y
通过 HTTP API 自动化构建、修改和发布 Grafana 仪表板 JSON。支持面板配置、模板变量、数据转换及部署注解,并包含创建后的版本与内容验证流程。
创建新服务监控仪表板
添加服务下拉选择变量
计算错误率等指标列
叠加部署记录作为注解
导出或推送仪表板 JSON
npx skills add grafana/skills --skill dashboarding -g -y
配置Grafana OSS,涵盖从YAML自动供应仪表盘和数据源、管理RBAC角色、生成服务账号令牌到验证健康检查的全流程自动化操作。
配置Prometheus/Loki等数据源
通过YAML或Git供应仪表盘
创建服务账号和Token
配置SSO/OAuth或SMTP
排查供应的仪表盘未显示问题
npx skills add grafana/skills --skill grafana-oss -g -y
提供OpenTelemetry集成Grafana的自动化指南,涵盖多语言SDK自动注入、认证配置、Alloy采集器部署及采样策略,支持向Grafana Cloud或自建后端发送指标、日志和链路追踪数据。
需要为应用添加可观测性监控
配置OTLP协议将数据发送至Grafana
排查链路追踪数据未显示问题
切换Jaeger或Datadog至OpenTelemetry
npx skills add grafana/skills --skill opentelemetry -g -y
提供PromQL查询编写、验证与优化指南,涵盖速率计算、聚合、直方图分位数及SLO燃烧率等模式。用于调试慢查询、解决基数爆炸、迁移录制规则及构建错误预算告警。
编写或优化Prometheus/Grafana指标查询
排查查询性能问题或高基数异常
将Dashboard查询转换为录制规则
计算错误率、P95/P99延迟等SLI/SLO指标
npx skills add grafana/skills --skill promql -g -y
提供 Grafana Agent SKILL.md 文件的编写、审计与优化指南,涵盖结构规范、触发描述技巧及 CI 评分标准(Tessl),辅助开发者创建或修复技能文件。
创建新的 Agent Skill
审查 Skill PR
Skill 评分低于阈值
优化或重构 SKILL.md 文件
npx skills add grafana/skills --skill skill-authoring -g -y
用于调查 Grafana Cloud k6 测试或运行状态的工作流技能。支持解析 URL、获取脚本与元数据、分析通过率/失败原因、提取指标与日志,并安全编辑脚本以修复故障。
用户询问特定 k6 测试或运行的状态
提供 /a/k6-app/tests/<id> 或 /a/k6-app/runs/<id> 链接
询问测试是否通过或失败原因
请求查看特定运行的指标或日志
希望添加阈值或修复失败的测试
npx skills add grafana/skills --skill k6-cloud-investigate-test -g -y
用于编写和审查 k6 相关文档,包括用户指南、发布说明及 TypeScript 类型定义。通过运行示例代码验证准确性,确保内容符合规范且可执行。
编写或修改 k6 文档
审查 k6 发布说明
生成 TypeScript 类型定义
验证文档中的代码示例
npx skills add grafana/skills --skill k6-docs -g -y
管理 Grafana Cloud k6 负载测试、脚本、项目及运行状态,支持通过 gcx CLI 或 curl 直接调用 API 获取指标日志。适用于测试故障排查、性能分析及自动化运维场景。
查询或管理 k6 负载测试结果与日志
创建、编辑或删除 k6 测试脚本与项目
调整 k6 项目配额或调度设置
本地执行 k6 脚本进行性能测试
npx skills add grafana/skills --skill k6-manage -g -y
使用 k6 对公开网站进行端到端性能、负载和压力测试的标准化工作流。涵盖协议与浏览器混合测试、SLO 阈值设定及 Grafana 排查,确保功能测试通过后执行负载测试。
perf test my site
load test this URL
stress test my web app
I want to load test [URL]
set up k6 against my website
npx skills add grafana/skills --skill k6-perf-test-website -g -y
维护和改进 k6 测试脚本,涵盖阈值调整、版本迁移、服务变更适配、代码重构及最佳实践审计。通过行为感知变更控制确保稳定性,并执行严格的验证循环。
修复失败的 k6 测试
收紧阈值
迁移到新版 k6
重构测试脚本
服务变更后更新脚本
应用最佳实践
npx skills add grafana/skills --skill k6-test-maintenance -g -y
分析 Grafana Cloud k6 测试趋势,检测延迟等指标漂移,计算阈值余量并推荐调整。适用于性能回归检查和健康度评估。
询问测试趋势或性能退化
请求检查特定测试的运行情况
建议收紧性能阈值
分析多个测试运行的整体表现
npx skills add grafana/skills --skill k6-trend-analysis -g -y
用于生成、验证和审查 k6 性能测试脚本的 Skill。支持 HTTP、WebSocket、gRPC 及浏览器等多种协议,涵盖负载、压力、冒烟等测试场景,通过执行示例并适配需求来创建可运行的测试代码。
生成 k6 负载或压力测试脚本
编写 API 冒烟或功能测试
调试 k6 测试脚本错误
设置性能阈值和自定义指标
npx skills add grafana/skills --skill k6 -g -y
提供Grafana Mimir的本地搭建、K8s部署及多租户配置指南,涵盖Prometheus remote_write和OTLP接入,支持扩展指标存储与故障排查。
需要长期存储Prometheus指标
扩展单节点Prometheus
配置多租户指标后端
替换Cortex
设置remote_write目标
npx skills add grafana/skills --skill mimir -g -y
提供基于Grafana Pyroscope的持续性能分析能力,支持eBPF无侵入式部署、多语言SDK集成及ProfileQL查询,用于CPU/内存热点定位与回归排查。
添加服务性能剖析
部署集群级eBPF分析器
通过火焰图查找CPU或内存热点
对比两个profile以发现性能回归
关联慢速Trace与性能数据
npx skills add grafana/skills --skill pyroscope -g -y
提供Grafana Tempo分布式追踪后端的部署、配置及TraceQL查询指南。涵盖本地启动、K8s Helm部署、多租户配置、对象存储对接及链路/日志/指标关联分析,用于排查慢请求和错误。
部署或配置Grafana Tempo
编写TraceQL查询以查找慢请求或错误
排查Explore中无追踪数据的问题
调整Querier或Compactor规模
配置S3/GCS/Azure块存储
关联追踪、日志和性能分析数据
npx skills add grafana/skills --skill tempo -g -y
基于@grafana/scenes框架构建Grafana插件页面的技能,支持声明式场景对象、面板可视化、变量配置及钻取导航开发。
创建新的Scene页面或组件
添加数据面板或可视化图表
配置查询运行器和数据转换
设置钻取导航或Tab子页面
npx skills add grafana/skills --skill grafana-scenes -g -y
针对Grafana应用插件,通过React.lazy、Suspense和Webpack代码分割优化bundle体积,提升初始加载性能。指导如何安全拆分模块并配置CI报告。
优化插件包体积
模块过大
插件加载慢
实施代码分割
减少JS载荷
npx skills add grafana/skills --skill plugin-bundle-size -g -y


