Agent Skills
› grafana/skills
grafana/skills
GitHub指导在 grafana-app-sdk 中实现 Admission Control,包括 Validator(校验)和 Mutator(变更)处理器的接口定义、示例代码及 Stub 生成方法,用于拦截资源持久化前的请求。
Install All Skills
npx skills add grafana/skills --all -g -y
Skills in Collection (51)
Showing top 50 of 51 by quality score. Use the install list command or open individual skills for the rest.
指导在 grafana-app-sdk 中实现 Admission Control,包括 Validator(校验)和 Mutator(变更)处理器的接口定义、示例代码及 Stub 生成方法,用于拦截资源持久化前的请求。
implement admission control
write a validator
add validation
implement admission logic
validate incoming resources
npx skills add grafana/skills --skill admission-control -g -y
评估Grafana Loki标签策略,通过基数评分、访问模式对齐及一致性检查优化Schema,解决查询慢问题。
评估Loki标签策略
审计日志标签架构
设计或改进Loki标签方案
排查Loki查询性能缓慢原因
npx skills add grafana/skills --skill loki-label-analyzer -g -y
提供将应用或基础设施数据发送至 Grafana Cloud 的完整指南,涵盖指标、日志、追踪和配置文件的采集方法。支持 Alloy 管道、Prometheus Remote Write、Loki Push 及 OpenTelemetry SDK 等集成方式,含凭证获取与配置示例。
连接应用到 Grafana Cloud
配置遥测数据发送
设置远程写入端点
选择数据采集方式
npx skills add grafana/skills --skill send-data -g -y
根据插件名称生成Grafana数据源的基础设施即代码配置(YAML或Terraform),自动解析插件ID、版本及设置Schema,实现数据源的标准化配置。
用户请求为特定插件生成Grafana数据源配置文件
用户询问如何以代码形式配置Grafana数据源
用户提供插件名称要求生成provisioning文件
npx skills add grafana/skills --skill datasources-provisioning -g -y
提供Grafana Loki日志聚合与LogQL查询技能的参考指南,涵盖语法、架构及排错,用于辅助编写查询和配置。
编写或调试LogQL查询语句
配置Loki日志采集管道
分析应用日志数据
npx skills add grafana/skills --skill loki -g -y
使用profilecli查询Pyroscope性能数据,结合pprof与源码分析热点函数,提供可操作的性能优化建议。
需要分析服务性能瓶颈
查询Pyroscope profiling数据
定位CPU或内存热点代码
npx skills add grafana/skills --skill profilecli-insights -g -y
提供 Prometheus 与 Grafana 云监控的 PromQL 查询参考、指标聚合模式、告警规则配置及 Alertmanager 路由设置,适用于编写查询、配置告警和讨论指标架构最佳实践。
编写或调试 PromQL 查询语句
配置 Prometheus 告警规则和 Alertmanager 路由
分析系统性能指标如错误率、CPU 和内存使用
讨论监控架构和集成模式
npx skills add grafana/skills --skill prometheus -g -y
使用 pnpm 审计并缩减 JavaScript 依赖,清理无用包、去重版本、分析传递依赖以优化锁文件和 node_modules 体积。
清理 pnpm 依赖
减小 lockfile 大小
缩小 node_modules
npx skills add grafana/skills --skill audit-and-reduce-dependencies -g -y
对JS/TS项目的npm/yarn/pnpm配置进行供应链安全审计,检查工具版本、生命周期脚本禁用、不安全依赖协议及最低发布年龄。
/check-npm命令
询问包管理器安全性审计
npx skills add grafana/skills --skill check-npm -g -y
提供Grafana相关的专业知识,涵盖核心概念、常用模式及最佳实践。旨在帮助AI高效处理监控配置、PromQL查询编写及仪表盘设计等任务,避免重复解释通用编程概念。
Grafana配置
PromQL查询
监控仪表盘
数据源集成
npx skills add grafana/skills --skill your-skill-name -g -y
提供Grafana App SDK的入门指南,涵盖CLI安装、项目初始化、三种部署模式选择及CUE到代码生成的工作流,辅助开发者快速搭建和配置Grafana应用。
创建新的Grafana应用
Grafana App Platform
kinds and watchers
operator scaffold
apps/ 目录配置
npx skills add grafana/skills --skill app-sdk-concepts -g -y
用于在 Grafana App SDK 中创建和管理 CUE Kind 定义,包括脚手架生成、版本管理、模式约束及代码生成。
添加新的资源类型
为现有 Kind 添加版本
编写 CUE 模式或字段约束
运行 grafana-app-sdk generate
npx skills add grafana/skills --skill cue-kind-definition -g -y
指导实现 grafana-app-sdk 的 Reconciler 和 Watcher,处理资源生命周期事件、业务逻辑及状态更新。
编写控制器或 reconciler
处理资源创建/更新/删除事件
实现异步业务逻辑
npx skills add grafana/skills --skill reconciler-logic -g -y
用于优化Grafana Cloud指标成本,通过自动推荐或自定义规则预聚合高基数指标,减少活跃系列数。支持API管理、基线验证及回滚操作。
查询高Mimir/Grafana Cloud账单
处理高基数标签如pod_uid
用户提及降低指标支出或系列爆炸
npx skills add grafana/skills --skill adaptive-metrics -g -y
管理Grafana Cloud账号,包括创建Stack、配置SSO/OAuth、RBAC角色分配、服务账户管理及团队入职。通过API和Terraform实现自动化资源编排与访问控制。
设置SSO或OAuth
创建新的Stack
管理服务账户
分配RBAC角色
邀请用户或管理团队
npx skills add grafana/skills --skill admin -g -y
提供基于Grafana Cloud的APM、前端RUM及AI可观测性配置指南。涵盖Alloy接收器部署、Faro SDK集成及OpenLIT监控,支持链路追踪、性能分析及LLM成本评估。
设置APM服务监控
配置前端性能监控
监控LLM成本与延迟
排查服务映射缺失问题
关联前端错误与后端链路
npx skills add grafana/skills --skill app-observability -g -y
配置 Grafana MCP Server,使 AI 编码代理(如 Claude Code、Cursor)通过标准协议连接 Grafana Cloud。涵盖安装、Token 生成、IDE 集成及安全配置,支持 stdio 和 SSE 传输模式。
连接 AI 编码代理到 Grafana
配置 Grafana MCP 服务器
在 Cursor 或 VS Code 中使用 Grafana 工具
让 AI 代理访问指标数据
npx skills add grafana/skills --skill assistant-mcp -g -y
指导用户配置和排查 Grafana Cloud 与 AWS、Azure 等云提供商的集成,包括设置托管导出器和 Firehose 接收器以采集监控指标。
AWS CloudWatch
Azure Monitor
Confluent integration
cloud integration
hosted exporter
AWS Firehose
install integration
cloud metrics
cloud logs
npx skills add grafana/skills --skill cloud-integrations -g -y
管理Grafana Cloud成本,通过成本归因标签、自适应指标/日志/追踪优化及用量告警,降低遥测数据消耗并控制账单支出。
调查高额的Grafana Cloud账单
将可观测性成本归因于特定团队或服务
减少活跃序列、日志字节或追踪跨度
设置用量或配额告警
npx skills add grafana/skills --skill cost-management -g -y
为MySQL和PostgreSQL配置Grafana云数据库可观测性,包括启用统计扩展、创建监控用户及Alloy组件配置,实现查询级洞察、慢查询诊断与APM关联。
监控数据库性能
诊断慢查询
设置RDS/Aurora/Cloud SQL等实例的可观测性
将DB指标与APM追踪关联
对查询延迟设置告警
npx skills add grafana/skills --skill database-observability -g -y
Grafana PS CLI工具,按DPM对Prometheus指标排序并分析标签集,用于排查高账单、识别高基数指标及优化成本。
调查Grafana Cloud高额支出
寻找噪声或高基数指标
比较录制规则前后的基数变化
用户询问账单过高或优化Prometheus成本
npx skills add grafana/skills --skill dpm-finder -g -y
管理Grafana Alloy采集器集群,通过OpAMP远程下发和热更新Pipeline配置。支持基于属性匹配器精准推送、本地语法校验及故障排查,适用于大规模Agent的统一配置与运维。
配置Alloy采集器
远程推送Pipeline
使用OpAMP管理Collector
排查REMOTE_CONFIG_STATUS_FAILED
验证River语法
npx skills add grafana/skills --skill fleet-management -g -y
提供Grafana Cloud基础设施监控方案,涵盖K8s集群、Linux主机、容器及云厂商指标的上报与配置。支持通过Helm Chart或Alloy进行数据收集、验证及告警设置。
monitor my cluster
send K8s metrics to Grafana
scrape EC2 metrics
cluster pod logs
install the monitoring helm chart
npx skills add grafana/skills --skill infrastructure -g -y
提供Grafana Cloud的AI/ML功能集成指南,涵盖动态告警、异常检测、自动根因分析及LLM插件配置,支持自然语言查询与自动化运维。
需要基于机器学习而非静态阈值的智能告警
使用自然语言生成PromQL或仪表盘
执行自动化故障根因分析(RCA)
在Grafana中集成大语言模型(LLM)代理
npx skills add grafana/skills --skill ml-ai -g -y
管理Grafana OnCall/IRM的告警路由、值班轮换和事件响应。支持集成配置、Jinja2路由模板、升级链及Slack ChatOps,实现从告警接入到自动恢复的全流程自动化处理。
配置告警接收器或Webhook集成
设置值班轮换时间表
构建告警升级策略
处理P1-P4级事件响应
npx skills add grafana/skills --skill oncall-irm -g -y
配置 Grafana Cloud 私有网络连接(AWS/Azure/GCP),通过 VPC Endpoint 或 PrivateLink 实现数据私域传输,避免公网暴露与出口费用,满足合规要求。
配置云厂商私有连接至监控平台
消除遥测数据公网出口费用
满足 PCI-DSS/HIPAA 数据驻留合规
npx skills add grafana/skills --skill private-connectivity -g -y
用于诊断 Prometheus 高基数引发的性能、内存或成本问题。提供症状归因、指标下钻及修复路径,指导用户安全排查而非盲目丢弃标签。
Prometheus OOM 或内存增长
查询缓慢或超时
DPM 或 Active Series 账单激增
接收样本过多报错
npx skills add grafana/skills --skill prometheus-cardinality-troubleshooter -g -y
Prometheus标签策略专家,用于审计、设计和优化标签方案,从源头预防高基数问题。遵循核心规则确保数据完整性,指导应用代码和抓取目标层面的标签管理,避免错误丢弃导致的数据损坏。
评估或审计 Prometheus 标签模式
设计或改进标签方案
询问如何从源头防止高基数
npx skills add grafana/skills --skill prometheus-label-strategy -g -y
用于编写Grafana Cloud合成监控检查,涵盖k6脚本、浏览器及协议类型。指导用户正确配置单迭代执行模型、断言、探针部署及回滚,明确区分于负载测试,确保生产环境可用性监测。
编写合成监控检查
验证用户登录或结账流程
将k6脚本转换为监控检查
询问多区域站点可用性
npx skills add grafana/skills --skill synthetic-monitoring-checks -g -y
提供Grafana Cloud测试能力,涵盖合成监控、k6负载测试及Faro前端可观测性。用于多地域探针探测、发布门禁负载测试、TLS证书监控、前端性能追踪及错误关联分析。
检查网站或API的多区域可用性
执行发布前的负载测试门禁
监控TLS证书过期风险
前端应用性能与用户体验监控
将前端错误与后端链路追踪关联
npx skills add grafana/skills --skill testing -g -y
用于配置Grafana告警、IRM及SLO,涵盖通知路由、联系人设置、告警规则定义与验证、On-call轮班编排及故障管理集成。适用于排查告警未触发或路由错误等运维场景。
配置告警规则与通知策略
调试告警路由与联系人
设置SLO与多窗口燃烧率告警
建立On-call轮班与升级链
集成IRM进行事件管理
npx skills add grafana/skills --skill alerting-irm -g -y
用于构建统一遥测管道的Grafana Alloy技能,涵盖配置编写、验证及Metrics/Logs/Traces采集与转发。适用于替换Agent、调试数据上报或处理K8s/Docker环境下的日志解析与OTLP接入场景。
编写Alloy配置文件
替换Grafana Agent或OTel Collector
调试数据未发送问题
配置K8s/Docker服务发现
npx skills add grafana/skills --skill alloy -g -y
基于eBPF技术实现零代码修改的应用程序HTTP/gRPC/DB流量自动注入,支持Docker和Kubernetes部署,将遥测数据导出至OTLP接收器。适用于无法重新编译或闭源二进制文件的可观测性采集场景。
添加不可修改应用的APM监控
使用eBPF进行零代码可观测性接入
在Kubernetes集群中部署DaemonSet以捕获遥测数据
npx skills add grafana/skills --skill beyla -g -y
通过 HTTP API 自动化构建、修改和发布 Grafana 仪表盘。支持面板配置、变量模板、数据转换及注解,实现仪表盘 JSON 的脚本化生成与版本管理。
创建新的监控仪表盘
添加服务下拉选择变量
计算错误率等指标列
叠加部署时间轴注解
导出或推送仪表盘 JSON
npx skills add grafana/skills --skill dashboarding -g -y
配置Grafana OSS,包括通过YAML配置数据源、仪表盘和插件,管理RBAC角色及服务账户令牌,修改grafana.ini设置,并通过API验证配置健康状态。
配置Prometheus/Loki等数据源
通过YAML或Git自动供应仪表盘
创建服务账户并生成Token
配置SSO/OAuth认证
排查仪表盘未显示问题
npx skills add grafana/skills --skill grafana-oss -g -y
指导将应用接入 OpenTelemetry,通过 OTLP 协议向 Grafana Cloud 或自建集群发送指标、日志和链路追踪数据。涵盖多语言 SDK 自动注入、Alloy 代理配置及采样策略。
instrumenting a service
send traces to Grafana
what env vars do I set
OTLP endpoint
Operator inject
npx skills add grafana/skills --skill opentelemetry -g -y
提供Prometheus/Grafana的PromQL编写、验证与优化指南。涵盖速率计算、聚合、直方图分位数、SLO燃烧率及性能调优,辅助查询开发与故障排查。
编写Prometheus指标查询
修复错误的p95/p99延迟计算
构建错误预算告警规则
调试缓慢的查询或高基数问题
将仪表板查询迁移为记录规则
npx skills add grafana/skills --skill promql -g -y
用于创建、审查和优化 Grafana SKILL.md 文件,确保符合 Anthropic 规范和 CI 门禁标准。涵盖触发器编写、结构规范、评分维度及验证流程。
创建新技能
审查技能 PR
技能描述未生效
重构长文档
询问如何优化或修复技能
npx skills add grafana/skills --skill skill-authoring -g -y
用于调查Grafana Cloud k6测试或运行结果的工作流技能,支持诊断失败原因、查看指标日志及安全编辑脚本。
用户询问测试是否通过或失败原因
提供k6测试或运行的URL
请求查看特定运行的指标或日志
需要修复失败的测试或调整阈值
npx skills add grafana/skills --skill k6-cloud-investigate-test -g -y
用于撰写、审查 k6 相关文档(用户指南、API参考、发布说明及TS类型定义),并验证代码示例在master版本的可运行性。适用于涉及k6及其子仓库的文档编写与审核场景。
撰写或编辑 k6 文档
审查 k6 文档内容
生成 TypeScript 类型定义
起草发布说明
验证文档中的代码示例
npx skills add grafana/skills --skill k6-docs -g -y
用于通过gcx CLI或curl与Grafana Cloud k6交互,管理负载测试、脚本、项目及运行状态,支持获取日志指标和配置。
查询k6测试失败原因
查看特定运行的日志或指标
调整项目VU限制或调度
更新k6脚本
本地运行k6脚本
npx skills add grafana/skills --skill k6-manage -g -y
使用 k6 对公开网站进行端到端性能、负载及压力测试。生成混合协议与浏览器测试套件,配置 SLO 阈值,并附带监控侧车与 Grafana 排查方案。
用户要求进行性能测试、负载测试或压力测试
用户提及 k6 或验证网站在流量下的表现
npx skills add grafana/skills --skill k6-perf-test-website -g -y
维护和改进k6测试脚本,涵盖阈值调整、版本迁移、服务变更适配、代码重构及最佳实践审计。通过行为感知变更控制和严格验证循环确保脚本稳定性和合规性。
修复失败的k6测试
收紧性能阈值
迁移到新k6版本
服务变更后更新测试脚本
重构k6测试代码
npx skills add grafana/skills --skill k6-test-maintenance -g -y
分析Grafana Cloud k6测试运行趋势,检测指标漂移、异常及性能退化,计算阈值余量并建议收紧阈值。适用于查询测试趋势、性能回归检查及健康评估场景。
如何查看我的测试趋势
P95延迟是否恶化
检查性能回归
是否应收紧阈值
测试是否在退化
分析k6测试运行
npx skills add grafana/skills --skill k6-trend-analysis -g -y
用于生成、验证和审查k6负载测试脚本的Skill。覆盖HTTP、WebSocket、gRPC及浏览器测试,支持自定义指标、阈值设置及xk6扩展集成,通过运行脚本确保代码可执行性。
编写或生成k6负载/压力测试脚本
验证k6测试脚本的正确性与可运行性
调试性能测试中的断言或阈值问题
npx skills add grafana/skills --skill k6 -g -y
用于部署和配置 Grafana Mimir,提供 Prometheus 和 OTLP 指标的水平扩展、多租户长期存储。涵盖本地 Docker、K8s Helm 部署及对象存储集成。
需要长时期存储 Prometheus 指标
扩展 Prometheus 单节点限制
搭建多租户指标后端
替换 Cortex
配置 remote_write 目标
npx skills add grafana/skills --skill mimir -g -y
用于应用持续性能分析,支持通过SDK、eBPF或Alloy集成Pyroscope。涵盖CPU/内存热点定位、火焰图分析及Trace关联,适用于性能调优与故障排查。
查找CPU热点
分析内存分配问题
生成火焰图
配置Pyroscope监控
排查慢请求性能瓶颈
npx skills add grafana/skills --skill pyroscope -g -y
部署 Grafana Tempo 分布式追踪后端,支持多租户及对象存储。提供 TraceQL 查询以分析慢请求、错误率及服务图,涵盖从本地 Docker 到 Kubernetes Helm 的部署流程及链路日志关联配置。
部署 Tempo 追踪后端
编写 TraceQL 查询慢请求或错误
排查 Explore 中无追踪数据问题
配置 S3/GCS/Azure 块存储
关联追踪与日志/指标
npx skills add grafana/skills --skill tempo -g -y
基于@grafana/scenes框架构建Grafana插件页面,支持场景树组装、数据查询、变量配置及钻取导航。
创建新的Grafana场景页面
添加可视化面板或配置查询运行器
设置钻取导航或标签页结构
npx skills add grafana/skills --skill grafana-scenes -g -y
针对Grafana插件的bundle体积优化技能,指导使用React.lazy、Suspense和Webpack代码分割技术减小module.js大小,提升插件加载性能。
优化插件包体积
模块文件过大
插件加载缓慢
实现代码分割
减少初始JS负载
npx skills add grafana/skills --skill plugin-bundle-size -g -y


