Agent Skills
› grafana/skills
grafana/skills
GitHub提供 grafana-app-sdk 中准入控制(验证与变异)的实现指南,涵盖接口定义、示例代码及 Stub 生成方法,用于在资源持久化前拦截并处理请求。
Install All Skills
npx skills add grafana/skills --all -g -y
Skills in Collection (52)
Showing top 50 of 52 by quality score. Use the install list command or open individual skills for the rest.
提供 grafana-app-sdk 中准入控制(验证与变异)的实现指南,涵盖接口定义、示例代码及 Stub 生成方法,用于在资源持久化前拦截并处理请求。
实现 admission control
编写 validator
添加 mutation handler
实现 admission webhooks
npx skills add grafana/skills --skill admission-control -g -y
Loki标签策略专家评估器,用于审计、设计和优化Grafana Loki的标签方案。通过基数评分、访问模式对齐及一致性检查,解决查询慢问题并防止高基数导致的性能瓶颈。
评估或审计Loki标签策略
设计新的Loki标签架构
诊断Loki查询缓慢原因
优化日志索引性能
npx skills add grafana/skills --skill loki-label-analyzer -g -y
指导如何将应用指标、日志、追踪和性能数据发送至 Grafana Cloud。涵盖 Alloy 配置、Prometheus 远程写入、Loki 推送及 OpenTelemetry SDK 集成,包含凭证获取与认证设置。
需要连接应用或基础设施到 Grafana Cloud
配置遥测数据(指标、日志、追踪)的采集与发送
设置 Prometheus 远程写入或 OTLP 端点
npx skills add grafana/skills --skill send-data -g -y
根据插件名称自动生成 Grafana 数据源配置代码(YAML/Terraform)。通过 API 解析插件 ID、版本及设置 Schema,实现基础设施即代码。
用户请求生成数据源的 YAML 或 Terraform 配置
用户提及特定插件如 clickhouse 或 infinity 的配置需求
npx skills add grafana/skills --skill datasources-provisioning -g -y
提供Grafana Loki日志聚合与LogQL查询技能,涵盖语法、架构及采集配置。用于编写查询、配置Loki、排查日志管道及分析日志数据。
编写LogQL查询语句
配置Loki日志采集管道
排查日志收集问题
分析应用或系统日志
npx skills add grafana/skills --skill loki -g -y
基于profilecli和pprof分析Pyroscope性能数据,关联源代码定位热点函数。
需要分析服务CPU或内存性能瓶颈
查询Pyroscope连续配置文件并生成洞察
npx skills add grafana/skills --skill profilecli-insights -g -y
提供Prometheus与Grafana指标监控指南,涵盖PromQL查询、告警配置、记录规则及最佳实践,用于解决指标采集、分析及系统可观测性问题。
编写PromQL查询语句
配置Prometheus告警规则
分析系统性能指标
排查监控数据异常
npx skills add grafana/skills --skill prometheus -g -y
基于 pnpm 审计并缩减 JavaScript 依赖,通过移除无用包、去重版本及内联依赖来减小 footprint。需先运行 check-npm 进行硬化检查,确保保留 lockfile 和 workspace 布局,适用于 Grafana 插件等项目的依赖清理与优化。
需要清理或优化 JavaScript/pnpm 依赖关系
希望减小 node_modules 体积或锁文件尺寸
执行依赖审计与风险评估
npx skills add grafana/skills --skill audit-and-reduce-dependencies -g -y
对 JS/TS 仓库的包管理器配置进行供应链安全审计,检查版本合规、生命周期脚本禁用、不安全依赖协议及最低发布年龄。只读扫描 workspace,不修改文件。
用户调用 /check-npm
询问包管理器安全性
涉及 lifecycle scripts 或 git 依赖审计
npx skills add grafana/skills --skill check-npm -g -y
提供Grafana相关的知识、概念、模式和最佳实践,专注于PromQL等特定领域内容,不包含通用编程概念。
询问Grafana配置
需要PromQL示例
Grafana监控问题
npx skills add grafana/skills --skill your-skill-name -g -y
提供Grafana App SDK的初始化、脚手架生成及部署模式选择指南,涵盖CLI安装、CUE Schema定义到代码生成的完整工作流,支持独立Operator与In-process插件开发。
创建新的Grafana应用项目
初始化Grafana App Platform应用
选择部署模式(独立/集成/前端)
配置SDK环境
npx skills add grafana/skills --skill app-sdk-concepts -g -y
指导如何为 Grafana App SDK 应用创建和定义 CUE Kind,涵盖脚手架生成、版本管理、字段约束及代码生成。
添加新的资源类型 (Kind)
向现有 Kind 添加新版本
编写或修改 CUE Schema 约束
定义可复用的结构体类型
配置自定义路由
执行代码生成并处理错误
npx skills add grafana/skills --skill cue-kind-definition -g -y
实现 grafana-app-sdk 的 Reconciler 和 Watcher,处理资源生命周期事件、状态更新及控制器注册。
编写控制器逻辑
实现资源同步循环
处理创建/更新/删除事件
npx skills add grafana/skills --skill reconciler-logic -g -y
通过自适应聚合规则降低Grafana Cloud指标成本,自动推荐、自定义规则及检测未使用指标,解决高基数和账单过高问题。
调查Grafana Cloud或Mimir高额账单
处理高基数标签如pod_uid、version
用户提及降低基数、减少系列数或指标支出
npx skills add grafana/skills --skill adaptive-metrics -g -y
管理Grafana Cloud账户,涵盖组织与Stack创建、RBAC权限分配、SSO配置、服务账号管理及用户邀请。支持通过API和Terraform进行资源供应与审计,适用于云环境下的访问控制与基础设施配置任务。
设置SSO或SAML认证
创建新的Stack或组织
管理服务账号用于CI/CD
分配RBAC角色或邀请用户
管理团队或成员资格
npx skills add grafana/skills --skill admin -g -y
提供Grafana Cloud应用、前端及AI可观测性配置指南,涵盖APM搭建、Faro SDK集成、Alloy转发及故障排查。
set up APM
monitor browser perf
session replay
RUM SDK
watch our OpenAI bill
show service map
npx skills add grafana/skills --skill app-observability -g -y
指导将AI编码助手(如Claude Code、Cursor)通过MCP协议接入Grafana Cloud,涵盖安装配置、安全令牌生成及传输方式选择。
连接AI代理到Grafana
配置MCP服务器
在IDE中集成Grafana工具
npx skills add grafana/skills --skill assistant-mcp -g -y
用于配置和排查 Grafana Cloud 与 AWS、Azure 等云提供商的集成,包括设置托管导出器、AWS Firehose 接收器及 IAM 权限。
连接 AWS CloudWatch
设置 Azure Monitor
配置 Confluent Cloud 可观测性
安装 Grafana 集成
使用 AWS Firehose
npx skills add grafana/skills --skill cloud-integrations -g -y
用于降低Grafana Cloud账单,涵盖成本归属、自适应指标/日志/追踪优化及用量告警设置。适用于高账单调查、减少遥测数据量或配置配额警报场景。
investigating a high Grafana Cloud bill
attributing observability cost to a team or service
reducing active series / log bytes / trace spans
setting up usage / quota alerts
npx skills add grafana/skills --skill cost-management -g -y
为MySQL和PostgreSQL数据库配置Grafana Cloud可观测性,启用查询级洞察、RED指标及慢查询诊断。支持主流云数据库及自建实例,实现数据库监控与APM链路关联。
设置数据库监控
诊断慢查询
RDS/Aurora可观测性配置
数据库性能分析
npx skills add grafana/skills --skill database-observability -g -y
Grafana PS CLI工具,按DPM对Prometheus指标排序并分析每标签集用量。用于排查高云账单、识别高基数指标及优化成本,支持自定义定价与导出器模式。
Grafana Cloud账单过高
寻找高基数或嘈杂指标
优化Prometheus成本
比较录制规则前后的基数变化
npx skills add grafana/skills --skill dpm-finder -g -y
管理Grafana Alloy采集器集群,通过OpAMP远程分发和热更新Pipeline配置。涵盖本地语法验证、匹配器设置、部署及故障排查,适用于大规模Agent配置集中管理与运维。
配置Alloy采集器
远程推送Pipeline配置
使用OpAMP管理Agent
排查REMOTE_CONFIG_STATUS_FAILED
验证River语法
npx skills add grafana/skills --skill fleet-management -g -y
基于gcx工具诊断前端可观测性(RUM)会话的健康状况,分析错误、根因及修复建议。适用于解释会话状态、RCA分析及健康度检查,依赖Faro等遥测数据。
用户要求诊断或分析前端会话
询问会话是否健康
提及Faro、Core Web Vitals、异常或ANR
提供App ID和Session ID上下文
npx skills add grafana/skills --skill frontend-session-rca -g -y
用于将Kubernetes、主机、容器及云提供商的遥测数据接入Grafana Cloud。涵盖Helm部署、Alloy配置、多云监控集成及故障排查,支持集群上线与指标采集。
monitor my cluster
send K8s metrics to Grafana
scrape EC2 metrics
cluster pod logs
install the monitoring helm chart
npx skills add grafana/skills --skill infrastructure -g -y
用于在Grafana Cloud中启用AI与ML功能,包括动态告警(Prophet预测、DBSCAN异常检测)、自然语言查询、自动化根因分析(Sift)及LLM插件集成。
需要基于数据趋势而非静态阈值的智能告警
使用自然语言生成PromQL或构建Dashboard
执行自动化事故调查与根因分析
将LLM模型接入Grafana进行辅助分析
npx skills add grafana/skills --skill ml-ai -g -y
配置Grafana OnCall/IRM告警路由、值班轮换及事件升级链,支持Alertmanager集成与Slack ChatOps。
配置告警接收器与路由规则
设置值班轮换时间表
构建或测试事件升级链
处理P1-P4级事故生命周期
npx skills add grafana/skills --skill oncall-irm -g -y
配置 Grafana Cloud 私有网络连接(AWS/Azure/GCP),通过 VPC 端点实现指标、日志等数据私网传输,避免公网暴露与出口费用,满足合规要求。
需要消除云流量出口费用
要求遥测数据不经过公共互联网
需满足 PCI-DSS/HIPAA 等数据驻留合规性
配置私有数据源连接
npx skills add grafana/skills --skill private-connectivity -g -y
用于诊断 Prometheus 基数问题,如内存溢出、查询缓慢及费用激增。通过系统化的排查步骤定位高基数指标和标签,提供安全修复建议并路由至相关工具。
Prometheus OOM 或内存持续增长
PromQL 查询慢或超时
Grafana Cloud DPM 或 Active Series 账单激增
接收样本错误(Too Many Samples)
npx skills add grafana/skills --skill prometheus-cardinality-troubleshooter -g -y
Prometheus标签策略专家,评估、审计和优化标签架构。核心在于从源头(代码和抓取目标)防止高基数问题,确保数据完整性,避免后期删除唯一标识符导致的数据错误。
评估或审计 Prometheus 标签策略
设计或改进标签模式
询问如何从源头预防高基数
npx skills add grafana/skills --skill prometheus-label-strategy -g -y
用于编写Grafana Cloud合成监控检查,涵盖k6脚本和浏览器检查。提供执行模型约束、断言最佳实践、本地验证及通过UI/API/Terraform/gcx的部署指导,旨在保障可用性而非负载测试。
编写合成监控检查
将k6脚本转换为检查
验证用户旅程可用性
多区域站点健康检查
npx skills add grafana/skills --skill synthetic-monitoring-checks -g -y
提供Grafana Cloud测试能力,涵盖合成监控、k6云负载测试及Faro前端遥测。用于多地域探活、发布前性能门禁、TLS证书监控及前端用户体验指标追踪与错误关联。
检查网站或API在多个地区的可用性
执行发布前的负载测试门禁
监控TLS证书有效期
在前端应用中集成RUM和核心网页指标
将前端错误与后端链路追踪关联
npx skills add grafana/skills --skill testing -g -y
配置Grafana告警、事件响应管理(SLO)及通知路由,涵盖联系人、策略、SLO定义与验证。
配置Grafana告警规则或通知策略
设置SLO或多窗口燃烧率警报
调试告警路由或通知未触发问题
集成IRM或配置值班轮转
npx skills add grafana/skills --skill alerting-irm -g -y
用于构建统一遥测管道的Grafana Alloy技能,支持指标、日志、链路和配置文件的采集与发送。涵盖配置编写、验证、多源发现及OTLP协议处理,适用于替代旧版Agent或调试数据上报问题。
配置Grafana Alloy收集指标或日志
调试遥测数据未发送的问题
将应用日志转发至Loki
接收并导出OTLP追踪数据到Tempo
npx skills add grafana/skills --skill alloy -g -y
基于 eBPF 实现零代码应用可观测性,自动采集 HTTP/gRPC/DB 流量并导出 OTLP 指标与追踪数据。适用于无法修改源码或闭源场景,支持 Docker 单实例及 Kubernetes DaemonSet 集群部署。
添加不可编译应用的监控
eBPF 可观测性配置
零代码 APM 集成
Trace 数据接入 Tempo
npx skills add grafana/skills --skill beyla -g -y
通过 HTTP API 构建、修改和发布 Grafana 仪表盘 JSON。支持面板配置、变量管理及数据转换,实现监控仪表盘的自动化创建与更新。
创建新的 Grafana 仪表盘
通过 API 推送或更新仪表盘 JSON
添加模板变量如服务下拉框
计算错误率等数据转换
npx skills add grafana/skills --skill dashboarding -g -y
用于配置 Grafana OSS,涵盖从 YAML 编排仪表盘与数据源、管理 RBAC 角色及服务账号令牌,到修改服务器配置及插件安装等全流程自动化。支持通过 API 验证健康状态,适用于监控平台初始化与运维配置场景。
配置 Prometheus/Loki 等数据源
通过 YAML 或 API 编排仪表盘
创建服务账号并分配权限
设置 SMTP/OAuth 等服务器配置
排查预置仪表盘未显示问题
npx skills add grafana/skills --skill grafana-oss -g -y
提供OpenTelemetry与Grafana集成方案,涵盖多语言自动注入、OTLP认证及Alloy管道配置。适用于服务监控数据上报、从其他APM迁移或排查链路追踪问题。
需要为应用添加OpenTelemetry指标/日志/追踪
将OTLP数据发送到Grafana Cloud或自建后端
从Jaeger/Datadog等迁移到Grafana
配置环境变量或调试链路不显示问题
npx skills add grafana/skills --skill opentelemetry -g -y
PromQL查询技能,涵盖编写、验证与优化Prometheus/Grafana指标查询。包含聚合函数、直方图分位数、SLO燃烧率计算及性能调优,用于监控数据分析和告警规则构建。
编写Prometheus查询语句
修复错误的P95/P99延迟计算
构建基于错误预算的告警
调试缓慢的查询或高基数问题
将Dashboard查询迁移为录制规则
npx skills add grafana/skills --skill promql -g -y
用于编写、审查和优化 Grafana Agent SKILL.md 文件,确保符合 Anthropic 指南及 CI 门禁标准。涵盖触发词设计、渐进式披露结构、内容精简及自动化验证流程,适用于创建新技能或修复低分技能。
创建新的 Grafana Skill
审查 Skill PR
Skill 评分低于75需优化
Skill 描述无法被 Agent 触发
重构长文档为 Bundle
询问如何编写或改进 Skill
npx skills add grafana/skills --skill skill-authoring -g -y
用于调查 Grafana Cloud k6 测试或运行结果的结构化工作流。支持脚本分析、运行历史查询、通过/失败状态判定及原始指标日志提取,帮助用户诊断测试失败原因并安全编辑脚本。
用户询问特定 k6 测试或运行的状态(如是否通过)
用户提供 /a/k6-app/tests/<id> 或 /a/k6-app/runs/<id> URL
用户请求分析测试失败原因、查看特定运行的指标或日志
用户希望添加阈值或修复失败的测试
npx skills add grafana/skills --skill k6-cloud-investigate-test -g -y
用于编写、审查 k6 文档、TypeScript 类型定义及发布说明。覆盖用户文档、API 参考及变更日志,确保示例在 master 分支可运行并符合风格规范。
编写或审查 k6 相关文档
生成 TypeScript 类型定义
撰写或更新发布说明
npx skills add grafana/skills --skill k6-docs -g -y
管理Grafana Cloud k6的负载测试、脚本、项目及运行记录,支持通过gcx CLI或curl获取指标与日志。适用于性能测试配置、执行及故障排查场景。
用户询问k6测试失败原因或需要查看特定运行的日志/指标
用户要求创建、编辑、启动或中止k6负载测试任务
用户需要管理k6项目设置、环境变量或定时调度
npx skills add grafana/skills --skill k6-manage -g -y
基于k6对公开网站执行端到端性能、负载及压力测试。自动生成混合测试套件、SLO阈值、监控旁路及Grafana排查手册,确保功能测试通过后再进行负载测试,并提供结构化报告。
perf test my site
performance test my site
load test this URL
stress test my web app
I want to load test [URL]
set up k6 against my website
write a k6 suite for [site]
see if my site handles N concurrent users
how does my site perform under traffic
npx skills add grafana/skills --skill k6-perf-test-website -g -y
维护和改进现有k6测试脚本,涵盖阈值调整、版本迁移、服务变更适配、代码重构及最佳实践审计。严格区分语法与行为变更,确保修改安全可控并经过验证循环。
修复失败的k6测试
收紧阈值
迁移到新版k6
服务变更后更新脚本
重构测试代码
npx skills add grafana/skills --skill k6-test-maintenance -g -y
分析 Grafana Cloud k6 测试的历史趋势,检测指标缓慢漂移、计算阈值余量并推荐调整。适用于评估性能退化、检查测试健康度及判断是否需收紧阈值等场景。
询问测试性能趋势或是否恶化
请求检查特定测试的近期运行健康状态
咨询是否需要收紧测试阈值
要求分析多个测试项目的整体趋势
npx skills add grafana/skills --skill k6-trend-analysis -g -y
生成、验证和审查k6性能测试脚本,支持HTTP、WebSocket、gRPC及浏览器自动化等场景,提供示例适配与执行校验。
编写负载或压力测试脚本
调试k6测试用例
查询k6文档或扩展用法
npx skills add grafana/skills --skill k6 -g -y
用于部署和配置 Grafana Mimir,实现 Prometheus 和 OTLP 指标的水平扩展、多租户及长期存储。涵盖本地 Docker、K8s Helm 部署、远端写入配置及故障排查。
需要长期存储 Prometheus 指标
扩展 Prometheus 集群规模
搭建多租户指标后端
替代 Cortex 或配置 remote_write
处理 Mimir 503 或 429 错误
npx skills add grafana/skills --skill mimir -g -y
提供Grafana Pyroscope连续性能分析能力,涵盖eBPF自动注入、多语言SDK集成及ProfileQL查询。用于部署集群级profiler、定位CPU/内存热点、对比性能回归及关联Trace与Profile数据。
添加服务性能剖析
部署Alloy eBPF profiler
通过火焰图排查CPU或内存热点
对比两个Profile以发现性能回归
将慢速Tempo追踪与Profile关联
npx skills add grafana/skills --skill pyroscope -g -y
部署 Grafana Tempo 分布式追踪后端,支持多租户与对象存储。提供 TraceQL 查询以定位慢请求和错误,配置链路/日志/指标关联,涵盖本地启动、K8s Helm 部署及 OTLP 数据接入等全流程。
部署 Tempo
编写 TraceQL 查询
排查无追踪数据问题
配置 S3/GCS 存储
查找慢请求或错误服务
npx skills add grafana/skills --skill tempo -g -y
用于构建基于@grafana/scenes框架的Grafana插件页面,涵盖场景对象创建、面板可视化、钻取导航及变量配置等开发任务。
创建新的Grafana场景页面
添加面板或可视化组件
配置钻取导航或标签页
定义查询运行器和数据转换器
npx skills add grafana/skills --skill grafana-scenes -g -y


