Agent Skillsbacoco/BMad-Skills › bmad-observability-readiness

bmad-observability-readiness

GitHub

建立可观测性基础,包括监控、告警和日志规划。适用于系统上线前或面临性能可靠性问题时,通过审计现有遥测数据、定义SLO和设计仪表板,输出全面的可观测性计划及实施待办事项,确保系统具备可靠的诊断与测量能力。

.claude/skills/bmad-observability-readiness/SKILL.md bacoco/BMad-Skills

Trigger Scenarios

提及缺失或低质量的日志、指标或追踪 请求在发布前设置监控或告警 需要SLO、仪表板或值班手册 报告告警疲劳或噪音问题

Install

npx skills add bacoco/BMad-Skills --skill bmad-observability-readiness -g -y
More Options

Non-standard path

npx skills add https://github.com/bacoco/BMad-Skills/tree/main/.claude/skills/bmad-observability-readiness -g -y

Use without installing

npx skills use bacoco/BMad-Skills@bmad-observability-readiness

指定 Agent (Claude Code)

npx skills add bacoco/BMad-Skills --skill bmad-observability-readiness -a claude-code -g -y

安装 repo 全部 skill

npx skills add bacoco/BMad-Skills --all -g -y

预览 repo 内 skill

npx skills add bacoco/BMad-Skills --list

SKILL.md

Frontmatter
{
    "name": "bmad-observability-readiness",
    "metadata": {
        "outputs": [
            "observability-plan",
            "instrumentation-backlog",
            "slo-dashboard-spec"
        ],
        "triggers": {
            "keywords": [
                "observability",
                "logging",
                "monitoring",
                "tracing",
                "metrics",
                "alerting",
                "telemetry"
            ],
            "patterns": [
                "add logging",
                "monitoring setup",
                "no telemetry",
                "instrument this",
                "observability gaps",
                "alert fatigue",
                "SLO dashboard"
            ]
        },
        "auto-invoke": true,
        "capabilities": [
            "instrumentation-design",
            "metrics-cataloging",
            "logging-standards",
            "alert-tuning",
            "slo-definition"
        ],
        "prerequisites": [
            "bmad-architecture-design",
            "bmad-test-strategy"
        ]
    },
    "description": "Establishes instrumentation, monitoring, and alerting foundations.",
    "allowed-tools": [
        "Read",
        "Write",
        "Grep",
        "Bash"
    ]
}

BMAD Observability Readiness Skill

When to Invoke

Use this skill when the user:

  • Mentions missing or low-quality logging, metrics, or tracing.
  • Requests monitoring/alerting setup before a launch or major release.
  • Needs SLOs, dashboards, or on-call runbooks.
  • Reports alert fatigue or noise that needs rationalization.
  • Wants to ensure performance and reliability work has data coverage.

If instrumentation already exists and only specific bug fixes are required, hand over to bmad-development-execution with the backlog produced here.

Mission

Deliver a comprehensive observability plan that enables diagnosis, alerting, and measurement across the system. Ensure downstream performance, reliability, and security work has trustworthy telemetry.

Inputs Required

  • Architecture diagrams and component inventory.
  • Existing logging/monitoring/tracing configuration (if any).
  • Current incidents, outages, or blind spots experienced by the team.
  • SLAs/SLOs, business KPIs, or compliance reporting requirements.

Outputs

  • Observability plan detailing metrics, logs, traces, dashboards, and retention policies.
  • Instrumentation backlog with implementation tasks, owners, and acceptance criteria.
  • SLO dashboard specification covering golden signals, alert thresholds, and runbook links.
  • Updated runbook or escalation paths if gaps were discovered.

Process

  1. Audit current telemetry coverage, tooling, and data retention. Document gaps.
  2. Define observability objectives aligned with user journeys and business KPIs.
  3. Design instrumentation strategy: metrics taxonomy, structured logging, trace spans, event schemas.
  4. Establish SLOs, SLIs, and alerting strategy with on-call expectations and noise controls.
  5. Produce dashboards/reporting requirements and data governance notes.
  6. Create backlog with prioritized instrumentation tasks and verification approach.

Quality Gates

  • Every critical user journey has metrics and alerts defined (latency, errors, saturation, traffic).
  • Logging standards specify structure, PII handling, and retention.
  • Alert runbooks documented or flagged for creation.
  • Observability plan references integration with performance, security, and incident workflows.

Error Handling

  • If telemetry tooling is undecided, present comparative options with trade-offs.
  • Highlight dependencies on platform teams or infrastructure before finalizing timeline.
  • Escalate when observability requirements conflict with compliance or privacy constraints.

Version History

  • 58378b1 Current 2026-08-20 13:14

Same Skill Collection

.claude/skills/bmad-performance-optimization/SKILL.md
.claude/skills/bmad-security-review/SKILL.md
.claude/skills/bmad-taskmaster-mcp-bootstrap/SKILL.md
.claude/skills/core-skill-creation/SKILL.md
.claude/skills/main-workflow-router/SKILL.md
.claude/skills/bmad-architecture-design/SKILL.md
.claude/skills/bmad-development-execution/SKILL.md
.claude/skills/bmad-discovery-research/SKILL.md
.claude/skills/bmad-product-planning/SKILL.md
.claude/skills/bmad-story-planning/SKILL.md
.claude/skills/bmad-test-strategy/SKILL.md
.claude/skills/bmad-ux-design/SKILL.md
.claude/skills/openspec-change-closure/SKILL.md
.claude/skills/openspec-change-implementation/SKILL.md
.claude/skills/openspec-change-proposal/SKILL.md

Metadata

Files
0
Version
58378b1
Hash
36bb4298
Indexed
2026-08-20 13:14

inicio - Wiki
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-08-22 07:29
浙ICP备14020137号-1 $mapa de visitantes$