Agent Skillswinstonkoh87/Athena-Public › red-team-review

red-team-review

GitHub

红队审查技能,采用7阶段框架对提案、代码等工件进行对抗性评估。通过预设前提、多维度攻击视角及偏差检测,识别盲点与风险,提供决策引擎支持,确保逻辑严谨性与战略对齐。

examples/skills/quality/red-team-review/SKILL.md winstonkoh87/Athena-Public

Trigger Scenarios

review this red team what am I missing is this ready to ship QA critique

Install

npx skills add winstonkoh87/Athena-Public --skill red-team-review -g -y
More Options

Non-standard path

npx skills add https://github.com/winstonkoh87/Athena-Public/tree/main/examples/skills/quality/red-team-review -g -y

Use without installing

npx skills use winstonkoh87/Athena-Public@red-team-review

指定 Agent (Claude Code)

npx skills add winstonkoh87/Athena-Public --skill red-team-review -a claude-code -g -y

安装 repo 全部 skill

npx skills add winstonkoh87/Athena-Public --all -g -y

预览 repo 内 skill

npx skills add winstonkoh87/Athena-Public --list

SKILL.md

Frontmatter
{
    "name": "red-team-review",
    "model": "default",
    "auto-invoke": false,
    "description": "Unified adversarial review: v4.3 Strategic Matrix (MTA-004). 7-phase framework: Priors → Rubric → Adversarial Lenses → SWOT\/TOWS → MCDA Decision Engine → Blind Spot\/Kill Switch → Executive Summary. Absorbs: bias-detector.",
    "argument-hint": "review this | red team | what did I miss | QA | bias check | is this anchored | base rate",
    "context_trigger": "review, red team, what did I miss, QA, bias check, critique, pre-mortem, is this ready, stress test, adversarial"
}

Red-Team Review (v4.3 — Strategic Matrix)

Canonical Protocol: MTA-004-red-team-v4-3.md Absorbs: bias-detector (v4.0 Phase 2 anchoring/base-rate suite retained below) Upgraded: 2026-09-04 — unified skill v4.0 + protocol v4.3 into single version Version History: v4.0 (5-phase) → v4.1 → v4.2 → v4.3 (Strategic Matrix, 7-phase)

This skill wraps MTA-004 (the canonical red-team protocol) and adds trigger routing + the bias detection suite from v4.0. For the full framework, load MTA-004 directly.

Triggers

"review this", "red team", "what am I missing", "is this ready to ship", "QA", "critique", "is this a fair price", "too good to be true", "scam", "is this legit", "grill me"

The 7-Phase Framework (MTA-004 v4.3)

Phase 0: Priors & Premises (Mandatory)

Assume the "Alien Observer" stance. Declare:

  1. Thesis: core argument/frame of the artifact
  2. Falsification: what specific metric/event proves this wrong
  3. Excluded Reality: what valid perspective is strictly ignored
  4. Reality Check: the unspoken cultural narrative or meta-game

Do not proceed until these 4 are answered.

Phase 1: The Objective Rubric

Score the artifact against this matrix. Start at 50%.

Component Weight Criteria
Logic & Rigor 30% Deductively sound. Checks survivorship bias & sample size. No orphan stats.
Bias Mitigation 20% Steelmans opposition. Checks for sycophancy.
Completeness 20% Addresses "The Victim." Covers edge cases and cultural nuance.
Strategic Alignment 15% Aligns with Law #1. Respects physics. High utility.
Actionability 15% Recommendations are distinct, executable, and ranked.

Confidence Cap: Low confidence → max score capped at 60/100.

Phase 1.5: The "Grill Me" Test (Echo Chamber Breaker)

If invoked via /grill or explicitly asked to "grill me":

  1. Reverse Roles: Act as the senior, uncompromising reviewer.
  2. Challenge Premises: Explicitly challenge at least one core premise.
  3. Demand Proof: Make the user defend their decisions.

Phase 2: Adversarial Lenses (The Attack)

One concrete objection per lens:

Lens The Attack Question
The Skeptic Survivorship bias or small sample size (n=1)? Show me the graveyard.
The Victim This strategy harms me because [negative externalities].
The Historian Mean reversion? Does this work in a bear market?
The Anthropologist What is the implied social contract or cultural narrative?
The Cynic You are lying to yourself about [hidden incentive/ego].
The System This ignores the 2nd order effect on [broader ecosystem].
The Entropy This will rot via [vector] because [reason].

Entropy Vectors: Incentive Rot, Complexity Rot, Competition Rot, Regulatory Rot, Tech Obsolescence, Data Rot.

Phase 2B: Bias Detection Suite (from v4.0)

Anchoring Detection

  1. Source Check: Where did this number come from?
  2. Red Flags: Round numbers, comparison anchoring, pre-concession framing.
  3. Structural Test: Cost of production? Value to buyer? Alternative cost?
  4. Correction: Structural Value = max(Cost * 1.5, Value to Buyer * 0.3)

Base Rate Audit

IF (Claimed Outcome) >> (Expected Outcome for Demographics)
THEN (Hidden Variable) EXISTS

Hidden Variable Spectrum (descending probability):

  1. Hidden Capital — family money, inheritance
  2. Hidden Cost — extreme leverage, illegal activity
  3. Hidden Variance — survivorship bias
  4. Fabrication — the claim is a lie
  5. Genuine Outlier — the <0.1%

Standard Bias Checklist

Sycophancy, Cherry-Picking, False Precision, Assumed Context, Complexity Bias.

Phase 3: Strategic Expansion (SWOT + TOWS)

Use Phase 2 objections to populate Weaknesses/Threats. Build the TOWS matrix:

  • SO (Attack): Use Strength to capture Opportunity
  • WO (Improve): Fix Weakness to capture Opportunity
  • ST (Defend): Use Strength to block Threat
  • WT (Mitigate): Survival/exit strategy

Phase 4: Decision Engine (MCDA)

Rank top 3 recommendations using: Final Score = ((Impact + Ease) / Risk Factor) * Entropy Multiplier

  • Risk Factors: Low = 1.0 | Med = 1.5 | High = 2.0
  • Entropy Multipliers: Stable = 1.0 | Decaying = 0.8 | Rotting = 0.5

Invoke Protocol 121 (MCDA/EEV/Pairwise) for complex multi-criteria rankings.

Phase 5: Blind Spot & Kill Switch

  1. "I am least confident about ______ because ______." (Check for survivorship bias.)
  2. The Kill Switch: We must ABANDON this strategy immediately if [specific condition].

Executive Summary

  1. Final Score: XX/100 (Confidence: X)
  2. The Kill Shot: The single most dangerous flaw found.
  3. The #1 Recommendation: The highest scoring Phase 4 option.

Rules

  • Quote directly. No vague complaints.
  • Steelman opposing views BEFORE critiquing them.
  • Empty sections are allowed — don't invent issues.
  • Every HIGH must have a fix achievable in ≤10 minutes.

Reference Protocols

Version History

  • 006a53a Current 2026-09-08 20:31

    v4.3版本引入战略矩阵,扩展为7阶段框架;整合bias-detector模块;更新触发路由机制。

  • e624e2d 2026-07-19 08:47

Same Skill Collection

examples/protocols/diagnostics/DIA-SKILL.md
examples/skills/business/brand-foundations/SKILL.md
examples/skills/business/client-pricing/SKILL.md
examples/skills/business/distribution-physics/SKILL.md
examples/skills/business/marketing-swarm/SKILL.md
examples/skills/business/seo-auditor/SKILL.md
examples/skills/business/sovereign-economics-engine/SKILL.md
examples/skills/coding/agentic-code-orchestrator/SKILL.md
examples/skills/coding/atomic-execution/SKILL.md
examples/skills/coding/dashboard-builder/SKILL.md
examples/skills/coding/diagnostic-refactor/SKILL.md
examples/skills/coding/git-worktree-swarm/SKILL.md
examples/skills/coding/micro-commit/SKILL.md
examples/skills/coding/spec-driven-dev/SKILL.md
examples/skills/coding/visual-verify-ui/SKILL.md
examples/skills/decision/bionic-decision-engine/SKILL.md
examples/skills/decision/decision-journal/SKILL.md
examples/skills/decision/mcda-solver/SKILL.md
examples/skills/decision/trading-risk-gate/SKILL.md
examples/skills/decision/zenith-execution/SKILL.md
examples/skills/quality/bionic-safety-net/SKILL.md
examples/skills/quality/circuit-breaker/SKILL.md
examples/skills/quality/consiglieri-protocol/SKILL.md
examples/skills/quality/power-inversion/SKILL.md
examples/skills/quality/web-launch-gate/SKILL.md
examples/skills/research/data-analysis/SKILL.md
examples/skills/research/deep-research-loop/SKILL.md
examples/skills/research/semantic-search/SKILL.md
examples/skills/research/statistical-analysis/SKILL.md
examples/skills/research/synthetic-parallel-reasoning/SKILL.md
examples/skills/social-physics-filter/SKILL.md
examples/skills/structural-trading-gate/SKILL.md
examples/skills/therapeutic-ifs/SKILL.md
examples/skills/workflow/academic-delivery/SKILL.md
examples/skills/workflow/context-compactor/SKILL.md
examples/skills/workflow/daemon-loop/SKILL.md
examples/skills/workflow/skill-compiler/SKILL.md
examples/skills/workflow/trade-journal-analyzer/SKILL.md

Metadata

Files
0
Version
006a53a
Hash
3e22af42
Indexed
2026-07-19 08:47

Главная - Вики-сайт
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-09-10 04:36
浙ICP备14020137号-1 $Гость$