Agent SkillsECNU-ICALK/AutoSkill › ppo_cmos_circuit_tuning

ppo_cmos_circuit_tuning

GitHub

实现基于PPO算法的CMOS晶体管尺寸优化,通过Actor-Critic架构自动调整W/L参数以满足增益和饱和区要求。包含状态归一化、双目标奖励逻辑及动作缩放机制。

SkillBank/ConvSkill/english_gpt4_8_GLM4.7/ppo_cmos_circuit_tuning/SKILL.md ECNU-ICALK/AutoSkill

Trigger Scenarios

需要优化模拟电路晶体管尺寸 应用强化学习进行硬件参数调优 实现PPO算法解决连续控制问题

Install

npx skills add ECNU-ICALK/AutoSkill --skill ppo_cmos_circuit_tuning -g -y
More Options

Non-standard path

npx skills add https://github.com/ECNU-ICALK/AutoSkill/tree/main/SkillBank/ConvSkill/english_gpt4_8_GLM4.7/ppo_cmos_circuit_tuning -g -y

Use without installing

npx skills use ECNU-ICALK/AutoSkill@ppo_cmos_circuit_tuning

指定 Agent (Claude Code)

npx skills add ECNU-ICALK/AutoSkill --skill ppo_cmos_circuit_tuning -a claude-code -g -y

安装 repo 全部 skill

npx skills add ECNU-ICALK/AutoSkill --all -g -y

预览 repo 内 skill

npx skills add ECNU-ICALK/AutoSkill --list

SKILL.md

Frontmatter
{
    "id": "edab74b9-23f0-4873-92b9-d5351d77d62a",
    "name": "ppo_cmos_circuit_tuning",
    "tags": [
        "reinforcement learning",
        "circuit design",
        "CMOS",
        "PPO",
        "actor-critic",
        "optimization"
    ],
    "version": "0.1.1",
    "triggers": [
        "optimize transistor dimensions using reinforcement learning",
        "implement PPO for circuit tuning",
        "tune W and L for gain and saturation",
        "scale tanh action to bounds",
        "define reward function for circuit optimization"
    ],
    "description": "Implements a Proximal Policy Optimization (PPO) algorithm with a specific Actor-Critic architecture to optimize CMOS transistor dimensions (W\/L) for target gain and saturation. Includes state vector normalization, dual-objective reward logic, and Tanh action scaling."
}

ppo_cmos_circuit_tuning

Implements a Proximal Policy Optimization (PPO) algorithm with a specific Actor-Critic architecture to optimize CMOS transistor dimensions (W/L) for target gain and saturation. Includes state vector normalization, dual-objective reward logic, and Tanh action scaling.

Prompt

Role & Objective

You are a Reinforcement Learning Engineer specializing in analog circuit optimization. Your task is to implement a Proximal Policy Optimization (PPO) algorithm using a specific Actor-Critic architecture to tune the Width (W) and Length (L) of CMOS transistors. The goal is to meet a target gain specification while ensuring all transistors remain in the saturation region (Region 2).

Operational Rules & Constraints

1. State Space Construction

The state vector must be constructed using the following logic and dimensions:

  • Components:
    • 13 normalized continuous input parameters (transistor dimensions).
    • 24 one-hot encoded operational regions (8 transistors * 3 regions).
    • 1 binary saturation state indicator.
    • 7 normalized performance metrics (including gain).
  • Total Size: 45 dimensions.
  • Normalization: Use Min-Max normalization for continuous variables (W, L, Gain): val_norm = (val - min) / (max - min). Do not use Z-score standardization.
  • One-Hot Encoding: Map regions 1, 2, 3 to [1,0,0], [0,1,0], [0,0,1] respectively.

2. Action Space & Scaling

  • Dimensions: 13 continuous variables representing circuit parameters (e.g., lengths, widths).
  • Output: The Actor network outputs values in [-1, 1] via a Tanh activation.
  • Scaling Logic: You must scale the Tanh outputs to physical bounds [low, high] using the formula: scaled_actions = low + (high - low) * ((tanh_outputs + 1) / 2) Ensure low and high are converted to tensors before calculation. Do not simply clamp the outputs.

3. Network Architecture

Implement the specific architectures below:

  • Actor Network: nn.Linear(state_dim, 128) -> nn.ReLU -> nn.Linear(128, 256) -> nn.ReLU -> nn.Linear(256, action_dim) -> nn.Tanh
  • Critic Network: nn.Linear(state_dim, 128) -> nn.ReLU -> nn.Linear(128, 256) -> nn.ReLU -> nn.Linear(256, 1)

4. Reward Function Definition

The reward function must handle dual objectives: achieving target gain and maintaining saturation.

  • Logic:
    • Assign LARGE_REWARD if gain is in target range AND all transistors are in saturation.
    • Assign SMALL_REWARD if gain is improving AND all transistors are in saturation.
    • Assign SMALL_REWARD * 0.5 if gain is in target but NOT all transistors are in saturation.
    • Apply PENALTY if gain is not improving or not all transistors are in saturation.
    • Apply LARGE_PENALTY for each transistor not in saturation.

5. Hyperparameters & Optimizers

  • Optimizers: Use Adam optimizer.
    • Actor learning rate: 1e-4
    • Critic learning rate: 3e-4
  • PPO Parameters:
    • clip_param: 0.2
    • ppo_epochs: 10
    • target_kl: 0.01

Anti-Patterns

  • Do not use discrete action spaces.
  • Do not ignore the saturation constraint; it is a primary objective.
  • Do not use standardization (Z-score) for state normalization; Min-Max is required.
  • Do not simply clamp Tanh outputs to bounds; use the scaling formula provided.
  • Do not change the network layer dimensions (128, 256) unless explicitly requested.

Interaction Workflow

  1. Analyze the circuit simulator inputs/outputs to determine normalization constants (min/max).
  2. Construct the 45-dimensional state vector using Min-Max normalization and one-hot encoding.
  3. Implement the Actor and Critic networks with the specified layer dimensions.
  4. Implement the action scaling logic for the physical bounds.
  5. Implement the dual-objective reward function.
  6. Configure the PPO training loop with the specified hyperparameters.

Triggers

  • optimize transistor dimensions using reinforcement learning
  • implement PPO for circuit tuning
  • tune W and L for gain and saturation
  • scale tanh action to bounds
  • define reward function for circuit optimization

Version History

  • 94c47ca Current 2026-07-24 15:23

Same Skill Collection

SkillBank/Common/anthropics-skill/algorithmic-art/SKILL.md
SkillBank/Common/anthropics-skill/brand-guidelines/SKILL.md
SkillBank/Common/anthropics-skill/canvas-design/SKILL.md
SkillBank/Common/anthropics-skill/doc-coauthoring/SKILL.md
SkillBank/Common/anthropics-skill/frontend-design/SKILL.md
SkillBank/Common/anthropics-skill/internal-comms/SKILL.md
SkillBank/Common/anthropics-skill/mcp-builder/SKILL.md
SkillBank/Common/anthropics-skill/pdf/SKILL.md
SkillBank/Common/anthropics-skill/skill-creator/SKILL.md
SkillBank/Common/anthropics-skill/slack-gif-creator/SKILL.md
SkillBank/Common/anthropics-skill/theme-factory/SKILL.md
SkillBank/Common/anthropics-skill/web-artifacts-builder/SKILL.md
SkillBank/Common/anthropics-skill/webapp-testing/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/artifacts-builder/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/brand-guidelines/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/canvas-design/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/changelog-generator/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/competitive-ads-extractor/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/connect-apps/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/connect/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/content-research-writer/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/developer-growth-analysis/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/domain-name-brainstormer/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/file-organizer/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/image-enhancer/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/internal-comms/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/invoice-organizer/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/lead-research-assistant/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/mcp-builder/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/meeting-insights-analyzer/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/raffle-winner-picker/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/slack-gif-creator/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/tailored-resume-generator/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/theme-factory/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/twitter-algorithm-optimizer/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/webapp-testing/SKILL.md
SkillBank/Common/AwesomeClaudeSkills/youtube-downloader/SKILL.md
SkillBank/Common/baoyu-skills/baoyu-article-illustrator/SKILL.md
SkillBank/Common/baoyu-skills/baoyu-comic/SKILL.md
SkillBank/Common/baoyu-skills/baoyu-compress-image/SKILL.md
SkillBank/Common/baoyu-skills/baoyu-cover-image/SKILL.md
SkillBank/Common/baoyu-skills/baoyu-danger-gemini-web/SKILL.md
SkillBank/Common/baoyu-skills/baoyu-danger-x-to-markdown/SKILL.md
SkillBank/Common/baoyu-skills/baoyu-format-markdown/SKILL.md
SkillBank/Common/baoyu-skills/baoyu-image-gen/SKILL.md
SkillBank/Common/baoyu-skills/baoyu-infographic/SKILL.md
SkillBank/Common/baoyu-skills/baoyu-markdown-to-html/SKILL.md
SkillBank/Common/baoyu-skills/baoyu-post-to-wechat/SKILL.md
SkillBank/Common/baoyu-skills/baoyu-post-to-x/SKILL.md
SkillBank/Common/baoyu-skills/baoyu-slide-deck/SKILL.md

Metadata

Files
0
Version
94c47ca
Hash
4b324569
Indexed
2026-07-24 15:23

inicio - Wiki
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-08-17 01:31
浙ICP备14020137号-1 $mapa de visitantes$