Agent Skillsaiming-lab/AutoResearchClaw › nlp-pretraining

nlp-pretraining

GitHub

提供NLP模型预训练与微调的最佳实践,涵盖优化器配置、参数高效微调方法及评估指标,用于生成或审查相关训练代码。

researchclaw/skills/builtin/domain/nlp-pretraining/SKILL.md aiming-lab/AutoResearchClaw

Trigger Scenarios

生成NLP训练代码 审查NLP训练代码

Install

npx skills add aiming-lab/AutoResearchClaw --skill nlp-pretraining -g -y
More Options

Non-standard path

npx skills add https://github.com/aiming-lab/AutoResearchClaw/tree/main/researchclaw/skills/builtin/domain/nlp-pretraining -g -y

Use without installing

npx skills use aiming-lab/AutoResearchClaw@nlp-pretraining

指定 Agent (Claude Code)

npx skills add aiming-lab/AutoResearchClaw --skill nlp-pretraining -a claude-code -g -y

安装 repo 全部 skill

npx skills add aiming-lab/AutoResearchClaw --all -g -y

预览 repo 内 skill

npx skills add aiming-lab/AutoResearchClaw --list

SKILL.md

Frontmatter
{
    "name": "nlp-pretraining",
    "metadata": {
        "author": "researchclaw",
        "version": "1.0",
        "category": "domain",
        "priority": "3",
        "references": "Devlin et al., BERT, NAACL 2019; Hu et al., LoRA, ICLR 2022",
        "trigger-keywords": "language model,pretraining,fine-tuning,bert,gpt,llm,transformer,nlp,text",
        "applicable-stages": "9,10"
    },
    "description": "Best practices for language model pretraining and fine-tuning. Use when generating or reviewing NLP training code."
}

NLP Pretraining/Fine-tuning Best Practice

Fine-tuning recipe:

  • Use pre-trained checkpoints (HuggingFace hub)
  • AdamW optimizer, lr=2e-5 to 5e-5
  • Linear warmup (6% of total steps) + linear decay
  • Batch size: 16-32 (use gradient accumulation for larger effective batch)
  • 3-5 epochs for classification, 1-2 for generation
  • Weight decay: 0.01

Parameter-efficient methods:

  • LoRA: r=8-64, alpha=16-128, apply to q/v projections
  • Prefix tuning: 10-20 prefix tokens
  • Adapters: bottleneck dimension 64-256

Evaluation:

  • Classification: accuracy, F1 (macro for imbalanced)
  • Generation: perplexity, BLEU/ROUGE, human evaluation
  • Use multiple seeds and report mean +/- std

Version History

  • e2e23c9 Current 2026-07-25 07:48

Same Skill Collection

.claude/skills/a-evolve/SKILL.md
.claude/skills/biology-biopython/SKILL.md
.claude/skills/chemistry-rdkit/SKILL.md
.claude/skills/hypothesis-formulation/SKILL.md
.claude/skills/literature-search/SKILL.md
.claude/skills/researchclaw/SKILL.md
.claude/skills/scientific-visualization/SKILL.md
.claude/skills/scientific-writing/SKILL.md
.claude/skills/statistical-reporting/SKILL.md
external/agents/Biology-Agent/skills/fba-simulator/SKILL.md
external/agents/Biology-Agent/skills/flux-analyzer/SKILL.md
external/agents/Biology-Agent/skills/gsmm-builder/SKILL.md
external/agents/Biology-Agent/skills/gsmm-validator/SKILL.md
external/agents/Biology-Agent/skills/metabolic-study-planner/SKILL.md
external/agents/Biology-Agent/skills/mfa-pipeline-orchestrator/SKILL.md
external/agents/stat_research_agent/skills/stat-research-orchestrator/SKILL.md
external/agents/stat_research_agent/skills/stat-result-validator/SKILL.md
external/agents/stat_research_agent/skills/statistical-experimental-evaluation/SKILL.md
external/agents/stat_research_agent/skills/statistical-method-design/SKILL.md
external/agents/stat_research_agent/skills/statistical-problem-formulation/SKILL.md
external/agents/stat_research_agent/skills/statistical-theory-analysis/SKILL.md
researchclaw/skills/builtin/domain/biology-biopython/SKILL.md
researchclaw/skills/builtin/domain/chemistry-rdkit/SKILL.md
researchclaw/skills/builtin/domain/cv-classification/SKILL.md
researchclaw/skills/builtin/domain/cv-detection/SKILL.md
researchclaw/skills/builtin/domain/nlp-alignment/SKILL.md
researchclaw/skills/builtin/domain/quantum-qiskit/SKILL.md
researchclaw/skills/builtin/domain/rl-policy-optimization/SKILL.md
researchclaw/skills/builtin/experiment/experimental-design/SKILL.md
researchclaw/skills/builtin/experiment/hypothesis-formulation/SKILL.md
researchclaw/skills/builtin/experiment/literature-search/SKILL.md
researchclaw/skills/builtin/experiment/meta-analysis/SKILL.md
researchclaw/skills/builtin/experiment/scientific-visualization/SKILL.md
researchclaw/skills/builtin/experiment/scientific-writing/SKILL.md
researchclaw/skills/builtin/experiment/statistical-reporting/SKILL.md
researchclaw/skills/builtin/experiment/systematic-review/SKILL.md
researchclaw/skills/builtin/tooling/data-loading/SKILL.md
researchclaw/skills/builtin/tooling/distributed-training/SKILL.md
researchclaw/skills/builtin/tooling/mixed-precision/SKILL.md
researchclaw/skills/builtin/tooling/pytorch-training/SKILL.md

Metadata

Files
0
Version
be4ba47
Hash
ce910d10
Indexed
2026-07-25 07:48

inicio - Wiki
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-08-20 06:37
浙ICP备14020137号-1 $mapa de visitantes$