Agent Skills
› SprocketLab/slop-code-bench
SprocketLab/slop-code-bench
GitHub用于审查招聘任务中的规格说明书,移除冗余信息、架构暗示和过度引导,确保候选人需通过设计决策解题而非依赖隐藏细节或试错。
Install All Skills
npx skills add SprocketLab/slop-code-bench --all -g -y
Skills in Collection (9)
用于审查招聘任务中的规格说明书,移除冗余信息、架构暗示和过度引导,确保候选人需通过设计决策解题而非依赖隐藏细节或试错。
需要审查技术面试题目规范时
优化规格说明书以去除过度指导时
npx skills add SprocketLab/slop-code-bench --skill audit-spec -g -y
分析测试规范与现有用例,识别缺失的边缘情况并生成带TODO的测试骨架代码。用于提升测试覆盖率,确保对边界值、异常输入等场景的验证。
编写测试后检查覆盖度
审查测试用例完整性
npx skills add SprocketLab/slop-code-bench --skill edge-cases -g -y
用于迭代测试并修复基准问题的解决方案代码,直到所有测试通过。适用于解决方案存在失败测试的场景,通过运行评估、分析失败原因、最小化修复及验证来确保代码正确性。
解决方案测试失败时
需要迭代修复代码直至通过测试
npx skills add SprocketLab/slop-code-bench --skill fix-solution -g -y
根据规格说明书显式示例,分析并重新分类测试用例。将未明确展示的行为标记为功能测试,确保核心测试仅覆盖显式需求,提升评估公平性。
用户要求重新分类测试用例
需要区分核心测试与功能测试
测试评估标准不一致
npx skills add SprocketLab/slop-code-bench --skill reclassify-tests -g -y
在Docker环境中运行基准测试,评估解决方案质量。通过eval-snapshot命令隔离执行测试并输出结构化结果与代码质量指标,辅助判断测试通过率及失败原因。
需要运行自动化测试
评估代码解决方案的正确性
检查测试覆盖率与通过率
npx skills add SprocketLab/slop-code-bench --skill run-tests -g -y
对比测试用例与规格说明,识别测试中未由规格明确定义的假设行为,如具体返回值、错误码或格式要求,评估风险并生成报告以澄清规格或调整测试。
分析测试用例是否符合规格定义
发现测试断言超出规格范围
检查测试是否包含未指定的实现细节假设
npx skills add SprocketLab/slop-code-bench --skill test-ambiguity-detector -g -y
并行验证智能体运行目录中的所有检查点。通过分发测试验证器代理,对比规范与测试结果,识别代码或测试错误,并对子代理报告进行人工复核以确保准确性。
用户请求验证智能体运行结果
需要批量检查多个检查点的正确性
npx skills add SprocketLab/slop-code-bench --skill validate-run -g -y
审查检查点规范与测试,识别将模糊解释而非明确需求编码为测试用例的情况。通过对比规格说明与测试断言,发现并报告因规格未明确定义(如排序、精度、边界)导致的歧义性测试,提供修复建议。
检查 checkpoint_N.md 与 test_checkpoint_N.py
审计测试是否存在歧义
审查快照评估失败中的解释性问题
npx skills add SprocketLab/slop-code-bench --skill checkpoint-ambiguity-review -g -y
分析检查点规范与现有测试,识别并补充缺失的边界、异常及空值等边缘情况测试用例,确保测试覆盖度。
编写测试后
审查测试覆盖率时
npx skills add SprocketLab/slop-code-bench --skill edge-cases -g -y


