用于执行简单的上传测试或基础数据检查。通过调用 inspect_schema 和 run_sql_readonly 验证数据源,并以简洁语言总结只读查询结果,旨在进行运行时冒烟测试。
用于对视频生成模型运行 WBench 22项指标评测流水线,涵盖预计算、GPU推理、VLM评估及报告生成。适用于用户请求评估模型性能、计算评分或生成评测报告的场景。
用于在人类审批前对记录、数据集或GMP文档进行ALCOA+数据完整性检查的确定性Linter。支持FULL和DEGRADED模式,输出DRAFT供人工复核,绝不自动判定合规。
用于评估PII模型的召回率,通过合成数据验证标签感知的精确跨度与字素召回,确保发布前满足召回率底线,防止隐私泄露。
维护语义图谱工作流,涵盖论文、引用、推荐及作者网络工具。支持适配器测试与无API密钥的模拟环境,确保合同、模块、测试及发布门控的正确性。
定期审计研究知识库,检测过期档案、论点偏离和孤立页面,生成0-100健康评分及改进建议。
用于规划、顺序执行和对比多个训练实验的 Skill。涵盖参数扫描设计、日志解析、异常检测及结果分析,旨在优化模型训练流程并推荐后续实验方向。
对数据异常样本执行截尾处理,量化删除范围并评估偏差。通过工具路由识别列、分析分布、确认规则后清洗,并验证结果,确保可追溯。
对学术文献进行多源交叉验证,逐字段比对作者、标题等元数据,检测DOI冲突、页码偏差及作者异常等问题。支持批量处理整篇论文参考文献或单条校验,生成结构化验证报告并同步修正Zotero库。
用于在MATLAB中对表格数据进行端到端分类,包括数据加载、清洗、模型训练与比较。支持交叉验证、超参数优化及统计检验,旨在识别准确率相当的顶级模型。
用于 LAMMPS 分子动力学模拟工作流,涵盖输入准备、运行、诊断与报告,确保可追溯性与结果准确性。
期权策略回测框架,支持Black-Scholes定价、Greeks分析及多腿组合回测,适用于加密货币和股票期权。
用于ML训练实验追踪、指标可视化及告警的工具,支持Python API记录数据与触发诊断告警,CLI查询指标并同步至HF Space。
- «
- 1
- »


