提供基于Python的数据分析能力,支持CSV/JSON处理、统计计算及数据可视化。适用于用户请求数据处理、统计分析或图表生成等场景。
利用MinerU将复杂PDF转换为LLM友好的Markdown或JSON格式,支持提取文本、表格及公式。适用于学术论文解析、RAG数据准备及批量处理,提供多种后端模式以平衡速度与精度。
将 Claude Code 等编程代理的对话历史导出至 Hugging Face。涵盖安装配置、本地导出、PII 隐私审计及发布流程,确保数据合规上传。
用于在简单搜索不足时探索知识图谱,通过多阶段流程(语义入口、扩展、实体发现、关系遍历)进行跨项目调查和实体中心查询,最终合成关联图景。
从会议记录中提取结构化事实,更新知识库中的人物画像、时间日志和索引。支持单次或批量导入,具备去重、置信度过滤及干跑预览功能,确保数据准确性与可追溯性。
指导在本地通过 ONNX Runtime 构建和配置离线嵌入模型,支持自定义模型选择与参数设置,无需 API Key,适用于对隐私有严格要求或无网络环境的场景。
用于为视觉语言模型训练生成图像-字幕对及结构化场景图。通过构建3D场景图并调用NVIDIA NIM LLM,输出简要、全局或问答式描述,支持独立运行或集成至SDG流程。
用于加载CSV/Excel/JSON数据,执行清洗、统计分析与可视化,并生成图表及Markdown报告。适用于数据集分析、趋势发现及报表制作场景。
提供 HyperspaceDB MCP 服务器配置与使用指南,支持在 Claude Desktop、Cursor 等 AI 宿主中集成数据库平面和认知记忆平面的工具,涵盖集合管理、向量 CRUD、语义搜索及图遍历等功能。
将原始CRM导出CSV清洗为区域销售摘要,执行去重、按区域汇总金额并输出结构化JSON。适用于需要清理销售数据或生成周报的场景。
为ML/AI实验提供严格的数据分析服务,包括统计验证、图表生成及证据审查。专注于产出分析报告与附录,而非论文写作或最终报告汇总,确保数据严谨性与可复现性。
提供学术论文复现的系统方法论,涵盖从数据探索、变量映射构建、样本筛选到统计分析的全流程。指导用户通过对比论文结果验证复现准确性,并输出详细报告。
基于 Whisper 的语音转文字工具,支持会议录音、播客等音频文件的文本提取及可选的 LLM 后处理。


