Agent Skills › xberg-io/xberg

xberg-io/xberg

GitHub

规范 Alef 自动生成的绑定代码管理流程,涵盖 alef.toml 配置、生成与验证任务执行及核心侧编辑注意事项。

40 skills 9,341

Install All Skills

npx skills add xberg-io/xberg --all -g -y
More Options

List skills in collection

npx skills add xberg-io/xberg --list

Skills in Collection (40)

规范 Alef 自动生成的绑定代码管理流程,涵盖 alef.toml 配置、生成与验证任务执行及核心侧编辑注意事项。
修改 Rust 源码或 alef.toml 需要重新生成或验证绑定文件 编辑 packages/* 或 binding crates
.ai-rulez/skills/alef-generated-bindings/SKILL.md
npx skills add xberg-io/xberg --skill alef-generated-bindings -g -y
负责运行、诊断和优化基准测试工作流,包括提取基准、质量评分及工件契约。强调使用独立源验证真实性,区分基础设施与提取故障,确保A/B测试条件一致,并提供调试指南以保障数据准确性。
需要运行或解释基准测试结果时 诊断基准测试失败或质量评分异常时 修改基准测试配置或工件契约时
.ai-rulez/skills/benchmark-workflow/SKILL.md
npx skills add xberg-io/xberg --skill benchmark-workflow -g -y
文档描述文本分块与嵌入生成模块,涵盖RAG管道集成、多种分块策略及ONNX静态嵌入模型配置。
询问关于文本分块(Chunking)的配置或实现细节 询问关于嵌入向量(Embeddings)的模型选择或集成方式 需要理解RAG流程中的数据预处理逻辑
.ai-rulez/skills/chunking-embeddings/SKILL.md
npx skills add xberg-io/xberg --skill chunking-embeddings -g -y
解析Xberg配置加载机制,涵盖CLI与服务端优先级、文件自动发现及JSON合并规则。用于添加配置项、调整优先级或排查配置未生效问题。
添加新的配置标志或环境变量 修改配置加载优先级逻辑 调试配置设置未生效的原因
.ai-rulez/skills/config-loading-precedence/SKILL.md
npx skills add xberg-io/xberg --skill config-loading-precedence -g -y
描述 Xberg Rust 工作区结构,包括核心库、CLI、多语言绑定及排除项。用于导航代码库、确定代码归属及添加新 crate 时的配置指引。
需要了解项目模块划分 决定代码应放入哪个 crate 添加新的 workspace member 查找特定语言绑定的位置
.ai-rulez/skills/crate-structure/SKILL.md
npx skills add xberg-io/xberg --skill crate-structure -g -y
描述文档提取管道的架构与模式,涵盖格式检测、路由、提取及后处理流程。用于指导核心提取编排、缓存语义、降级策略及并发配置的变更与诊断。
修改提取管道编排逻辑 诊断文件提取失败或性能问题 调整缓存或降级策略
.ai-rulez/skills/extraction-pipeline-patterns/SKILL.md
npx skills add xberg-io/xberg --skill extraction-pipeline-patterns -g -y
定义xberg crate的Cargo特性标志策略,管理WASM/Android等平台的兼容性、ORT依赖隔离及纯Rust替代方案。
添加或配置Cargo特性 调试跨平台编译问题 分析特定目标平台的构建限制
.ai-rulez/skills/feature-flag-policy/SKILL.md
npx skills add xberg-io/xberg --skill feature-flag-policy -g -y
解析MIME类型检测与路由机制,涵盖FORMATS注册表、路径/字节检测函数及提取器优先级选择。用于添加新格式、配置提取器或调试文件路由错误问题。
添加新的文件格式支持 排查文件路由到错误提取器的问题 配置提取器与MIME类型的映射关系
.ai-rulez/skills/mime-detection-routing/SKILL.md
npx skills add xberg-io/xberg --skill mime-detection-routing -g -y
规范 OCR 流水线与质量评估,涵盖后端执行、配置缓存及质量校验。修正了关于缓存键包含构建身份的错误描述,确保 A/B 测试和结果准确性。
OCR 后端集成或替换 OCR 缓存策略调整 OCR 质量指标校准
.ai-rulez/skills/ocr-pipeline-and-quality/SKILL.md
npx skills add xberg-io/xberg --skill ocr-pipeline-and-quality -g -y
指导PDF引擎后端(Native/Pdfium)的选择、配置及能力差异处理。涵盖OCR回退、渲染会话优化及加密文档诊断,明确后端切换时的行为约束与错误处理规范。
PDF文本或结构提取 Pdfium后端配置与加载问题 PDF渲染性能优化 OCR回退机制调试
.ai-rulez/skills/pdf-backends/SKILL.md
npx skills add xberg-io/xberg --skill pdf-backends -g -y
指导设计、实现和诊断Xberg插件系统,涵盖插件类型、注册机制、优先级管理及生命周期处理。
需要开发或调试插件功能 解决插件冲突或注册问题
.ai-rulez/skills/plugin-architecture-patterns/SKILL.md
npx skills add xberg-io/xberg --skill plugin-architecture-patterns -g -y
定义多仓库协作边界,明确各组件职责与API归属。指导跨仓库修复的依赖协调、发布顺序及兼容性策略,确保独立CI与治理规范。
涉及多个 sibling repositories 的代码修改 需要协调跨仓库 API 变更或依赖版本升级
.ai-rulez/skills/polyrepo-boundaries/SKILL.md
npx skills add xberg-io/xberg --skill polyrepo-boundaries -g -y
用于发布前准备检查,通过审计CI、基准测试、生成物新鲜度及Changelog等状态,确保提交符合发布标准。
执行发布前准备审核 协调CI与发布流程
.ai-rulez/skills/release-readiness/SKILL.md
npx skills add xberg-io/xberg --skill release-readiness -g -y
管理 xberg 版本同步与发布流程。以 Cargo.toml 为唯一真相源,通过 task version:sync 自动将版本号同步至 alef 绑定的绑定清单及 integrations 下的集成包、Helm Chart 等,确保核心与依赖严格锁定并一致发布。
需要提升或设置项目版本号时 执行版本同步以更新所有依赖包和集成模块的版本号时 检查版本一致性以防止漂移时 添加新的集成包到版本管理体系时
.ai-rulez/skills/release-versioning/SKILL.md
npx skills add xberg-io/xberg --skill release-versioning -g -y
指导如何管理测试语料库,包括从GCS拉取二进制文件、使用read_test_fixture处理缺失依赖及避免构建失败,并说明git worktree陷阱与发布流程。
运行Rust测试前初始化环境 诊断缺失fixture导致的测试失败 设置A/B控制组或排查CI问题
.ai-rulez/skills/test-corpus/SKILL.md
npx skills add xberg-io/xberg --skill test-corpus -g -y
定义 WASM 构建约束,规范同步 API、无 Tokio 运行时及大小优化策略,指导提取器开发与构建配置。
构建 WASM 目标 添加或修改 WASM 兼容提取器 调试 WASM 构建或运行时失败
.ai-rulez/skills/wasm-constraints/SKILL.md
npx skills add xberg-io/xberg --skill wasm-constraints -g -y
规范 Xberg TypeScript/JS 仓库的开发流程,涵盖 lint、测试及构建工具使用。明确 pnpm 工作区依赖管理、多语言绑定构建边界及配置校验规则,确保代码质量与一致性。
修改 TypeScript 或 JavaScript 包代码 调整构建、测试或依赖配置 处理 pnpm 工作区依赖关系
.ai-rulez/skills/xberg-typescript-toolchain/SKILL.md
npx skills add xberg-io/xberg --skill xberg-typescript-toolchain -g -y
支持批量提取文件,具备共享配置、并发控制、单文件覆盖及错误恢复功能。适用于多文档一次性处理场景。
需要同时处理多个文件的提取任务 要求对批量操作进行并发限制或资源管控 需要对不同文件应用不同的提取配置
plugin/.ai-rulez/skills/batch-extraction/SKILL.md
npx skills add xberg-io/xberg --skill batch-extraction -g -y
用于将提取的文本切分为适合LLM上下文窗口或RAG ingest的块。支持字符/Token大小、重叠配置及Markdown/YAML/Semantic等多种分块策略,提供内联和独立命令两种模式。
需要将长文档切分为小块以输入LLM 为向量数据库准备数据分块 使用特定策略(如语义、Markdown)进行文本分割
plugin/.ai-rulez/skills/chunking/SKILL.md
npx skills add xberg-io/xberg --skill chunking -g -y
提供文档关键词提取(YAKE/RAKE)、语言检测和向量嵌入生成的技能,涵盖CLI配置、算法参数及特征门控说明,支持RAG和搜索场景。
从文档中提取关键词 检测文档语言 生成用于RAG或搜索的嵌入向量
plugin/.ai-rulez/skills/extracting-keywords/SKILL.md
npx skills add xberg-io/xberg --skill extracting-keywords -g -y
用于从PDF、电子表格或图像中提取结构化表格数据。支持布局感知检测、多种表格模型选择及Markdown/JSON输出格式,适用于财务报表、发票等场景。
从PDF文档中提取表格数据 解析电子表格文件内容 从图片中识别并提取表格
plugin/.ai-rulez/skills/extracting-tables/SKILL.md
npx skills add xberg-io/xberg --skill extracting-tables -g -y
提供基于Xberg CLI的OCR文本提取能力,支持扫描PDF、图片等无文本层文档。涵盖Tesseract、PaddleOCR及VLM后端选择,语言包配置及强制OCR参数,解决乱码或空内容问题。
从扫描件或照片中提取文本 PDF无文本层或内容乱码需强制OCR 需要多语言OCR支持
plugin/.ai-rulez/skills/extracting-with-ocr/SKILL.md
npx skills add xberg-io/xberg --skill extracting-with-ocr -g -y
提供文档提取输出格式选择指南,根据消费者类型(LLM、RAG、解析器等)推荐CLI参数组合,优化下游处理流程。
选择文档提取的输出格式 配置CLI参数以适配下游消费者
plugin/.ai-rulez/skills/picking-a-format/SKILL.md
npx skills add xberg-io/xberg --skill picking-a-format -g -y
提供Xberg文档智能库的多语言集成指南,支持从107种格式提取文本、表格及元数据。涵盖安装、OCR配置、批量处理及插件开发,适用于各类代码场景。
需要从PDF或Office等文档中提取内容 需要实现文档OCR功能 需要批量处理文件并提取结构化数据
plugin/.ai-rulez/skills/xberg/SKILL.md
npx skills add xberg-io/xberg --skill xberg -g -y
用于批量提取多个文件内容,支持共享配置、并发控制、单文件覆盖及错误恢复。适用于一次性处理目录或通配符匹配的大量文档场景。
需要同时从多个文件中提取内容 对大批量文档进行并行处理
plugin/.cursor-plugin/skills/batch-extraction/SKILL.md
npx skills add xberg-io/xberg --skill batch-extraction -g -y
用于将提取的文本分割为适合LLM上下文窗口或RAG摄入的块。支持字符/Token大小、重叠设置及多种分块策略(文本、Markdown、YAML、语义)。
需要将长文档分割为小块以适配LLM上下文窗口 准备数据用于向量数据库或RAG系统 使用chunk命令对已有文本进行预处理
plugin/.cursor-plugin/skills/chunking/SKILL.md
npx skills add xberg-io/xberg --skill chunking -g -y
提供文档关键词提取(YAKE/RAKE)、语言检测及向量嵌入生成能力,支持CLI配置与代码集成,用于RAG和搜索场景的数据预处理。
从文档中提取关键词 检测文档语言 生成文本向量嵌入
plugin/.cursor-plugin/skills/extracting-keywords/SKILL.md
npx skills add xberg-io/xberg --skill extracting-keywords -g -y
从PDF、电子表格或图像中提取结构化表格数据。支持布局感知检测、多种表格模型选择及Markdown/JSON输出格式,适用于财务报表、发票等场景。
需要从PDF文档中提取表格 需要解析电子表格数据 需要从图片中识别表格结构
plugin/.cursor-plugin/skills/extracting-tables/SKILL.md
npx skills add xberg-io/xberg --skill extracting-tables -g -y
提供从扫描PDF、图片中提取文本的OCR能力,支持Tesseract、PaddleOCR及VLM后端,涵盖语言包配置与性能调优。
从扫描件或无文本层PDF提取文字 处理图像中的文本识别 解决PDF复制乱码问题
plugin/.cursor-plugin/skills/extracting-with-ocr/SKILL.md
npx skills add xberg-io/xberg --skill extracting-with-ocr -g -y
指导根据下游消费者(如LLM、RAG索引器或人类)选择正确的输出格式组合,平衡结构保留与Token消耗。
选择文档提取后的输出格式 为LLM或RAG系统配置数据管道
plugin/.cursor-plugin/skills/picking-a-format/SKILL.md
npx skills add xberg-io/xberg --skill picking-a-format -g -y
提供Xberg文档提取库的多语言开发指南,涵盖文本、表格及元数据提取,支持OCR与批量处理。用于指导集成该库的代码编写。
需要解析PDF或Office文档内容 实现文档OCR识别功能 批量处理多格式文件提取
plugin/.cursor-plugin/skills/xberg/SKILL.md
npx skills add xberg-io/xberg --skill xberg -g -y
用于批量并行提取多文件内容,支持共享配置、并发控制、单文件覆盖及容错。
需要同时处理多个文件的提取任务 要求对批量操作进行并发限制或错误恢复
plugin/skills/batch-extraction/SKILL.md
npx skills add xberg-io/xberg --skill batch-extraction -g -y
用于将提取的文本分割为适合LLM上下文窗口或RAG ingest的分块。支持字符/令牌大小、重叠、多种分块器及独立命令。
需要将长文档切分为片段以适配LLM上下文窗口 为向量数据库准备数据以进行RAG检索增强生成
plugin/skills/chunking/SKILL.md
npx skills add xberg-io/xberg --skill chunking -g -y
提供文档关键词提取(YAKE/RAKE)、语言检测和向量嵌入生成能力,支持CLI配置与多算法选择,用于RAG和搜索场景的数据预处理。
从文档中提取关键词 检测文档语言 生成向量嵌入
plugin/skills/extracting-keywords/SKILL.md
npx skills add xberg-io/xberg --skill extracting-keywords -g -y
从PDF、电子表格或图像中提取结构化表格数据,支持布局感知检测与多种输出格式。
需要从非结构化文档(如PDF、图片)中提取表格数据 需要将财务、发票等表格转换为Markdown或JSON格式
plugin/skills/extracting-tables/SKILL.md
npx skills add xberg-io/xberg --skill extracting-tables -g -y
提供基于Xberg工具的OCR文本提取能力,支持扫描PDF、图片等无文本层文档。涵盖Tesseract、PaddleOCR及VLM后端配置,语言包管理及强制OCR触发场景,用于解决文档内容无法直接复制的问题。
从扫描件或照片中提取文本 PDF缺少文本层或内容乱码时 需要统一混合文档的提取格式
plugin/skills/extracting-with-ocr/SKILL.md
npx skills add xberg-io/xberg --skill extracting-with-ocr -g -y
指导如何选择文档提取工具的输出格式(CLI与内容格式),基于消费者类型(LLM、RAG、解析器等)提供决策树和参数配置示例,以简化下游处理。
选择文档提取输出格式 配置 CLI 格式参数 为 LLM 或 RAG 准备数据格式
plugin/skills/picking-a-format/SKILL.md
npx skills add xberg-io/xberg --skill picking-a-format -g -y
Xberg文档智能提取技能,支持107种格式的文件文本、表格、元数据及图片提取。涵盖多语言安装、OCR配置、批量处理、异步调用及插件开发,适用于构建文档解析功能。
需要解析PDF、Office或图像文件内容 实现文档OCR识别与结构化提取 批量处理大量文档并获取元数据 集成Xberg SDK进行代码开发
plugin/skills/xberg/SKILL.md
npx skills add xberg-io/xberg --skill xberg -g -y
提供基于Axum的REST API服务及MCP协议集成,支持文档提取、异步任务处理、缓存管理及健康检查。
需要调用或实现文档提取相关的REST API接口 需要配置或调试MCP协议的HTTP传输服务
.ai-rulez/skills/api-server-mcp/SKILL.md
npx skills add xberg-io/xberg --skill api-server-mcp -g -y
定义多格式文档(Office、PDF、归档、结构化文本、邮件)的提取工作流,涵盖解析、OCR、元数据提取及安全预算控制逻辑。
需要解析或提取特定格式文档内容 配置文档提取器的安全限制与后端引擎
.ai-rulez/skills/format-specific-extraction/SKILL.md
npx skills add xberg-io/xberg --skill format-specific-extraction -g -y

inicio - Wiki
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-10-03 01:00
浙ICP备14020137号-1