PDF格式转换与处理工具,支持转PPT/Word/Excel/图片、表单填写、去水印及批量表格提取。强调源文件验证、输出完整性检查及表格提取降级策略,适用于非扫描版PDF的高保真格式转换需求。
端到端生成游戏角色逐帧动画视频。核心通过multi_modal2video结合极小占比首图与隐形红框提示词防爆框,支持纯文字启动自动生成定妆图。严格限制镜头、时长与特效范围,确保动作还原。
基于 yt-dlp 下载 YouTube 视频、字幕及元数据,支持保守请求策略与稳定文件命名。用于为后续转录或说话人识别准备本地媒体素材,仅限授权内容。
基于本地 Esse MCP 工具实现批量图像生成。自动打开工作台,遵循用户默认模型配置,按请求语言撰写提示词,支持引用历史图片,确保批次任务独立且可复用。
将口播或插画转为沐阳风格扁平动画。通过三闸门协议:先确认动画方案,再生成并审核静帧,最后调用Gemini生成视频。支持自定义尺寸、音效及人物/内容模式,确保视觉直观与风格统一。
自动化生成Vox风格纸拼贴解释视频。通过Atlas Cloud API和ffmpeg,从主题自动生成脚本、拼贴关键帧、运动、配音、音乐及字幕,支持多种输入模态。
根据中文文本生成多风格配图,支持怪诞手绘、暖调绘本等。新增自定义IP录入流程,强制路由分流防止误触发生图,确保形象确认后再执行图像生成。
基于HTML/CSS和Chrome生成1410x600微信公众号封面PNG。通过脚本解析标题并渲染,严格校验尺寸、对比度及中文显示效果,确保无乱码裁切。适用于需确定性视觉输出且不调用AI图片模型的流水线场景。
paxm技能用于管理Agent主动记忆层,支持通过CLI或MCP模式进行上下文回忆、状态记录及配置诊断。适用于需回顾项目历史、偏好或决策的任务,增强Agent的长期记忆与短期工作记忆管理能力。
提供视频分析能力,支持通过yt-dlp下载、ffmpeg提取帧及Whisper/Gemini生成字幕或视觉报告,帮助Agent理解视频内容。
基于算法库的八字与紫微斗数排盘及综合分析工具。通过调用脚本精准生成命盘,结合LLM进行深度解读或生成可视化海报,支持独立分析与交叉印证。
将主题转化为完整的Remotion手绘解说视频,支持自动与引导模式。集成图像生成、TTS语音合成及字幕功能,默认中文旁白,涵盖从脚本编写到MP4渲染的全流程自动化工作流。


