将输入图像生成为交互式全息卡片,通过分层处理(角色、背景、UI、结构)实现视差与轮廓发光效果。支持本地原生工具链或独立 API 模式,无需额外密钥。
为Three.js游戏生成、转换和集成音频资产,涵盖音效、环境音及语音合成。支持ElevenLabs API,提供从提示词生成到Web Audio运行时集成的完整工作流,包含清理与隔离功能。
将中文文稿或SRT转为可编辑手绘讲解视频,支持逐笔动画与程序动画两条路线。涵盖风格选择、配音字幕、渲染验收及环境配置,确保交付真实MP4与工程文件。
通过 zframes CLI 为用户构建、更新或启动个人市场仪表盘,支持加密货币与股票数据展示。根据指令自动路由至服务现有、修改配置或从零创建新仪表盘任务。
智能转换视频画幅,支持横竖互转及多种比例。提供模糊背景、焦点裁切和人脸居中三种策略,自动处理分辨率对齐与音轨保留,适配各平台尺寸需求。
用于启动 Moli CDP 服务端并连接 Playwright、Puppeteer 等客户端,支持无头浏览器调试、截图及页面诊断。提供安装、启动、连接及集成规范,确保通过 CDP 协议稳定交互。
口播视频制作技能,集成配音时间戳、Remotion渲染及108张动效配方。通过语义驱动画面与Apple视觉范式,实现从文案到电影感成片的自动化管线。
通过渲染临时Next.js路由并截图生成OG社交卡片,确保与实时Hero组件一致。支持更新文案、布局及截图,自动处理端口检测、Headless Chrome截图及图片优化,最后清理临时文件。
控制浏览器执行导航、点击、填表及截图验证等自动化操作。强调基于会话工具选择运行时,遵循观察-行动-验证流程,确保操作安全与状态同步,适用于前端页面交互测试与数据抓取。
将任意文本内容转化为高质量MP4视频。自动分类内容类型,规划分镜与视觉策略,生成旁白、场景资产及音效,并通过ffmpeg或HyperFrames渲染组装,最终进行质量审查输出成品。
提供本地音乐分析、节拍检测及音视频卡点剪辑规划功能。支持基于BPM、节奏和结构的视频剪切与图片放置,确保离线安全处理。
用于图像生成与编辑的专用技能,支持文生图、图生图及局部重绘。通过CLI调用gpt-image-2模型处理请求并返回结果。
端到端生成游戏角色逐帧动画视频。核心通过multi_modal2video结合极小占比首图与隐形红框提示词防爆框,支持纯文字启动自动生成定妆图。严格限制镜头、时长与特效范围,确保动作还原。
基于本地 Esse MCP 工具实现批量图像生成。自动打开工作台,遵循用户默认模型配置,按请求语言撰写提示词,支持引用历史图片,确保批次任务独立且可复用。


