将任意文本或数据源自动转化为高质量MP4视频。通过分类内容类型,规划分镜与视觉策略,利用TTS、3D场景、图像生成及ffmpeg组装,完成从脚本到成片的全流程生产与质量检查。
提供文本转语音(TTS)及自定义音效生成能力,支持为视频添加、替换或同步旁白,并处理多提供商的语音选择与配置。
用于通过mdbox平台生成和处理多媒体内容,包括图像、视频、音频及OCR文字识别。支持文生图/视频/音频、图生图/视频、抠图、放大及文档文字提取,并规范了文件存储路径与URL交付格式。
将指定网站URL转化为HyperFrames专业视频,涵盖捕获、设计、脚本、分镜、配音及构建等7步工作流,适用于社交媒体广告或产品展示。
用于Seedance 2.0音频生成与处理,涵盖对话、口型同步、音效、音乐及节拍同步。指导用户加载参考文档,遵循核心规则优化提示词,解决音画不同步问题,确保音频支持视觉节奏。
在Orca环境中控制iOS模拟器,支持触控、手势、输入及权限管理等操作。提供CLI解析与版本匹配指南,确保Agent能安全、准确地驱动模拟器流,优于直接使用simctl。
利用 EdgeSpeak 转录与词级对齐生成 ASS 卡拉字幕,支持双语、样式预览及 FFmpeg 硬字幕烧录。
将单一主题自动转换为Vox风格的拼贴解说视频。通过Atlas Cloud API生成图像与视频,结合本地ffmpeg处理音频、字幕和合成,支持多种输入模态及叙事结构。
用于根据中文文章生成多风格配图(怪诞手绘/暖调绘本等)及自定义IP录入。支持路由分流,优先处理IP创建流程,再执行配图任务,确保角色一致性与视觉质量。
从穿搭或模特照片中提取独立衣物,生成透明背景目录图及保留身份的模特展示图,并将审核通过的商品导入本地Wardrobe项目的JSON数据库。


