Hyperresearch是一个基于Python的AI代理驱动研究知识库工具。它利用Claude Code执行深度研究,通过自适应流水线收集、搜索并综合网络信息,生成经过验证且带有完整来源引用的持久化报告,构建可搜索的研究档案。
Vox Director 是一个自动化视频生成工具,能将单一主题转化为 Vox 风格的纸拼贴解说/广告视频。它通过 Atlas Cloud API 和本地 ffmpeg 自动完成脚本、关键帧、配音及字幕等全流程,作为 Agent 技能供编程助手调用,输入主题即可输出 MP4 视频。
Toonflow-web是AI短剧工厂的前端Web项目,基于Vue 3、TypeScript和Vite构建。提供现代化用户界面,供开发者进行二次开发或定制。普通用户建议使用主仓库的完整客户端。
Qwen-Image-Layered是一款将图像分解为多个RGBA层的模型,实现固有可编辑性。各层可独立操作,支持缩放、位移和重着色等保真操作,便于高保真且一致的图像编辑。
MatteFormer是基于Transformer的图像抠图模型,利用先验Token和PAST块提升效果。提供SOTA性能评估及预训练模型,适用于Composition-1k等数据集。需Python 3.8、PyTorch 1.10.1及CUDA环境,支持从Deep Image Matting数据集准备数据并进行训练推理。
ViTMatte是一个基于预训练纯视觉Transformer的图像抠图工具,旨在提升抠图精度。它通过信息融合技术优化Alpha预测,支持Composition-1K等数据集SOTA性能。该仓库提供Python实现、Colab演示及教程,适用于需要高精度前景提取的研究与开发场景。
diffvg是一个用于2D矢量图形的可微光栅化器。它支持圆形、椭圆、矩形、多边形、曲线等图元的梯度计算,适用于基于梯度的图形编辑、图像合成及深度学习应用。该工具通过Python实现,结合PyTorch提供端到端的可微渲染能力。
这是一个基于Cloudflare Workers的简易大模型API反代工具,旨在解决中国大陆无法直连访问主流大模型API的问题。支持Gemini、OpenAI、Claude等服务,提供完全透传、可选的API密钥轮询及请求日志记录功能,部署简单且无需维护服务器。
GPROXY是基于Rust构建的多通道LLM代理网关,统一暴露OpenAI/Claude/Gemini等风格API。支持多提供商路由、协议转换、租户认证及用量审计,内置管理控制台。可部署为原生二进制、Docker容器或边缘函数,简化大模型集成与管理。
SGProxy是基于Cloudflare Workers和Rust构建的ClaudeCode凭证代理服务。支持OAuth导入、Token自动刷新、用量追踪及429状态切换,提供Header-only转发和内嵌Web管理后台,专为简化ClaudeCode单通道请求代理而设计。
TokenHub是一个企业级私有AI网关,支持基于角色的工作空间(用户、团队领导、管理员)。它提供统一的API接入、模型目录、路由策略及用量分析,兼容OpenAI接口,支持多语言,旨在帮助企业集中管理AI服务资源与权限。
该仓库提供基于Blender的渲染代码,用于生成doc3D数据集风格的文档图像。支持自定义网格、HDR光照和纹理,可批量渲染图像、UV坐标、法线及深度图,适用于文档去扭曲等计算机视觉任务的3D数据合成。
这是一个基于DocTr+模型的文档图像几何校正工具。主要用于矫正扭曲的文档图片,支持通过Python脚本运行推理。用户只需放置预训练模型和失真图像,即可生成校正后的结果,适用于文档数字化预处理场景。
RAFT是用于光流估计的深度学习模型,基于循环全对字段变换。支持在Sintel、KITTI等数据集上训练和评估,提供预训练模型及演示脚本,适用于计算机视觉任务中的运动场计算。
DocTrPP是PaddlePaddle实现的DocTr++模型,用于文档图像矫正(去扭曲)。支持数据准备、模型训练、推理测试及ONNX导出。需安装PaddlePaddle,通过Python脚本运行训练和预测,适用于需要高精度文档图像处理的场景。


