输入关键词搜索 AI 工具、分类,或直接跳转页面

francis-rings.github.io
StableAnimator是一款专注于人像动画生成的开源视频扩散框架站点,核心定位为端到端身份保留的视频合成工具。核心功能包括参考图驱动的人像动画生成、姿势序列条件控制、无后处理高质量视频输出。目标用户覆盖AI动画创作者、数字内容制作者、影视后期从业者、科研人员等群体,可应用于短视频人像动效制作、虚拟角色动作迁移、数字人内容生成、动画角色原型测试等多种场景,无需依赖第三方工具即可完成从静态人像到动态视频的转换。

drexubery.github.io
ViewCrafter是基于视频扩散模型与点云3D表示的创新视角合成工具,核心定位为面向3D内容创作、空间可视化领域的单/稀疏图像多视角生成平台。其核心功能包括单图场景高保真新视角生成、稀疏视图3D范围迭代扩展、3D-GS格式输出适配实时渲染,主要面向3D建模师、游戏场景设计师、数字孪生开发者、内容创作者等群体,可应用于快速生成场景多视角素材、辅助3D资产重建、沉浸式内容前置预览等多个场景,无需复杂的多视图采集设备即可完成常规视角下的场景扩展生成。

chenshuo20.github.io
DimensionX是基于视频扩散模型的科研类场景生成工具,核心定位是实现从单张图像到3D、4D场景的自动化生成。它支持用户上传单张图片生成多视角一致的三维场景,可根据文本提示词调整场景动态效果,生成的内容可直接导出兼容主流3D建模软件的格式。该工具面向计算机视觉研究人员、3D内容创作者、游戏开发人员等群体,可用于学术研究中的场景重建实验、动画前期的场景快速搭建、元宇宙内容的原型制作等场景。

video-prediction-policy.github.io
Video Prediction Policy(简称VPP)是专注于机器人视觉预测策略研究的学术展示平台,核心展示基于视频扩散模型的机器人操控技术方案。平台提供完整的VPP技术原理讲解、实验基准测试数据、预训练模型开源资源,以及相关论文成果和数据集获取渠道。目标用户覆盖机器人学研究者、计算机视觉方向科研人员、机器人开发工程师、人工智能领域高校师生、具身智能项目研发团队、工业自动化方案设计人员。可用于机器人操控算法性能对比参考、具身智能视觉预测模块开发、相关学术研究的实验基线搭建、视频扩散模型跨领域应用探索等场景。

johannakarras.github.io
Fashion-VDM是聚焦于视频虚拟试穿场景的视频扩散模型工具,核心定位是实现高还原度的动态虚拟试穿效果生成。其核心功能包括:支持单张衣物图片与人物动作视频双输入,输出人物穿着目标衣物的连贯试穿视频;生成过程保留人物原有身份特征与动作轨迹,同时还原衣物纹理、褶皱等细节;采用渐进式训练策略,可生成最高64帧、分辨率512px的稳定试穿视频。目标用户覆盖服装电商从业者、虚拟内容创作者、服饰研发人员、计算机视觉研究者等群体,可应用于商品展示视频制作、虚拟穿搭内容创作、服装设计效果验证、相关领域技术研发等多种场景,为动态虚拟试穿需求提供技术解决方案。
aejion.github.io
AccVideo是专注于视频扩散模型推理加速的技术工具站点,核心定位是为视频生成领域提供高效的蒸馏加速方案。其核心功能包括视频扩散模型推理速度提升、合成蒸馏数据集生成、预训练模型去噪轨迹优化、多场景适配调优。该站点面向视频生成相关的研究人员、算法开发者、内容生产从业者,可应用于视频生成效率优化、学术研究验证、工业级视频生产流水线搭建等场景,在保持生成视频质量的前提下,可实现最高8.5倍的推理速度提升,降低视频生成的时间与算力成本。