输入关键词搜索 AI 工具、分类,或直接跳转页面
knightyxp.github.io
VideoGrain是基于扩散模型的视频编辑技术展示平台,核心定位是为内容创作者、技术研究者提供可交互的多粒度视频编辑技术演示与参考。平台支持文本驱动的指定区域视频编辑,可实现跨帧语义一致的内容修改,同时保留原有视频的运动逻辑与画面风格;支持不同编辑粒度的调节,用户可选择从局部物体替换到整体场景风格调整的不同编辑强度;还提供多组对比案例,直观呈现技术效果与传统编辑方法的差异。平台目标用户包括视频后期从业者、AI视频技术研究者、广告内容制作人员、高校计算机相关专业师生等,可用于影视后期片段修改、广告创意内容快速迭代、视频编辑技术研发参考、学术研究效果验证等场景。

akashsengupta1997.github.io
DiffHuman是一个面向3D人体重建领域的学术项目展示网站,核心呈现基于扩散模型的概率式光度逼真3D人体重建方案。该网站支持单张RGB图像输入的3D人体分布预测、多采样高细节人体模型生成、加速推理效果对比三大核心功能,主要服务于计算机视觉研究人员、3D内容开发者、动画制作从业者、数字人研发团队等群体,可应用于学术研究验证、动画角色快速建模、数字人素材生成、3D重建算法效果比对等多种场景,帮助用户直观了解非确定性3D人体重建技术的实现逻辑与实际应用效果。

igl-hkust.github.io
Diffusion as Shader(简称DaS)是香港科技大学等高校研究团队开发的3D感知视频生成控制模型工具站,核心定位是为视频创作与3D内容生产领域提供基于扩散模型的多任务控制解决方案。核心功能包括支持网格到视频生成,可将3D网格素材转化为写实或风格化的连续视频内容;支持相机路径自定义控制,生成符合指定镜头运动逻辑的动态视频;支持运动迁移与对象属性编辑,可在保留原有3D空间逻辑的前提下修改对象外观、动作参数。目标用户覆盖CG从业者、影视动画制作人员、VR内容开发者、AI生成技术研究人员、高校计算机相关专业学生等,适用于影视片段预演、VR场景内容生成、3D动画效果测试、AI视频生成学术研究等多个场景。

reconfusion.github.io
ReconFusion是面向3D视觉研究与应用领域的技术项目官网,核心展示结合神经辐射场(NeRFs)与扩散先验的少量视图3D重建方法,可在仅提供少量实景照片的前提下完成真实场景的三维结构与纹理还原。核心功能包括3D重建效果可视化演示、技术论文与数据集资源下载、相关实验评估结果公开,目标用户覆盖计算机视觉领域研究者、3D内容创作者、VR/AR场景开发人员等,可应用于小样本实景3D建模、虚拟场景内容生成、受限视角场景三维还原等多种场景。

nihalsid.github.io
MeshGPT是专注于3D三角网格生成的学术项目站点,核心基于自回归Transformer架构实现3D模型的自动化生成。站点提供项目核心原理说明、效果对比样例、开源代码获取入口与论文全文下载渠道,还展示了不同类别3D物体的生成效果实测数据。目标用户包括3D图形学研究人员、计算机视觉领域学者、3D内容开发从业者、相关专业高校学生,可用于3D生成算法研究验证、3D内容批量制作原型开发、相关领域课程学习参考等场景。

maskgct.github.io
MaskGCT是专注于零样本文本到语音转换的开源技术站点,核心是同名零样本TTS模型的成果展示与技术落地内容。站点提供完整的模型技术原理讲解、官方演示Demo体验、论文研究成果查阅、开源代码仓库跳转等核心功能,面向语音技术研发人员、AI应用开发者、语音内容创作从业者等群体,可用于模型技术调研、语音合成效果验证、相关项目开发参考等场景,帮助使用者快速了解零样本TTS领域的前沿技术路径与实际应用表现。