输入关键词搜索 AI 工具、分类,或直接跳转页面

huanngzh.github.io
MV-Adapter是面向多视图图像与3D生成场景的技术方案官网,核心为基于适配器架构的预训练文本到图像模型增强方案。核心功能包括参数高效的预训练模型适配能力,可在不修改原有T2I模型结构的前提下注入3D知识;统一条件编码器支持相机参数、几何信息的无缝整合;兼容Stable Diffusion XL等主流生成模型,可实现768分辨率的多视图内容生成。目标用户覆盖计算机视觉研究人员、AIGC技术开发者、3D内容制作从业者、数字内容创作团队等,可用于学术研究中的3D生成算法迭代、工业场景下的多视图素材批量生产、数字孪生项目的纹理映射制作等场景,无需重新训练完整大模型即可快速构建多视图生成能力。

gen-x-d.github.io
GenXD是一个专注于3D与4D场景生成的开源研究框架,核心面向计算机视觉领域的研究者、开发人员及相关方向学生,旨在解决当前4D生成领域数据稀缺、运动与相机参数耦合的行业问题。核心功能包含专业4D数据策划流程,可从普通视频中提取相机姿态与物体运动强度参数;自研CamVid-30K大规模现实世界4D场景数据集,覆盖多类真实场景样本;多视图-时间模块,可实现相机与物体运动参数的分离学习,兼容3D与4D两类数据训练。目标用户覆盖高校计算机视觉实验室研究员、3D内容开发工程师、元宇宙场景搭建人员、AI生成算法开发者、数字孪生项目从业者、图形学相关专业学生等。使用场景包括学术研究中4D生成算法的基准测试、元宇宙项目中动态场景的批量生成、数字孪生项目的真实场景复刻、3D内容创作中的多视图一致素材生成等。
costwen.github.io
Ouroboros3D是面向3D内容创作领域的统一3D生成开源框架,核心是将基于扩散的多视图图像生成与3D重建能力集成到递归扩散流程中,通过自条件机制实现两个模块的联合训练适配。其核心功能包括多视图图像递归生成、3D模型实时重建、几何一致性校验、推理过程可视化、自定义训练参数配置。目标用户覆盖3D算法研究人员、计算机图形学开发者、3D内容创作从业者、高校相关专业师生、AI生成内容技术爱好者。可应用于3D内容批量创作、数字孪生模型构建、游戏素材快速生成、学术研究算法验证、元宇宙场景搭建等多个场景,帮助用户降低3D内容生成的技术门槛,提升3D模型生成的几何稳定性。

chenhonghua.github.io
MVDrag3D是基于多视图生成与重建先验技术打造的拖拽式3D编辑框架,核心定位是降低3D内容编辑的操作门槛,实现更灵活的3D对象调整。核心功能包括多视图一致的拖拽式3D变形、3D高斯实时重建与优化、跨视图编辑效果一致性校验。目标用户覆盖3D建模从业者、计算机图形学研究人员、游戏内容开发者、工业设计人员、数字内容创作者等群体,可应用于3D模型局部调整、创意3D造型设计、多视图一致内容生成、3D重建后优化等多种场景,支持多种常见3D对象类别的编辑需求。