输入关键词搜索 AI 工具、分类,或直接跳转页面

Genie 3是DeepMind开发的交互式AI世界模型平台,核心功能围绕文本生成交互式3D物理环境展开,支持用户在生成的环境中进行自由交互,还可调整环境参数、导出生成结果。该平台面向AI研究人员、游戏开发者、3D内容创作者、虚拟现实开发者等用户,可用于快速原型开发AI驱动的虚拟环境、测试交互式3D内容方案、构建沉浸式训练场景,为交互式3D内容开发提供新的生成路径。

huanngzh.github.io
MV-Adapter是面向多视图图像与3D生成场景的技术方案官网,核心为基于适配器架构的预训练文本到图像模型增强方案。核心功能包括参数高效的预训练模型适配能力,可在不修改原有T2I模型结构的前提下注入3D知识;统一条件编码器支持相机参数、几何信息的无缝整合;兼容Stable Diffusion XL等主流生成模型,可实现768分辨率的多视图内容生成。目标用户覆盖计算机视觉研究人员、AIGC技术开发者、3D内容制作从业者、数字内容创作团队等,可用于学术研究中的3D生成算法迭代、工业场景下的多视图素材批量生产、数字孪生项目的纹理映射制作等场景,无需重新训练完整大模型即可快速构建多视图生成能力。
snowpixel.app
Snowpixel是聚焦多模态AIGC创作的在线平台,核心支持文字生成图片、视频、音乐、3D对象等数字内容,还提供自定义模型训练能力,满足不同创作者的个性化产出需求。平台内置像素艺术专项模型,可针对性生成复古像素风格内容,同时支持音视频跨模态生成,适配多元创作场景。目标用户覆盖独立创作者、设计从业者、游戏开发人员、新媒体运营者等,可用于原创内容制作、项目原型产出、个性化素材生成、风格化艺术创作等多种场景。

3dtopia.github.io
3DTopia-XL是基于扩散变换器(DiT)架构开发的3D资产生成工具,采用自研的PrimX 3D表示方法,可实现从文本或图像输入到3D PBR资产的快速生成。核心功能包括文本转3D资产、图像转3D资产、PBR材质自动生成,主要面向3D建模从业人员、游戏开发人员、动画制作团队、元宇宙内容创作者等群体,适用于游戏场景搭建、动画素材制作、产品原型3D展示、元宇宙场景内容填充等多种场景,生成的资产可直接接入常规图形工作流使用,无需复杂的二次调整。

drexubery.github.io
ViewCrafter是基于视频扩散模型与点云3D表示的创新视角合成工具,核心定位为面向3D内容创作、空间可视化领域的单/稀疏图像多视角生成平台。其核心功能包括单图场景高保真新视角生成、稀疏视图3D范围迭代扩展、3D-GS格式输出适配实时渲染,主要面向3D建模师、游戏场景设计师、数字孪生开发者、内容创作者等群体,可应用于快速生成场景多视角素材、辅助3D资产重建、沉浸式内容前置预览等多个场景,无需复杂的多视图采集设备即可完成常规视角下的场景扩展生成。

trellis3d.github.io
TRELLIS是一款基于统一结构化潜在表示与修正流变换器架构的原生3D生成模型服务平台,核心面向3D内容创作相关从业者与研究人员,提供多条件驱动的3D资产生成、多格式导出、局部编辑等功能。用户可通过文本描述或参考图像快速生成符合需求的3D模型,支持游戏开发、元宇宙场景搭建、工业设计原型制作、影视内容创作等多个场景的3D内容生产需求,降低3D资产制作的技术门槛,缩短创作周期。

omages.github.io
Omages是专注于3D模型生成技术研发与演示的开源技术站点,核心是将3D形状封装为64x64像素的Object Images格式,简化3D内容的生成与处理流程。站点支持Omages格式的3D模型预览、Diffusion Transformers生成3D形状的效果演示、传统3D网格与Omages格式的在线转换,面向计算机视觉研究者、3D内容创作者、图形学开发人员,可用于3D生成模型开发、轻量3D内容存储、3DAI模型训练数据预处理等场景,帮助用户降低3D形状处理的技术门槛。

gen-x-d.github.io
GenXD是一个专注于3D与4D场景生成的开源研究框架,核心面向计算机视觉领域的研究者、开发人员及相关方向学生,旨在解决当前4D生成领域数据稀缺、运动与相机参数耦合的行业问题。核心功能包含专业4D数据策划流程,可从普通视频中提取相机姿态与物体运动强度参数;自研CamVid-30K大规模现实世界4D场景数据集,覆盖多类真实场景样本;多视图-时间模块,可实现相机与物体运动参数的分离学习,兼容3D与4D两类数据训练。目标用户覆盖高校计算机视觉实验室研究员、3D内容开发工程师、元宇宙场景搭建人员、AI生成算法开发者、数字孪生项目从业者、图形学相关专业学生等。使用场景包括学术研究中4D生成算法的基准测试、元宇宙项目中动态场景的批量生成、数字孪生项目的真实场景复刻、3D内容创作中的多视图一致素材生成等。

stability.ai
Stable Zero123是Stability AI推出的视图条件3D生成模型官方介绍页面,核心定位为面向研究与非商业场景的3D生成技术落地载体。核心功能包括技术原理详解、开源获取路径指引、训练效率对比呈现,目标用户覆盖3D内容创作者、AI研究人员、计算机视觉领域开发者、文创行业从业者,可用于单视图生成多视角3D对象、学术研究技术复现、文创项目3D素材快速生成等场景,帮助用户降低3D内容生产的技术门槛,提升3D生成模型的训练与落地效率。

junlinhan.github.io
Flex3D是由Meta支持的研究团队开发的3D内容生成工具,核心定位是通过两阶段流程实现从单张图片或文本提示到3D资产的自动化生成。核心功能包括单图3D重建、文本驱动3D生成、多格式3D资产导出,适配3D重建领域的技术落地需求。目标用户覆盖计算机视觉研究者、3D内容创作者、游戏开发人员、元宇宙内容制作者等群体,可用于快速生成产品3D模型原型、游戏场景素材、元宇宙虚拟物品、学术研究对照样本等场景,帮助用户降低3D内容制作的技术门槛。
chenguolin.github.io
DiffSplat是面向3D内容创作领域的技术展示与资源平台,核心展示基于扩散模型与3D高斯溅射结合的3D生成技术,支持从文本提示、单视图图像生成符合3D空间一致性的高斯点云模型。平台提供完整的技术论文、生成效果演示、代码部署指引与训练数据集参考,核心功能包含3D生成效果交互预览、技术原理可视化解析、开源代码对接说明、生成参数调整演示、多场景效果样例展示。目标用户覆盖计算机视觉研究人员、3D内容开发工程师、游戏建模从业者、动画制作人员、XR内容创作者等,可用于学术研究中的3D生成技术实验、小型3D资产快速原型制作、元宇宙场景批量3D元素生成、游戏道具快速初稿建模、动画场景辅助素材制作等多种场景。

pku-yuangroup.github.io
Repaint123是由北京大学前沿计算研究中心团队开发的3D内容生成工具,核心定位是通过单张输入图像快速生成多视角一致的3D内容。核心功能包括单图驱动的多视角一致性图像生成、自适应可视性感知重绘、快速3D模型导出。目标用户覆盖3D创作从业者、游戏建模人员、动画制作师、科研人员以及3D内容爱好者,可应用于游戏资产制作、虚拟场景搭建、3D打印原型设计、数字藏品创作等多个场景,无需复杂的多视角图像采集流程,即可完成基础3D内容的快速生成。

me.kiui.moe
LGM是专注于3D模型生成的技术框架站点,核心定位是为用户提供从文本提示或单视图图像生成高分辨率3D模型的技术能力。其核心功能包括多视图高斯特征3D表示、非对称U-Net多视图处理、高分辨率3D内容快速生成。目标用户覆盖3D内容创作者、游戏开发人员、AI研究人员、工业设计从业者等群体,可应用于游戏资源制作、元宇宙场景搭建、产品原型3D建模、学术研究实验等多个场景,帮助用户降低3D模型创作的技术门槛,提升生成效率与输出质量。

ml.cs.tsinghua.edu.cn
CRM是由清华大学团队研发的单图像转3D纹理网格生成模型,核心定位为面向3D内容创作的AI生成工具。其核心功能包括单图生成六视图图像、高分辨率三平面构建、端到端纹理网格输出三类,支持用户仅上传一张普通二维图像,即可快速得到可直接用于后续创作的3D资源。该工具面向3D建模师、游戏开发人员、动画创作者、学术研究人员等群体,可应用于游戏资产制作、数字孪生模型搭建、文创产品设计、3D内容原型快速验证等场景,无需复杂的多视角拍摄或手动建模操作,降低了3D内容的生成门槛。

justimyhxu.github.io
GRM是面向3D内容创作领域的大规模重建与生成模型项目站点,核心提供稀疏视图图像到3D资产的快速转换能力,支持基于Transformer架构的多视图信息融合,可对接多视图扩散模型实现文本到3D、图像到3D的生成任务。站点面向3D建模从业者、计算机视觉研究人员、元宇宙内容开发者、游戏制作人员、数字孪生技术人员、动画创作者等群体,可应用于小规模3D资产快速重建、学术研究算法效果比对、3D内容批量生成测试、多模态3D生成场景落地验证等多个场景,为3D内容生产的效率提升提供技术方案参考与效果演示。
infinitescript.com
GaussianCity是由南洋理工大学S-Lab团队开发的3D城市场景生成框架,基于3D高斯绘制技术打造,核心定位是解决大规模3D城市生成中的内存与计算效率问题。框架内置紧凑3D场景表示模块,可降低城市场景存储占用;搭载空间感知高斯属性解码器,能够实现单步前向传递生成无边界3D城市;配套完整开源代码与预训练模型,支持用户快速自定义场景开发。面向计算机视觉研究人员、3D内容开发者、自动驾驶仿真工程师等群体,可应用于城市规划可视化、自动驾驶训练场景搭建、元宇宙城市内容创作、游戏开放世界构建等多个场景。

interactive-3d.github.io
Interactive3D是一个支持交互式操作的3D生成模型服务平台,核心定位是为用户提供可干预的3D内容生成能力,满足定制化3D模型创作需求。平台支持生成过程全阶段干预调整,可基于用户引导修改3D模型细节,适配不同精度的3D表示输出。主要面向3D设计从业者、游戏开发人员、科研人员、艺术创作者等群体,可应用于数字资产制作、游戏场景搭建、工业原型设计、艺术作品创作等多种场景,帮助用户在生成过程中调整模型走向,产出符合特定需求的3D内容。