输入关键词搜索 AI 工具、分类,或直接跳转页面

uni-1ai.com
UNI-1 AI是一个将视觉推理与图像生成整合在单个Transformer架构中的AI模型服务站点,核心定位为提供统一架构下的图像理解与生成一体化服务。平台支持基于文本的图像内容推理、文本引导图像生成、图像修改编辑、视觉问答等多种核心功能,面向AI研究人员、创意设计从业者、内容创作者、产品开发人员以及AI爱好者提供服务。可应用于创意概念图产出、学术AI模型研究、商业内容视觉处理、个性化图像修改等多种场景,用户无需切换多个模型即可完成从图像理解到生成的全流程操作。

nihalsid.github.io
MeshGPT是专注于3D三角网格生成的学术项目站点,核心基于自回归Transformer架构实现3D模型的自动化生成。站点提供项目核心原理说明、效果对比样例、开源代码获取入口与论文全文下载渠道,还展示了不同类别3D物体的生成效果实测数据。目标用户包括3D图形学研究人员、计算机视觉领域学者、3D内容开发从业者、相关专业高校学生,可用于3D生成算法研究验证、3D内容批量制作原型开发、相关领域课程学习参考等场景。

hypergai.com
HPT是HyperGAI研究团队推出的多模态大型语言模型框架官方介绍站点,核心面向AI研发人员、模型训练从业者提供完整的技术架构说明、适配方案与落地参考。站点核心功能包括HPT框架技术原理详解、多模态训练流程演示、现有开源模型权重获取通道,同时提供不同场景下的模型适配案例参考。目标用户覆盖AI实验室研发人员、企业AI技术团队、高校人工智能方向研究者、独立AI开发者等群体,可用于多模态模型训练项目选型、行业多模态应用落地参考、学术研究中的模型架构对比等场景,帮助相关从业者快速了解HPT框架的能力边界与适配方法。

walt-video-diffusion.github.io
W.A.L.T是一个基于Transformer架构的实景视频生成技术展示与研究平台,核心聚焦于跨模态视频与图像生成技术落地。平台支持文本到视频生成、文本引导的图像到视频生成、图像插值三类核心功能,面向计算机视觉研究人员、AI内容创作者、视频制作从业者、高校相关专业师生等群体,可应用于学术研究验证、创意内容原型制作、视频片段补全、动态场景还原等多种场景,帮助用户直观了解前沿视频扩散模型的生成效果与技术特性。