输入关键词搜索 AI 工具、分类,或直接跳转页面

huanngzh.github.io
MV-Adapter是面向多视图图像与3D生成场景的技术方案官网,核心为基于适配器架构的预训练文本到图像模型增强方案。核心功能包括参数高效的预训练模型适配能力,可在不修改原有T2I模型结构的前提下注入3D知识;统一条件编码器支持相机参数、几何信息的无缝整合;兼容Stable Diffusion XL等主流生成模型,可实现768分辨率的多视图内容生成。目标用户覆盖计算机视觉研究人员、AIGC技术开发者、3D内容制作从业者、数字内容创作团队等,可用于学术研究中的3D生成算法迭代、工业场景下的多视图素材批量生产、数字孪生项目的纹理映射制作等场景,无需重新训练完整大模型即可快速构建多视图生成能力。

hithqd.github.io
DynamicControl是专注于提升文本到图像扩散模型生成控制力的开源技术框架,核心定位是解决多控制信号组合下图像生成一致性不足的问题。其核心功能包括双循环控制器初始条件排序、多模态大语言模型条件评估优化、并行多控制适配器特征整合三大模块,支持用户灵活组合不同类型、数量的控制条件,实现更符合预期的图像生成效果。该框架面向AI图像生成领域的研究人员、算法工程师、AIGC应用开发者,可应用于可控图像生成算法研究、专业AI绘图工具开发、定制化图像生成系统搭建等场景,帮助使用者降低多条件控制下的图像生成偏差,提升生成结果与输入需求的匹配度。
g-u-n.github.io
PCM网站是Phased Consistency Model生成模型的官方演示与技术展示平台,核心定位为面向AI生成领域研究者、开发者的技术方案展示与体验站点。平台核心功能包括不同迭代步数下的PCM生成效果对比、与Stable Diffusion系列基础模型的适配效果展示、高分辨率文生图结果样例呈现。目标用户覆盖AI生成算法研究者、AIGC应用开发者、计算机专业学生、数字内容创作者。使用场景包含算法选型参考、生成模型效果验证、学术研究对比、技术学习参考等,帮助用户直观了解PCM在文本条件高分辨率生成任务中的性能表现。

hidiffusion.github.io
HiDiffusion是面向扩散模型优化的技术方案网站,核心定位为低侵入式的扩散模型性能增强工具,无需改动原有模型结构即可实现高分辨率图像生成能力提升。核心功能包含单代码接入分辨率增强模块、MSW-MSA窗口注意力优化、4096×4096超分生成支持三大类,目标用户覆盖AI图像生成开发者、AIGC项目研发人员、计算机视觉研究学者等群体,可应用于商业设计素材高分辨率输出、学术研究中扩散模型性能优化、AI绘画平台生成效果迭代等多个场景。

oft.wyliu.com
Orthogonal Finetuning (OFT)是专注于文本到图像扩散模型微调技术的学术展示与工具网站,核心定位是为AI生成领域的研究者、开发者提供正交微调技术的原理说明、效果演示与落地参考。网站核心功能包括OFT技术原理的可视化讲解、主体驱动生成与可控生成两类任务的效果对比、不同微调方法的性能指标公开。目标用户覆盖AI生成模型研究者、深度学习算法工程师、AIGC应用开发者、高校计算机相关专业师生等,可用于学术研究参考、模型优化方案选型、AIGC应用落地技术评估等场景。

hyper-sd.github.io
Hyper-SD是聚焦于低步数高效图像合成的开源技术框架官方站点,核心面向AI图像生成领域的开发者、研究人员及应用开发者提供技术支持。站点核心功能包含完整的技术论文说明、开源代码仓库入口、不同步数推理效果的样例展示,同时提供模型部署的实操教程。目标用户覆盖AI计算机视觉领域研究人员、AIGC应用开发工程师、图像生成工具开发者等群体,可用于快速图像生成API开发、端侧AI图像生成功能落地、图像生成效率优化研究等场景。

yongshengyu.com
PromptFix是聚焦于扩散模型指令驱动图像处理的技术框架站点,核心定位为提升扩散模型图像编辑与修复类任务的指令遵循准确度。平台具备指令数据集构建参考、高频引导采样算法配置、辅助提示适配器参数调试三大核心功能,主要面向AI图像算法研发人员、计算机视觉方向研究者、AIGC应用开发从业者,可应用于图像盲恢复、多指令组合图像处理、零样本图像任务适配等场景,帮助开发者降低扩散模型多任务适配的研发成本,提升图像处理任务的输出匹配度。

shihaozhaozsh.github.io
LaVi-Bridge是面向文本到图像扩散模型研发的桥接模型工具站点,核心作用是打通不同预训练语言模型与生成视觉模型的适配链路。站点提供模型适配配置生成、兼容组件适配测试、生成效果对比评估三大核心功能,无需修改原语言、视觉模型的基础权重即可完成适配。目标用户覆盖AI生成领域研究人员、多模态模型开发工程师、AIGC应用开发者、高校计算机相关专业师生等群体,可用于多模态生成系统搭建、预训练模型跨架构适配实验、文本到图像生成效果优化等场景,为多模态生成链路的灵活拼接提供技术支撑。