输入关键词搜索 AI 工具、分类,或直接跳转页面
GLIGEN是一款开放式的条件式图像生成学术项目站点,核心为基于扩散模型的可控图像生成技术。用户可结合文本描述与空间边界框、参考图像等条件,生成符合指定布局与内容要求的图像;模型采用模块化训练设计,保留预训练扩散模型的基础生成能力的同时,扩展了空间控制属性。该站点面向AI图像生成研究者、计算机视觉从业者、内容创作人员、设计人员等群体,可用于学术研究验证、可控图像内容创作、多模态模型效果测试、概念设计初稿生成等场景,帮助用户在图像生成过程中实现更精准的内容与布局控制。
进入GLIGEN官方站点,找到在线演示功能入口,浏览页面内的功能说明与生成示例,了解模型支持的控制条件与生成效果范围。
选择合适的生成模式,可选择基础文本生成模式或者带布局控制的生成模式,根据自身需求确定本次生成需要使用的约束条件。
输入对应的生成条件,若使用布局控制则绘制边界框并为每个框填写元素描述,同时可补充整体图像的风格、场景等全局文本描述。
确认所有条件设置无误后,点击生成按钮等待模型推理,推理过程中请勿关闭或刷新页面,避免生成过程中断。
生成完成后查看结果图像,若不符合预期可调整文本描述、边界框位置或参数后重新生成,满意后可下载图像到本地使用。
看完教程,直接上手试试
访问 GLIGEN 官网