输入关键词搜索 AI 工具、分类,或直接跳转页面
OmniHuman-1 是专注于多模态条件人类视频生成的开源技术框架,核心定位是为内容创作与数字人开发领域提供可落地的视频生成技术支持。核心功能包括单张人像驱动视频生成、多模态运动信号输入适配、任意宽高比图像兼容三大模块,目标用户覆盖数字内容创作者、虚拟人开发者、影视后期从业者、AI技术研究人员等群体,可应用于虚拟主播内容制作、影视素材补全、数字人内容批量生产、AI 生成技术研发测试等多个场景,帮助用户降低真人拍摄成本,提升视频内容生产效率。
访问 OmniHuman-1 官方网站,在首页导航栏找到「文档」板块,查看本地部署的硬件与软件环境要求,提前配置好Python、PyTorch等依赖库。
在「下载」页面获取最新的预训练模型文件与项目源代码包,按照文档指引完成本地环境的安装与模型权重加载。
准备输入素材,包括1张清晰的人像参考图像,以及对应的运动信号素材,可以是音频文件、运动参考视频或者二者的组合。
在运行界面上传准备好的人像图像与运动信号,选择输出视频的分辨率、帧率等参数,确认后启动生成任务等待处理完成。
生成结束后预览输出视频效果,若符合需求即可导出保存;若需要调整,可更换运动信号或调整参数后重新生成。
看完教程,直接上手试试
访问 OmniHuman-1 官网