输入关键词搜索 AI 工具、分类,或直接跳转页面

opentalker.github.io
VideoReTalking是基于深度学习的说话人面部视频编辑系统,核心定位是实现音频与视频的唇形精准同步,同时支持面部表情统一调整与画面质量增强。核心功能包含面部表情标准化处理、音频驱动的唇形同步生成、身份感知的面部画质增强三类,目标用户覆盖视频创作者、新媒体运营人员、影视后期从业者、数字内容开发者等群体,可应用于口播视频二次配音、多语言译制视频口型匹配、虚拟数字人内容生成、老旧人物访谈视频修复等多个场景,无需复杂人工操作即可完成视频面部内容的自动化调整。

seevido.com
See Video AI是依托字节跳动Seedance 2.0模型打造的AI视频生成平台,支持用户通过文本、图像、现有视频、音频等多模态输入生成符合需求的视频内容。平台核心功能包括文字转视频、参考图生成视频、音频驱动视频生成、视频风格转换以及视频续写等,面向内容创作者、自媒体运营人员、短视频博主、营销策划人员、教育内容制作者和影视创意从业者,可用于短视频内容创作、营销广告视频制作、创意概念视频输出、课程演示视频生成等多个场景,降低视频创作的技术门槛,提升内容生产效率。

seedance2-ai.net
Seedance 2.0是一款支持多模态输入的AI视频生成工具,核心定位是降低视频创作的技术门槛,为不同创作需求的用户提供自动化视频生成服务。核心功能包括文本生成视频、图像生成视频、音频驱动视频生成,还支持视频风格转换和多镜头内容拼接。目标用户覆盖内容创作者、营销从业者、教育工作者、设计人员等群体,可应用于短视频内容制作、产品宣传视频生成、教学课件可视化、创意概念短片输出等多种场景,用户无需专业的视频剪辑基础,即可通过简单操作生成符合需求的视频内容。

fudan-generative-vision.github.io
Hallo2是复旦大学生成视觉团队研发的人像图像动画技术演示站点,核心基于优化后的潜在扩散生成模型,可实现音频驱动的静态人像动效生成。核心功能包括音频驱动长时人像视频生成、4K分辨率视频输出、文本提示辅助表情控制三类,面向AI视频创作者、数字内容制作从业者、高校相关领域研究人员开放,可应用于虚拟数字人内容制作、老照片人像动态化还原、短视频个性化动效创作、学术技术效果验证等多个场景。

infinitetalk.net
InfiniteTalk AI是一款依托AI技术提供音频驱动全身视频配音与生成服务的在线工具平台,核心功能包含单张照片生成全身对话视频、音频驱动唇形与肢体动作同步、多语言音色配音支持、自定义背景场景设置、批量视频生成处理等,面向内容创作者、自媒体运营人员、教育工作者、企业营销人员、独立开发者以及语言学习用户,可用于短视频内容创作、线上课程录制、产品营销推广、数字人直播素材制作、多语言内容本地化等场景。

omnihuman-lab.github.io
OmniHuman-1 是专注于多模态条件人类视频生成的开源技术框架,核心定位是为内容创作与数字人开发领域提供可落地的视频生成技术支持。核心功能包括单张人像驱动视频生成、多模态运动信号输入适配、任意宽高比图像兼容三大模块,目标用户覆盖数字内容创作者、虚拟人开发者、影视后期从业者、AI技术研究人员等群体,可应用于虚拟主播内容制作、影视素材补全、数字人内容批量生产、AI 生成技术研发测试等多个场景,帮助用户降低真人拍摄成本,提升视频内容生产效率。