输入关键词搜索 AI 工具、分类,或直接跳转页面
FoleyCrafter是上海人工智能实验室与香港中文大学(深圳)联合研发的视频拟音生成框架,核心定位是为视频内容生成语义匹配、时间同步的高质量音效。核心功能包括基于文本引导的音效生成、视频帧自动对齐音效时间轴、多风格音效自由切换、批量视频音效处理、生成音效可直接导出使用。目标用户覆盖视频创作者、影视后期从业者、动画制作人员、自媒体运营者、短视频创作者、高校传媒专业师生等。使用场景包括短视频后期拟音补全、动画作品音效创作、影视素材音效替换、科普视频音效制作、自制短片音效设计等,无需专业拟音设备即可完成音效与视频的匹配工作。
打开FoleyCrafter官方网站,在首页找到视频上传入口,点击上传本地需要添加音效的视频文件,支持MP4、MOV等常见视频格式,单个文件大小建议不超过2GB,时长不超过30分钟。
在文本输入框中填写你需要的音效描述,比如“森林里的鸟叫和风声”“玻璃杯碰撞的清脆声音”,也可选择预设的音效场景标签,减少文本输入的操作。
根据视频的整体风格,在风格选择栏中选择适配的音效风格,比如写实、卡通、科幻、复古等选项,也可自定义调整音效的响度、混响等基础参数。
点击生成按钮,等待框架完成视频识别和音效生成,生成时长根据视频长度有所不同,通常1分钟视频的生成时间在30秒到1分钟之间,页面会显示实时进度。
生成完成后在线预览音视频同步效果,若有不满意的段落可局部调整重新生成,确认效果后选择单独导出音频或者导出嵌入音效的完整视频文件到本地即可。
看完教程,直接上手试试
访问 FoleyCrafter 官网