输入关键词搜索 AI 工具、分类,或直接跳转页面
Make-An-Audio 2是由浙江大学、字节跳动、香港中文大学联合研发的文本到音频生成技术官方展示站点,核心定位为面向学术研究与创意开发群体的音频生成技术演示平台。核心功能包括文本语义解析转音频、变长音频生成、音频时间一致性优化、音频生成效果对比展示。目标用户覆盖音频领域研究人员、AI技术开发者、内容创作从业者、高校计算机相关专业师生。使用场景包括学术研究中的技术效果验证、内容创作前期的音效小样生成、AI音频技术开发的算法参考、高校相关课程的技术案例演示。
访问Make-An-Audio 2官方站点,在首页导航栏选择演示功能入口,进入文本到音频生成的操作界面,提前准备好需要生成音频的描述文本。
在文本输入框中输入清晰明确的音频描述内容,可包含场景、声音元素、时长、节奏等信息,尽量避免模糊的语义描述。
根据自身需求选择生成音频的大致时长范围,确认输入信息无误后,点击页面上的生成按钮,等待系统完成音频生成流程。
生成完成后可点击播放按钮试听生成的音频内容,确认音频是否符合自身的描述需求,若不符合可调整文本内容后重新生成。
若对生成结果满意,可点击下载按钮将音频保存到本地,也可选择查看同类型模型的生成对比结果,或前往技术文档板块查阅相关研发资料。
看完教程,直接上手试试
访问 Make-An-Audio 2 官网