输入关键词搜索 AI 工具、分类,或直接跳转页面
M2UGen是结合大语言模型能力的多模态音乐理解与生成在线演示平台,核心定位是降低多模态音乐创作的技术门槛。平台支持音乐理解分析、文本生成音乐、图像生成音乐三类核心功能,面向音乐创作者、内容创作者、AI音乐研究者等群体,可用于原创音乐小样制作、短视频配乐生成、音乐技术研究验证等场景,用户无需复杂的本地环境配置,即可在线体验大语言模型与音乐生成技术结合的落地效果。
进入M2UGen演示平台首页,首先浏览页面顶部的功能说明和案例展示,了解平台支持的音乐理解、生成相关能力和使用规则。
若需要使用音乐理解功能,点击上传按钮选择本地音乐文件,等待模型解析完成后,可在对话框输入具体问题获取分析结果。
若需要文本生成音乐,在输入框中详细描述音乐的风格、情绪、乐器、时长等要求,确认信息无误后点击提交按钮等待生成。
若需要图像生成音乐,点击上传图片按钮选择本地图片,或者粘贴公开可访问的图片URL,提交后等待模型分析图像并生成对应音乐。
生成或分析完成后,可在线试听音乐、查看分析结果,符合需求的话点击下载按钮保存音频文件,需要调整的话补充需求提交修改即可。
看完教程,直接上手试试
访问 M2UGen 官网