输入关键词搜索 AI 工具、分类,或直接跳转页面

hkchengrex.github.io
MMAudio是基于多模态联合训练技术的视频到音频合成工具站点,核心定位是为用户提供视频与文本输入驱动的同步音频生成服务。站点核心功能包括视频画面特征识别、文本语义音频匹配、音视频时序同步校准,能够适配不同场景下的音频创作需求。目标用户覆盖影视后期从业者、游戏开发人员、短视频创作者、AI技术研究者等群体,可在影视内容音频补全、游戏场景音效生成、短视频背景音制作、多模态技术研发测试等场景中使用,帮助用户提升音频合成的效率与成品质量。

typecast.ai
Typecast是一款AI语音生成平台,核心定位是为用户提供多风格虚拟人语音合成服务,支持文字转语音、情感化语音调整、虚拟主播形象联动等功能,满足音视频创作、内容分发、商业宣传等场景的音频制作需求。平台内置数百款不同音色、语种的虚拟语音角色,用户无需专业录音设备,输入文字即可生成接近真人发声的音频内容,适合内容创作者、企业营销人员、教育工作者、有声书制作者等群体使用,可有效降低音频制作的时间和人力成本。

cerebralai.studio
Cerebral AI是一款依托AI技术生成定制化音频内容的放松正念平台,核心围绕冥想放松需求,为用户提供个性化音频生成、场景适配混音、内容保存管理等功能。该平台支持用户根据自身状态和场景需求,调整生成音频的各类参数,获得符合个人偏好的放松音频内容,目标用户包括有日常放松需求的职场人群、正念冥想练习者、睡眠不佳人群等,可用于工作间隙放松、睡前助眠冥想、日常正念练习等多种场景。

google-research.github.io
AudioLM是Google Research推出的音频生成研究展示平台,核心定位是呈现基于语言建模思路的长时一致性音频生成技术能力。平台核心功能包括语音续篇生成演示、钢琴音乐续篇生成演示、不同生成参数效果对比展示。目标用户覆盖音频技术研究人员、AI生成领域开发者、内容创作从业者、语音技术爱好者等群体,可用于学术研究参考、音频创作灵感获取、生成效果评测对比、技术原理学习等场景,帮助用户直观理解无标注音频数据训练下的生成模型表现。