输入关键词搜索 AI 工具、分类,或直接跳转页面

nepvox.com
Nepvox AI是一个集成语音处理与图像生成的综合性AI创作平台,核心提供文本转语音、语音转文本、文本转图像三类AI生成服务,同时开放API接口支持二次开发,面向内容创作者、开发者、自媒体从业者等群体,可满足播客节目配音、自媒体内容脚本整理、营销素材生成、产品功能集成、有声书制作等多种使用场景,兼顾在线工具快速使用与开发者集成需求,结合稳定的生成效果与透明的定价体系,为不同需求的用户提供AI生成服务。

applio.org
Applio是一个聚焦AI语音克隆领域的开源生态系统,核心定位是为开发者与AI语音技术爱好者提供低门槛的语音模型训练、推理与应用落地工具。核心功能包括支持多语种语音数据集预处理、自定义音色模型训练、实时语音转换推理;目标用户覆盖AI技术开发者、内容创作者、配音从业者、学术研究人员等群体,可应用于有声读物制作、虚拟角色配音、语音数据扩增、多语种语音内容本地化等多种场景,所有核心代码开源开放,支持用户根据需求自主定制功能。
fun-audio-llm.github.io
FunAudioLLM是面向语音交互开发场景的开源技术框架,核心目标是优化人类与大语言模型的自然语音交互体验。框架内置SenseVoice多模态语音理解模型与CosyVoice语音生成模型,支持多语种语音识别、情绪识别、音频事件检测、可控语音合成等能力,相关代码与模型权重已开源开放。适合AI应用开发者、语音交互产品研发人员、学术研究人员使用,可应用于智能客服系统搭建、有声内容制作、多语种语音助手开发、语音类AI产品原型验证等多种场景,帮助降低语音交互相关功能的开发门槛。