输入关键词搜索 AI 工具、分类,或直接跳转页面
fun-audio-llm.github.io
FunAudioLLM是面向语音交互开发场景的开源技术框架,核心目标是优化人类与大语言模型的自然语音交互体验。框架内置SenseVoice多模态语音理解模型与CosyVoice语音生成模型,支持多语种语音识别、情绪识别、音频事件检测、可控语音合成等能力,相关代码与模型权重已开源开放。适合AI应用开发者、语音交互产品研发人员、学术研究人员使用,可应用于智能客服系统搭建、有声内容制作、多语种语音助手开发、语音类AI产品原型验证等多种场景,帮助降低语音交互相关功能的开发门槛。