输入关键词搜索 AI 工具、分类,或直接跳转页面
OpenVoiceChat是基于Apache-2.0许可的开源语音对话平台,核心定位是成为封闭商业语音AI产品的开源替代方案,支持用户通过自然语音与各类大型语言模型实现实时交互。平台支持接入Whisper等多种语音识别模型、ElevenLabs等多类文本转语音模型,以及GPT系列、 Llama系列等主流大语言模型,支持自定义模型参数配置。目标用户包含AI开发人员、语音交互产品爱好者、个人学习者、小团队开发者、教育技术从业者等,可用于快速搭建语音AI对话系统、开发语音交互原型、语音AI相关学习实践、离线语音交互方案部署等场景。
访问OpenVoiceChat官方网站,若需在线试用可直接点击首页的“开始对话”按钮,若需本地部署可点击“开源下载”获取对应操作系统的安装包或源代码。
进入配置界面,依次选择需要使用的语音识别模型、文本转语音模型和大语言模型,根据提示填入对应API密钥或本地模型的存储路径,完成基础配置。
调整交互参数,根据自身需求设置语音识别的目标语言、TTS的音色与语速、大模型的回复温度和上下文记忆长度,配置完成后可保存为专属方案。
点击麦克风按钮开启语音输入,说出你想要询问的内容,说完后点击停止按钮,平台会自动完成语音转写、AI回复生成和语音输出,也可开启连续对话模式。
对话结束后,可在历史记录板块查看所有对话内容,支持搜索、导出或删除对应记录,若需要更换模型可随时返回配置界面进行调整。
看完教程,直接上手试试
访问 OpenVoiceChat 官网