输入关键词搜索 AI 工具、分类,或直接跳转页面
SpeechGPT 2.0-preview是复旦大学自然语言处理实验室开发的语音交互模型预览站点,核心定位是为开发者、研究人员及内容创作者提供前沿的语音与大语言模型融合能力。站点支持中文语音交互,可实现多风格语音生成、工具调用联动、外部知识库接入三类核心功能,面向AI语音应用开发者、语音交互研究人员、有声内容创作者、教育产品开发者、智能硬件方案商等群体,适用于智能语音助手开发、有声读物内容制作、多模态对话系统研究、教育语音交互模块搭建等场景,帮助用户快速验证语音大模型的落地可能性。
打开站点https://open-moss.com/en/speechgpt2-preview,在首页查看平台功能说明和使用规则,确认当前仅支持中文语音交互,明确使用边界。
选择交互模式,若需文本转语音则切换到生成模式,输入目标文本后选择对应的情感、角色、风格参数;若需对话则切换到对话模式。
触发交互操作,生成模式点击生成按钮等待语音输出,对话模式点击语音输入按钮,清晰表述中文需求后结束输入。
查看交互结果,生成的语音可直接在线播放,也可下载到本地保存,对话回复会同步显示文字内容,可核对信息准确性。
体验扩展功能,若需要调用工具、搜索或知识库能力,可在对话中明确提出相关需求,模型会自动触发对应能力,完成后反馈结果。
看完教程,直接上手试试
访问 SpeechGPT 2.0-preview 官网