输入关键词搜索 AI 工具、分类,或直接跳转页面

emova-ollm.github.io
EMOVA全称是EMotionally Omni-present Voice Assistant,是一款多模态语言模型工具网站,核心定位为实现端到端语音处理与高水准视觉-语言能力融合的多模态交互模型。核心功能包括语义-声学解耦的语音分词处理、情感丰富的多模态对话交互、跨视觉与语音模态的任务响应。目标用户覆盖AI模型研究者、多模态应用开发者、语音交互产品设计师、自然语言处理方向学生等群体,可用于多模态模型性能测试、智能语音对话系统开发、情感化交互产品原型搭建、跨模态任务算法验证等场景,帮助用户探索多模态大模型在语音、视觉、语义融合方向的落地可能性。

ziyang.tech
LSLM(Listening-while-Speaking Language Model)是主打边说边听能力的人工智能对话模型服务平台,核心定位是提升人机语音交互的自然度与实时性。平台支持全双工交互模式,用户在模型输出语音的过程中可随时打断调整,系统能够快速响应修改需求;采用三种信号融合策略适配不同交互场景,兼顾响应速度与内容准确性;搭配流式音频编码模块,支持低延迟实时语音输入处理。目标用户覆盖语音交互开发者、智能设备厂商、AI应用研发人员等,可应用于智能语音助手开发、实时对话系统搭建、多模态交互产品测试等多个场景。