输入关键词搜索 AI 工具、分类,或直接跳转页面

emova-ollm.github.io
EMOVA全称是EMotionally Omni-present Voice Assistant,是一款多模态语言模型工具网站,核心定位为实现端到端语音处理与高水准视觉-语言能力融合的多模态交互模型。核心功能包括语义-声学解耦的语音分词处理、情感丰富的多模态对话交互、跨视觉与语音模态的任务响应。目标用户覆盖AI模型研究者、多模态应用开发者、语音交互产品设计师、自然语言处理方向学生等群体,可用于多模态模型性能测试、智能语音对话系统开发、情感化交互产品原型搭建、跨模态任务算法验证等场景,帮助用户探索多模态大模型在语音、视觉、语义融合方向的落地可能性。

emu.baai.ac.cn
Emu3是北京智源人工智能研究院推出的多模态大模型官方介绍站点,核心定位为公开分享通用多模态大模型技术成果与应用方向。站点核心功能包括完整呈现Emu3模型的技术架构细节、展示模型在多模态生成与感知任务中的实测效果、同步模型落地应用的相关进展。目标用户覆盖人工智能领域研究者、AI应用开发者、高校计算机相关专业师生、科技行业从业者等群体,可用于查阅多模态大模型技术资料、了解前沿模型性能表现、参考多模态技术落地路径等场景。