输入关键词搜索 AI 工具、分类,或直接跳转页面

boheumd.github.io
MA-LMM是面向长期视频理解场景的大规模多模态模型项目官网,核心定位为突破大语言模型上下文与GPU内存限制,实现长时序视频的高效分析处理。核心功能包括在线流式视频处理、跨时长记忆库调度、现有多模态大模型无缝适配三类,支持用户在长视频问答、智能字幕生成、视频内容检索等任务中调用相关能力。目标用户覆盖计算机视觉研究人员、视频平台技术开发人员、AI应用开发者等群体,可满足学术实验验证、工业级视频分析功能落地、多模态应用功能迭代等多场景使用需求。