输入关键词搜索 AI 工具、分类,或直接跳转页面
LEO是基于大型语言模型开发的多模态多任务具身智能代理项目官网,核心定位为面向3D环境交互的通用AI研究成果展示平台。平台支持3D视觉语言对齐技术演示、3D具身任务效果展示、相关训练数据集信息查询三类核心功能,主要面向AI研究人员、机器人开发从业者、高校计算机相关专业师生三类用户,可用于3D具身智能技术调研、多模态AI模型性能参考、机器人任务规划方案设计等场景。项目公开了两阶段训练框架的技术细节,以及在3D字幕生成、3D场景问答、具身导航、机器人操作等多个任务中的实验结果,为相关领域的技术研发提供参考依据。
访问官网首页后,先浏览顶部的核心介绍区域,了解LEO项目的基本定位、核心能力与主要应用方向,对项目形成整体认知。
点击技术框架板块,查看两阶段训练架构的详细说明,配合原理图理解3D视觉语言对齐、指令微调的具体实现逻辑。
进入任务演示板块,选择感兴趣的3D具身任务分类,查看输入示例与模型输出结果,直观了解模型在不同场景下的表现。
若需要相关资源,可跳转至数据集、论文、代码对应板块,按照页面指引获取数据集申请方式、论文下载链接或开源代码仓库地址。
若有技术相关疑问,可查看页面底部的团队联系方式,通过提供的邮箱渠道与项目研发团队取得联系,咨询相关问题。
看完教程,直接上手试试
访问 LEO 官网