输入关键词搜索 AI 工具、分类,或直接跳转页面
GLEE是一个面向图像与视频处理场景的通用对象基础模型服务平台,核心定位是为各类对象感知任务提供统一的技术支持。平台可实现多模态输入的对象定位与识别功能,支持零样本迁移适配不同任务场景,还具备多数据源联合训练的通用对象表示能力。目标用户覆盖计算机视觉领域的科研人员、AI应用开发工程师、内容生产行业的视频处理从业者、安防领域的智能分析从业者等,可应用于视频内容结构化标注、图像对象检测、多场景智能识别、零样本任务迁移等多种场景。
访问GLEE官方网站https://glee-vision.github.io,在首页了解模型的核心能力与支持的任务类型,确认平台能力匹配自身需求后进入功能模块。
根据自身任务需求,选择对应的功能入口,可选择图像识别、视频处理、零样本迁移等不同的任务类型,进入对应操作页面。
按照页面提示上传待处理的图像或视频文件,若为零样本迁移任务则同时上传目标对象的参考样本或填写类别描述信息,确认输入内容无误。
提交处理请求后等待模型运算,处理过程中可查看任务进度,处理完成后可在页面预览对象定位与识别的结果,支持下载结构化的结果数据。
若需要将模型能力集成到自有系统,可进入接口文档页面,查看API调用规范,按照文档说明完成接口对接与参数配置,实现批量任务处理。
看完教程,直接上手试试
访问 GLEE 官网