加载中...
输入关键词搜索 AI 工具、分类,或直接跳转页面
flageval.baai.ac.cn
FlagEval是北京智源人工智能研究院推出的AI模型评测平台,核心定位是为大语言模型、多模态模型提供统一标准的评测服务。平台支持多维度模型性能对比、专项领域定制化评测、评测报告自动生成三大核心功能,面向AI研究者、算法工程师、行业产品经理等群体,可应用于模型研发迭代、选型采购、学术研究性能验证等场景,助力AI技术落地与行业生态建设。