输入关键词搜索 AI 工具、分类,或直接跳转页面
lastexam.ai
Humanity's Last Exam 是面向大型语言模型学术能力评估的多模态基准测试平台,由全球多领域专家联合开发。核心功能包括覆盖100余个学科的标准化试题库、支持多模态模型的统一测试流程、自动化生成详细学术能力评估报告。目标用户覆盖AI模型研发团队、高校人工智能研究人员、AI行业评测机构、科技企业算法开发部门等,可用于大模型学术能力摸底测试、不同模型学术能力横向对比、模型迭代效果验证、AI学术评测相关研究等场景,为人工智能技术在学术领域的性能优化提供参考依据。