输入关键词搜索 AI 工具、分类,或直接跳转页面

epochai.org
FrontierMath是专注于人工智能数学推理能力评估的基准测试平台,由60余位数学家联合打造,核心用于衡量大语言模型等AI系统解决前沿复杂数学问题的能力上限。平台覆盖代数几何、数论、拓扑学、Zermelo-Fraenkel集合论等现代数学全领域问题,所有测试题均为未公开发表的原创内容,可规避训练数据泄露导致的测试结果失真问题。其目标用户包括AI研发团队、数学研究人员、高校AI相关专业师生,适用于AI数学推理能力迭代测试、前沿数学问题研究辅助、AI大模型能力横向对比评估等场景。