输入关键词搜索 AI 工具、分类,或直接跳转页面
zerobench.github.io
ZeroBench是聚焦多模态大模型视觉理解能力的专业基准测试平台,核心定位为多模态模型研发领域的评估工具。平台搭载经学术团队严格校验的高难度测试数据集,支持完整的模型性能分层评估,同时提供推理过程拆解分析功能。目标用户覆盖人工智能领域研究人员、多模态模型开发团队、高校计算机相关专业师生,可应用于模型迭代效果验证、学术论文实验支撑、多模态技术路线对比等场景,帮助使用者清晰识别不同模型在复杂视觉理解任务上的能力差异。

artificialanalysis.ai
Artificial Analysis是专注于AI语言模型与API服务商的独立分析平台,核心定位为中立的AI模型选型参考工具。平台可提供多维度模型性能测评、跨服务商参数对比、实时价格测算功能,面向AI开发人员、企业技术选型负责人、AI产品经理、学术研究人员等群体,适用于AI应用开发前的模型选型、AI服务采购前的成本评估、AI技术趋势调研等多个场景,帮助用户在众多AI模型和API服务商中筛选适配自身需求的选项,降低选型试错成本。