输入关键词搜索 AI 工具、分类,或直接跳转页面

countless.dev
Countless.dev是专注于AI模型信息聚合与横向对比的服务平台,核心定位是为AI相关从业者提供中立的模型参数、性能、成本参考体系。平台支持多维度模型筛选对比功能,可展示各模型的输入输出上下文长度、定价标准、模态支持情况;内置模型实测效果展示模块,可查看不同模型在同一场景prompt下的返回结果差异;同时提供模型价格计算器,可根据调用量估算使用成本。目标用户覆盖AI应用开发者、大模型研究人员、企业AI技术选型负责人、AI产品经理、高校AI相关专业学生等,可应用于AI项目前期选型、模型成本评估、技术方案调研、学术研究参数对比等多个场景。

unify.ai
Unify AI是面向开发者的大语言模型统一接入与管理平台,核心定位是为多LLM调用场景提供一站式解决方案。平台支持通过一套API对接全球多家主流大模型服务商,提供实时性能基准测试、自定义路由规则设置、自动流量调度三大核心功能。目标用户覆盖AI应用开发工程师、AI产品负责人、大模型研究人员、企业技术团队等,可应用于AI应用多模型兼容开发、大模型选型评估、生产环境LLM流量负载优化、多模型效果对比测试等场景,帮助开发者降低多模型对接成本,提升调用效率。

rank.opencompass.org.cn
OpenCompass司南是由上海人工智能实验室联合多家机构发起的开源大语言模型评测平台,核心定位为提供中立、可复现的大模型能力评测服务。平台支持超100个主流基准数据集,覆盖知识推理、数学计算、代码生成、语言理解、多模态处理等二十余个能力维度,可满足不同场景下的模型性能核验需求。平台面向大模型研发团队、AI领域研究者、企业技术选型人员、高校相关专业学生等群体,可用于模型研发过程中的能力迭代验证、学术研究中的性能对比、企业落地场景下的模型选型参考等多个场景,同时所有评测流程与数据完全开源,支持用户自定义评测任务配置。

llmarena.ai
LLM Arena是专注于大语言模型第三方测评分析的工具平台,核心定位是为用户提供中立、可量化的大模型对比参考。平台支持盲测对比不同大模型的输出效果,可整理公开各主流大模型的定价明细,同时标注不同模型的接口参数、功能差异并生成结构化对比报告。面向AI开发者、产品经理、AI领域研究者、企业技术选型人员、AI创业从业者、高校相关专业师生等用户,可应用于大模型技术选型、输出效果验证、调用成本核算、参数适配调研、功能适配评估等场景,帮助用户直观了解不同大语言模型的实际表现差异,为技术选型和应用开发提供参考依据。