输入关键词搜索 AI 工具、分类,或直接跳转页面

x.ai
Grok-1.5是x.ai推出的大型语言模型产品介绍站点,核心为对外披露该模型的技术特性、能力表现与迭代进展。站点提供128k长上下文处理能力的详细说明、数学与编码领域的基准测试数据、分布式训练框架的技术原理三大核心内容,面向AI技术从业者、模型研发人员、企业技术选型人员以及相关领域研究者,可用于了解模型技术参数、评估模型适配场景、参考技术实现路径、跟进大模型技术迭代方向等场景。

llmtest.io
LLMTest是由独立开发者打造的大语言模型调用管理与优化工具,核心定位是为开发者群体提供一站式大模型调用管控、成本追踪、性能评测与提示词优化服务。核心功能包括多平台大模型API代理转发,支持统一接入OpenAI、Anthropic等主流大模型服务;多维度模型基准测试,覆盖340+款大语言模型的响应速度、输出质量、调用成本对比;基于真实流量的提示词自动优化,可根据历史调用数据迭代提示词效果。目标用户覆盖独立开发者、小型创业团队、大模型应用开发者、产品测试人员等,适用于大模型应用开发阶段的模型选型、上线后的成本管控、日常运营中的提示词效果调优等多种场景,帮助用户降低大模型使用成本,提升应用输出质量。

mammoth-vl.github.io
MAmmoTH-VL是面向多模态推理领域的学术研究与应用支撑平台,核心面向多模态大模型研发人员、数学教育相关从业者、AI研究学者等群体。平台搭载基于指令调优优化的多模态大语言模型,可支撑多模态数学题解析、跨模态推理任务评测、推理过程可解释性分析三类核心需求。用户可通过平台体验模型对图文结合数学题的解答过程,也可获取开源数据集用于相关模型训练,还能借助基准测试结果对比不同多模态模型的推理能力,适合学术研究、教育工具开发、多模态模型迭代等场景使用。