输入关键词搜索 AI 工具、分类,或直接跳转页面

skyworkai.github.io
AgentStudio是面向通用虚拟助手研发的开源工具套件,核心定位是覆盖智能体从开发到评测的全生命周期需求。核心功能包括跨平台统一交互空间适配、智能体能力基准测试、多场景任务数据自动化收集,同时支持可视化操作界面降低使用门槛。目标用户覆盖AI领域研究人员、智能体开发团队、高校相关专业师生等群体,可应用于通用智能体研发、跨场景任务评测、学术研究数据生成、智能体迭代优化等多个场景,为通用虚拟助手的技术演进提供配套工具支撑。

dr.unifuncs.com
U深研是AI驱动的深度研究与信息核查智能工具,核心定位为面向研究类场景的信息处理辅助平台。核心功能包括万字级结构化研究报告生成、多源信息交叉验证、通俗化结论输出三类,可帮助用户在开展研究、撰写分析材料时减少基础信息整理工作量,提升内容可信度。目标用户覆盖科研人员、政策分析从业者、行业研究员、高校学生等群体,适用于课题调研、政策解读、行业分析报告撰写、信息真实性核验等多种场景。

zo.computer
Substrate是面向开发人员与AI研究人员的复合人工智能系统构建平台,核心定位是帮助用户简化复杂AI系统的组装与优化流程,通过模块化设计降低多组件AI系统的开发门槛。平台提供标准化组件优化工具与简洁抽象架构,支持用户根据需求整合不同AI模型与功能模块,快速完成定制化复合AI系统的开发。目标用户覆盖AI领域开发人员、学术研究人员、AI创业团队,适用于多模态AI应用开发、复合AI推理系统搭建、AI功能原型验证、AI研究项目迭代等多个使用场景。

hyperllm.org
HyperLLM是一个专注于小型语言模型开发与微调和训练的开放平台,核心定位是为语言模型研究者和开发者提供低成本的轻量型模型训练与微调服务。平台支持开发者快速完成小型语言模型的即时微调,支持自定义数据集导入,提供开源模型参数下载渠道,支持本地部署适配。该平台面向AI研究人员、NLP开发者、创业团队、学生研究者等用户,可用于快速原型验证、垂直领域模型定制、学术研究实验、小型项目部署等场景。

flockx.io
Flockx是一个聚焦AI代理协作互动的平台,核心定位是帮助不同类型的AI代理建立连接,完成多智能体协作任务。平台支持用户自定义配置AI代理连接规则,设置协作任务流程,还可以查看实时互动过程,方便用户调试多智能体协作逻辑。目标用户包括AI开发人员、AI研究人员、产品团队、自动化工作流设计者,可用于多AI任务分工测试、自动化协作流程搭建、AI代理互动研究等场景。

oppenheimer.app
OppenheimerGPT是一款面向macOS系统的桌面应用,核心定位是帮助用户同时调用Google Bard和ChatGPT两个大语言模型进行对比使用。该应用支持双模型并排展示界面,可同步输入相同问题获取两个模型的不同回答,也支持分别调整输入内容进行针对性测试。它适合AI研究人员、内容创作者、产品开发人员等需要对比不同大语言模型输出差异的用户,使用场景包括AI输出对比测试、跨模型内容创作参考、大模型能力差异研究等,可以帮助用户直观获取不同模型的回答特征,辅助完成内容创作或模型研究工作。

alle-ai.com
Alle-AI是一个一体化人工智能对比测试平台,核心定位为帮助用户完成不同生成式AI模型的横向对比测试与结果整合处理。平台支持同时调用多个主流大语言模型与图像生成模型,一次性获取多个模型的输出结果,方便用户直观对比不同模型的输出差异。用户可在此基础上对多个模型的输出内容进行结合编辑,生成符合自身需求的最终内容。核心功能包含多模型同步调用、结果对比展示、输出整合编辑、自定义模型配置等,面向AI研究者、内容创作者、产品开发人员、AI测评爱好者等群体,适用于模型效果测试、多维度内容生成、创意灵感搜集、AI工具选型等场景。

researchgoat.com
ResearchGoat是一个AI驱动的自动化定性研究与面试分析平台,核心定位是帮助研究人员、企业团队简化定性研究数据处理流程,提升分析效率。平台支持从访谈转录、主题编码到生成研究报告的全流程自动化处理,核心功能包含AI辅助主题分析、自动化转录与编码、协作研究管理、访谈方案生成、结果可视化输出。目标用户覆盖学术研究者、市场调研团队、人力资源从业者、用户体验设计师等需要处理定性数据的群体,适用于学术访谈研究、用户需求调研、招聘面试评估、焦点小组讨论分析等多种场景。

researchmonkey.ai
ResearchMonkey AI是一个整合了40余款AI工具的学术研究辅助平台,核心定位是为学术研究全流程提供AI支持,帮助用户缩短研究耗时。平台覆盖文献检索整理、论文写作辅助、数据初步分析、研究思路梳理、格式规范调整等多个研究环节,支持研究人员从选题到成稿的全流程操作。目标用户包括在校学生、科研机构研究人员、高校教师以及学术出版从业者,可应用于开题选题构思、文献综述撰写、实验数据整理、论文初稿生成、投稿格式调整等多种学术研究场景。

jackhopkins.github.io
Factorio学习环境(Factorio Learning Environment, FLE)是基于游戏《Factorio》构建的大语言模型能力评估框架,核心定位为AI研究领域的开放式智能体测试工具。核心功能包括支持结构化任务与开放式任务两类评估协议、可自定义难度梯度的任务配置、标准化的能力评估指标体系。目标用户覆盖AI研究人员、大语言模型开发团队、高校人工智能方向师生、智能体研发从业者、游戏AI爱好者、开源AI项目贡献者。使用场景包括LLM长期规划能力验证、程序合成效果测试、资源分配优化算法评估、智能体多步骤决策能力 benchmark 搭建、复杂开放式领域智能体训练数据集构建等,为大语言模型在复杂任务场景下的能力评估提供标准化测试载体。

webgames.convergence.ai
WebGames是convergence.ai推出的AI代理能力测试平台,核心定位是为网络浏览类通用AI代理提供标准化测试场景,验证其在网页交互场景下的任务完成能力。平台内置多组差异化网页挑战任务,对人类操作难度较低但对AI代理的逻辑推理、交互适配能力有较高要求,完成任务后可获取专属验证密码;同时支持任务过程数据回溯,便于开发者定位AI代理的能力短板;还提供开放的任务对比基准,方便研究人员横向对比不同AI代理的表现。平台主要面向AI开发者、AI研究人员、高校人工智能相关专业师生,可应用于AI代理迭代优化、AI能力边界研究、相关课程实践作业等场景。
ggg0919.github.io
Cantor是面向多模态链式思维推理研究的开源技术框架,核心定位是结合视觉感知与大语言模型逻辑推理能力,解决复杂视觉推理任务。核心功能包括视觉上下文感知对齐、多模态链式思维生成、推理性能自动评估、零样本推理适配、实验结果可视化。目标用户覆盖人工智能研究者、计算机视觉方向学生、多模态大模型开发人员、AI应用落地工程师、算法竞赛参与者。使用场景包括多模态推理算法性能测试、学术研究中基线模型对比、零样本视觉推理任务开发、大语言模型多模态能力验证、相关教学课程实验演示。

deepagent.abacus.ai
DeepAgent是由Abacus.AI推出的知名通用AI智能体平台,区别于常规对话式语言模型,核心定位为可落地执行复杂任务的自动化协作工具。平台支持通过自然语言指令完成全栈应用搭建、多维度主题研究、办公内容生成、跨工具工作流自动化等任务,可连接Google Workspace等外部系统,整合多类AI模型与工具实现端到端任务交付。目标用户覆盖开发者、企业创始人、行业分析师、知识工作者、学生等群体,适用于产品原型快速验证、行业研究分析、办公内容批量制作、内部效率工具搭建、日常工作流自动化等多种场景,同时符合SOC-2 Type-2、HIPAA等企业级安全合规标准,全程加密用户数据保障信息安全。

unified-io-2.allenai.org
Unified-IO 2是艾伦人工智能研究所推出的多模态生成模型演示平台,核心定位是为用户提供统一模态的AI能力体验入口。平台支持图像、文本、音频、动作四类模态的混合输入与输出,单个Transformer架构可实现跨模态语义的统一处理;内置经过120余个数据集微调的预训练模型,可直接适配多类多模态任务需求;平台同时提供基准测试结果查询功能,方便用户直观了解模型在各任务场景下的性能表现。目标用户覆盖AI研究人员、多模态应用开发者、高校相关专业师生、内容创作从业者等,可用于跨模态任务原型验证、模型性能对比分析、多模态应用效果测试、学术研究参考等场景。

tangoflux.github.io
TangoFlux是开源的文本到音频(TTA)生成模型平台,核心定位是为音频生成领域的研究者、开发者提供高效、对齐能力强的音频生成技术方案。核心功能包括基于CRPO框架的高对齐度文本转音频生成、30秒44.1kHz高音质音频快速生成、全开源的模型与代码资源开放。目标用户覆盖音频领域研究者、AI应用开发者、内容创作者、高校计算机相关专业学生等,可用于学术研究验证、音视频内容音频素材生成、AI音频应用原型开发、课程实践项目搭建等场景。

rank.opencompass.org.cn
OpenCompass司南是由上海人工智能实验室联合多家机构发起的开源大语言模型评测平台,核心定位为提供中立、可复现的大模型能力评测服务。平台支持超100个主流基准数据集,覆盖知识推理、数学计算、代码生成、语言理解、多模态处理等二十余个能力维度,可满足不同场景下的模型性能核验需求。平台面向大模型研发团队、AI领域研究者、企业技术选型人员、高校相关专业学生等群体,可用于模型研发过程中的能力迭代验证、学术研究中的性能对比、企业落地场景下的模型选型参考等多个场景,同时所有评测流程与数据完全开源,支持用户自定义评测任务配置。

slashspace.ai
Slashspace是一款定位本地优先的多智能体AI协作平台,依托无限画布载体为用户提供多智能体对话与深度研究支持。平台核心功能包含多智能体并行对话、无限画布信息整理、本地数据存储、自定义智能体配置、内容导出分享等,支持研究人员、内容创作者、产品开发者等不同群体在知识梳理、项目协作、创意脑暴等场景中开展工作,可将分散的AI对话内容整合在同一空间内,方便用户梳理逻辑关系,整合多来源信息。

imagebind.metademolab.com
ImageBind是Meta推出的多模态AI模型演示平台,核心定位是展示跨六种感官模态关联能力的AI技术成果。平台支持图像、音频、文本三类模态的交互查询演示,可实现不同模态内容的相似性匹配,还能生成跨模态的关联结果。目标用户覆盖AI研究人员、多模态应用开发者、高校计算机相关专业学生以及对AI前沿技术感兴趣的爱好者。使用场景包括学术研究参考、多模态产品原型验证、技术科普演示、跨模态应用功能构思等,帮助用户直观理解多模态AI的技术逻辑与应用潜力。

airisk.mit.edu
AI Risk Repository是麻省理工学院推出的AI风险公开数据库,当前收录超700个已发生或被验证的AI风险案例,按风险成因、所属领域、影响范围三个维度进行标准化分类整理。平台支持按关键词检索、多维度筛选、风险关联溯源等功能,目标用户覆盖AI领域研究人员、技术开发者、企业风控人员、AI审计师、政策制定者及高校相关专业师生。可应用于AI伦理研究、产品风险前置评估、行业监管政策制定、高校课程案例教学、AI系统审计校验等多个场景,为AI安全相关工作提供结构化的案例参考框架。

chatall.ai
ChatALL 是一款基于网页的开源 AI 对话聚合平台,核心定位是帮助用户同时向多个不同的大语言模型发送提问,统一查看不同模型返回的结果,支持对比不同模型的生成内容。核心功能包含多模型并行提问、对话结果保存导出、本地数据存储保护隐私、自定义模型快捷筛选,以及支持快捷提问。目标用户覆盖技术开发人员、内容创作者、AI 研究者、学生等群体,适合需要对比不同 AI 模型回答效果、整理 AI 对话内容、调研不同大模型能力的使用场景。

speechbot.github.io
Spirit LM是由研究团队推出的基础多模态语言模型,核心定位是实现文本与语音模态的自由混合交互。核心功能包括文本语音统一令牌流处理、少样本跨模态任务适配,以及两种不同特性的版本选择适配不同需求。目标用户涵盖自然语言处理研究人员、语音技术开发人员、多模态应用开发者、AI模型研究学习者等群体。使用场景包括语音识别模型优化、语音合成方案研发、多模态对话系统搭建、语音情感分析项目开发、跨模态任务迁移研究等多个方向,可帮助用户探索文本与语音模态融合的技术落地路径。

mammoth-vl.github.io
MAmmoTH-VL是面向多模态推理领域的学术研究与应用支撑平台,核心面向多模态大模型研发人员、数学教育相关从业者、AI研究学者等群体。平台搭载基于指令调优优化的多模态大语言模型,可支撑多模态数学题解析、跨模态推理任务评测、推理过程可解释性分析三类核心需求。用户可通过平台体验模型对图文结合数学题的解答过程,也可获取开源数据集用于相关模型训练,还能借助基准测试结果对比不同多模态模型的推理能力,适合学术研究、教育工具开发、多模态模型迭代等场景使用。

quoin.ai
Quoin.ai是专注于企业尽职调查自动化的AI研究工具,核心定位为企业调研信息整合与分析平台,可快速生成带完整引用来源的企业研究报告。核心功能包含多数据源企业信息聚合、报告引用来源自动标注、自定义调研维度设置三类,支持用户针对特定企业快速获取结构化的调研结果。该工具面向一级市场投资从业者、企业战略分析人员、咨询顾问、合规审查人员等群体,适用于项目投前尽职调查、竞品信息调研、合作方背景核查、行业企业盘点等场景,能够缩短手动收集整理公开信息的时间,辅助决策效率提升。

ailaborindex.com
The AI Labor Index是一个聚焦人工智能对劳动力市场影响的研究分析平台,核心定位是跟踪各职业受AI技术冲击的程度,量化不同工作任务的自动化潜力。平台可提供职业层面的AI替代风险评分,展示不同任务类型的自动化概率分布,支持用户按行业、职业分类查询相关数据,还可对比不同职业的自动化潜力差异。目标用户包括职业规划研究者、人力资源从业者、政策制定者以及求职择业人员,适合用于职业发展规划研究、劳动力市场趋势分析、行业AI影响评估等场景。
lastexam.ai
Humanity's Last Exam 是面向大型语言模型学术能力评估的多模态基准测试平台,由全球多领域专家联合开发。核心功能包括覆盖100余个学科的标准化试题库、支持多模态模型的统一测试流程、自动化生成详细学术能力评估报告。目标用户覆盖AI模型研发团队、高校人工智能研究人员、AI行业评测机构、科技企业算法开发部门等,可用于大模型学术能力摸底测试、不同模型学术能力横向对比、模型迭代效果验证、AI学术评测相关研究等场景,为人工智能技术在学术领域的性能优化提供参考依据。
researcher.customgpt.ai
CustomGPT.ai Researcher 是一款基于人工智能的深度研究与内容生成工具,核心定位为依托自定义知识库与互联网资源的智能研究辅助平台。核心功能包含多源信息聚合检索、结构化研究报告生成、自定义知识库关联适配,以及引用来源自动标注。目标用户覆盖学术研究者、内容创作者、企业市场人员、行业分析师等有内容调研与写作需求的群体,可应用于学术论文前期调研、行业分析报告撰写、品牌宣传内容创作、产品资料梳理等多种场景,帮助用户整合多渠道信息,减少手动检索与信息整理的工作量。

moltbook.com
Moltbook是面向AI智能体搭建的社交网络平台,核心定位是为不同类型的AI智能体提供内容分享、观点讨论、内容投票的交互空间,同时允许人类用户作为观察者参与内容浏览。平台核心功能包括AI智能体自主内容发布、多智能体跨模型观点交流、内容热度排序机制,目标用户覆盖AI研究人员、AI产品开发者、大语言模型测试人员、AI伦理研究学者等群体,可应用于AI交互行为研究、AI生成内容质量评估、多智能体协作模式探索等场景。

prelto.com
Prelto是一款基于AI技术的Reddit市场与客户研究助手,可帮助用户从Reddit海量公开讨论中提取有效市场信息、客户需求与用户观点。核心功能包括关键词话题搜索、需求趋势分析、竞品讨论整理、受众画像生成、导出研究报告等。目标用户涵盖产品经理、市场调研人员、初创创业者、内容创作者、竞品分析师等,适合在产品立项前期调研、目标受众需求挖掘、竞品用户反馈收集、细分市场规模判断等场景使用,帮助研究者降低人工整理信息的时间成本,获取更全面的用户真实观点。

ircopilot.com
IR COPILOT是专注于AI研究领域的信息分析平台,核心定位是帮助用户从海量AI相关数据中挖掘异常信号与深度研究洞见。平台支持AI研究文献的批量检索与要点提炼功能,可实现跨来源研究数据的自动整合与异常波动识别,还能生成结构化的研究分析报告,将原本需要数小时完成的资料梳理工作压缩至30分钟左右完成。目标用户覆盖AI领域研究人员、行业分析师、企业技术战略岗从业者、高校AI方向师生等,适用于前沿技术跟踪、行业趋势预判、研究选题参考、竞品技术动态分析等多种工作场景。

answergrid.ai
AnswerGrid是一款AI驱动的网络研究工具,以类电子表格的交互形式为核心载体,专注为用户提供自动化数据收集与分析服务。核心功能包含多源公开数据自动爬取整合、自定义维度智能分析、销售线索资质自动预审三个模块,可帮助用户减少手动检索整理信息的时间投入。目标用户覆盖初创企业销售团队、市场调研人员、行业分析师等群体,可应用于销售线索筛选、行业趋势调研、竞品信息汇总、潜在客户背景核查等多个场景,辅助用户提升销售与市场研究环节的工作效率。

genei.io
Genei是一款面向内容创作、学术研究群体的智能研究辅助工具,依托自定义AI算法为用户提供文献信息处理相关服务。核心功能包括文档智能摘要、内容信息检索、引用格式自动生成,能够帮助用户在处理学术论文、行业报告、专业文稿等内容时减少信息整理耗时。目标用户覆盖学术研究者、内容创作者、行业分析师等群体,可应用于文献综述整理、研究报告撰写、内容素材筛选、项目资料梳理等多种场景。

spatial-vlm.github.io
SpatialVLM是谷歌DeepMind研发的空间视觉语言模型展示站点,核心定位是呈现可实现定量空间关系理解与推理的多模态模型能力。平台支持空间视觉问答测试、空间推理路径可视化、机器人控制场景效果演示三类核心功能,面向AI研究者、机器人开发工程师、多模态模型学习者、计算机视觉领域从业者,可用于空间推理类模型性能验证、机器人导航逻辑预测试、多模态模型训练方向参考等场景,帮助用户直观了解空间视觉语言模型的技术特点与落地可能性。

inquisite.ai
Inquisite是基于人工智能技术的深度研究辅助平台,核心定位是为用户简化复杂主题的研究流程,降低深度信息整合的门槛。平台搭载AI代理迭代检索引擎,可自动对多源信息进行筛选、核验与排序,同时支持研究内容自动梳理和结构化文档生成功能,还可自动标注信息来源保障内容可信度。目标用户覆盖学术研究者、行业分析师、内容创作者、企业战略调研人员等群体,适用于学术论文前期资料收集、行业调研报告撰写、深度内容创作素材梳理、商业项目可行性调研等多种场景,能够帮助用户减少信息检索与筛选的时间投入,提升研究工作的效率。

aihabitat.org
PARTNR是由Meta FAIR发布的多智能体推理与规划研究领域的大规模基准测试平台,核心定位为面向AI研究人员的多智能体协作能力评估工具。平台内置10万个经过验证的自然语言协作任务,支持基于大型语言模型的智能体规划能力测试,同时提供人类在环评估基础设施。目标用户覆盖AI研究人员、多智能体系统开发人员、高校人工智能方向师生等群体,可用于多智能体协作算法验证、LLM规划能力短板分析、人机协作机制研究等场景,为相关领域的技术迭代提供标准化的测试支撑。

si.inc
hertz-dev是Standard Intelligence推出的开源音频变换器基础模型站点,核心定位为面向音频处理领域的开源技术研究平台,提供85亿参数规模的全双工仅音频变换器模型能力。核心功能包括音频编码转换服务,可将16kHz单声道语音转换为8Hz低比特率潜在表示;支持模型微调工具集,方便研究人员基于现有模型适配特定场景;提供完整的技术文档与开源协作社区,助力跨模态音频学习技术落地。目标用户覆盖AI音频领域研究人员、语音技术开发工程师、跨模态学习相关科研团队,适用于低带宽语音传输场景开发、音频特征提取研究、多模态大模型音频模块搭建等多元场景。

arc.ai
ARC Reactor是由ARC AI推出的AI驱动计算基础设施平台,面向AI研究人员、应用开发者和科技企业提供低能耗的AI计算服务,核心功能包含AI计算资源调度、本地语音助手部署、开源AI研究工具集合、能耗优化管理以及自定义AI模型部署支持,可用于AI模型训练、离线语音应用开发、AI学术研究、生产环境AI应用部署等多种场景,帮助用户在控制算力成本的同时完成各类AI相关工作。

largeworldmodel.github.io
Large World Models是专注于长序列多模态处理的开源大模型项目官网,核心基于RingAttention技术构建70亿参数规模的模型体系,可支持超100万标记的文本、长视频序列处理。项目提供开源模型权重下载、技术文档查阅、推理示例部署等核心功能,面向AI研究人员、多模态应用开发者、高校计算机相关专业师生等群体,可应用于长视频内容分析、超长文档理解、多模态知识库构建、长时序任务推理等多种科研与落地场景。