输入关键词搜索 AI 工具、分类,或直接跳转页面

agentsflex.com
Agents Flex是面向Java开发者的大语言模型应用开发框架,核心定位为降低LLM应用的开发门槛,提供标准化的大模型对接与能力调度方案。核心功能包含多协议大模型适配、多范式Prompt工程模板、本地函数调用编排、工作流可视化搭建、调用链路可观测等模块。目标用户覆盖Java生态的后端开发人员、AI应用研发工程师、企业级应用架构师等群体,可满足对话式AI应用开发、企业内部知识库问答系统搭建、AI工作流集成、智能客服系统开发等多种场景的开发需求。

ts.llamaindex.ai
LlamaIndex.TS是面向TypeScript/JavaScript生态的大语言模型应用开发框架,核心定位为降低私有数据与大语言模型结合的开发门槛。核心功能包括多源私有数据结构化接入、上下文检索增强生成、多运行时环境适配,支持开发者将业务私有数据快速接入大模型应用,解决大模型知识时效性不足、私有领域信息缺失的问题。目标用户覆盖全栈开发人员、AI应用开发者、企业技术团队,可用于搭建企业内部知识库问答系统、领域专属智能客服、个人知识助理、文档智能分析工具等多种场景,无需开发者具备深度学习专业背景即可完成功能落地。

hithqd.github.io
DynamicControl是专注于提升文本到图像扩散模型生成控制力的开源技术框架,核心定位是解决多控制信号组合下图像生成一致性不足的问题。其核心功能包括双循环控制器初始条件排序、多模态大语言模型条件评估优化、并行多控制适配器特征整合三大模块,支持用户灵活组合不同类型、数量的控制条件,实现更符合预期的图像生成效果。该框架面向AI图像生成领域的研究人员、算法工程师、AIGC应用开发者,可应用于可控图像生成算法研究、专业AI绘图工具开发、定制化图像生成系统搭建等场景,帮助使用者降低多条件控制下的图像生成偏差,提升生成结果与输入需求的匹配度。

jackhopkins.github.io
Factorio学习环境(Factorio Learning Environment, FLE)是基于游戏《Factorio》构建的大语言模型能力评估框架,核心定位为AI研究领域的开放式智能体测试工具。核心功能包括支持结构化任务与开放式任务两类评估协议、可自定义难度梯度的任务配置、标准化的能力评估指标体系。目标用户覆盖AI研究人员、大语言模型开发团队、高校人工智能方向师生、智能体研发从业者、游戏AI爱好者、开源AI项目贡献者。使用场景包括LLM长期规划能力验证、程序合成效果测试、资源分配优化算法评估、智能体多步骤决策能力 benchmark 搭建、复杂开放式领域智能体训练数据集构建等,为大语言模型在复杂任务场景下的能力评估提供标准化测试载体。
ggg0919.github.io
Cantor是面向多模态链式思维推理研究的开源技术框架,核心定位是结合视觉感知与大语言模型逻辑推理能力,解决复杂视觉推理任务。核心功能包括视觉上下文感知对齐、多模态链式思维生成、推理性能自动评估、零样本推理适配、实验结果可视化。目标用户覆盖人工智能研究者、计算机视觉方向学生、多模态大模型开发人员、AI应用落地工程师、算法竞赛参与者。使用场景包括多模态推理算法性能测试、学术研究中基线模型对比、零样本视觉推理任务开发、大语言模型多模态能力验证、相关教学课程实验演示。

design-edit.github.io
DesignEdit是面向空间感知图像编辑需求的技术框架类工具网站,核心定位是为图像编辑相关的开发者、研究人员提供统一的多层潜在表征编辑解决方案。核心功能包含基于key-masking自注意力的图像区域修复、指令驱动的多层潜在表征融合、潜在空间伪影抑制三大模块。目标用户覆盖计算机视觉领域研究人员、图像工具开发从业者、AI图像方向的高校学生等群体,可用于图像目标移动、背景替换、局部元素增删、多图像元素拼接等空间类图像编辑任务的技术研发与效果验证。

gen-x-d.github.io
GenXD是一个专注于3D与4D场景生成的开源研究框架,核心面向计算机视觉领域的研究者、开发人员及相关方向学生,旨在解决当前4D生成领域数据稀缺、运动与相机参数耦合的行业问题。核心功能包含专业4D数据策划流程,可从普通视频中提取相机姿态与物体运动强度参数;自研CamVid-30K大规模现实世界4D场景数据集,覆盖多类真实场景样本;多视图-时间模块,可实现相机与物体运动参数的分离学习,兼容3D与4D两类数据训练。目标用户覆盖高校计算机视觉实验室研究员、3D内容开发工程师、元宇宙场景搭建人员、AI生成算法开发者、数字孪生项目从业者、图形学相关专业学生等。使用场景包括学术研究中4D生成算法的基准测试、元宇宙项目中动态场景的批量生成、数字孪生项目的真实场景复刻、3D内容创作中的多视图一致素材生成等。

nju-pcalab.github.io
STAR是南京大学PCALAB推出的真实世界视频超分辨率时空增强框架站点,核心定位是为视频画质修复领域提供基于文本到视频扩散先验的技术方案。站点核心功能包括框架技术原理详细讲解、公开数据集测试效果样例展示、模型代码与预训练权重下载渠道提供,同时附带相关学术论文引用说明。目标用户覆盖计算机视觉领域研究人员、视频处理相关开发工程师、影视内容修复从业者、高校相关专业师生等群体,可应用于学术研究参考、商用视频画质优化、老视频修复、低分辨率监控视频增强等多个场景,为视频超分辨率任务提供新的技术实现路径。

nvlabs.github.io
Sana是由NVIDIA研究院推出的轻量级文本生成图像开源框架,核心定位为在消费级硬件上实现高效高分辨率图像生成。该框架支持最高4096×4096分辨率图像输出,搭载深度压缩自编码器、线性扩散变换器与轻量文本编码器架构,可在普通笔记本16GB显存GPU上运行,1秒内即可生成1024×1024分辨率的对齐文本描述的图像。面向AI图像生成研究者、独立内容创作者、前端产品开发者等群体,适用于快速原型图制作、批量内容素材生成、嵌入式AI功能部署等场景,可降低高分辨率AI绘画的硬件门槛与时间成本。

langchain.com
LangGraph是LangChain团队推出的AI Agent编排框架,核心定位是帮助开发者构建有状态、可循环的多步骤AI应用。其核心功能包括状态图定义、条件分支路由、人机交互节点、持久化检查点,能够实现复杂的Agent工作流和决策逻辑。该工具面向AI应用开发者、工程师和技术团队,适用于客服机器人、数据分析流水线和多步骤AI工作流构建等场景。

adminforth.dev
AdminForth是一款开源的基于Tailwind CSS构建的管理面板框架,支持Vue 3与Node.js TypeScript开发,面向需要快速搭建后台管理系统的开发者提供组件化开发支持。核心功能包含可复用UI组件库、响应式布局适配、权限路由配置、自定义主题修改、数据表格封装,帮助开发者减少重复基础开发工作,适用于企业后台、内容管理系统、数据分析仪表盘、 SaaS管理后台等开发场景。

me.kiui.moe
LGM是专注于3D模型生成的技术框架站点,核心定位是为用户提供从文本提示或单视图图像生成高分辨率3D模型的技术能力。其核心功能包括多视图高斯特征3D表示、非对称U-Net多视图处理、高分辨率3D内容快速生成。目标用户覆盖3D内容创作者、游戏开发人员、AI研究人员、工业设计从业者等群体,可应用于游戏资源制作、元宇宙场景搭建、产品原型3D建模、学术研究实验等多个场景,帮助用户降低3D模型创作的技术门槛,提升生成效率与输出质量。

umi-gripper.github.io
Universal Manipulation Interface(简称UMI)是面向机器人操作领域的数据收集与策略学习框架,核心定位是降低机器人技能从人类演示到实际部署的迁移门槛。核心功能包括手持夹具式人类操作数据采集、硬件无关的机器人策略学习、零次调整的跨场景技能泛化。目标用户覆盖机器人研发人员、高校自动化领域研究者、工业机器人方案开发者、科研机构机器人实验室人员等。使用场景涵盖工业流水线机器人操作技能训练、家用服务机器人复杂动作开发、双臂机器人动态任务学习、特殊场景机器人操作策略验证等多个领域,可帮助开发者快速将人类的操作经验转化为可落地的机器人执行策略。
infinitescript.com
GaussianCity是由南洋理工大学S-Lab团队开发的3D城市场景生成框架,基于3D高斯绘制技术打造,核心定位是解决大规模3D城市生成中的内存与计算效率问题。框架内置紧凑3D场景表示模块,可降低城市场景存储占用;搭载空间感知高斯属性解码器,能够实现单步前向传递生成无边界3D城市;配套完整开源代码与预训练模型,支持用户快速自定义场景开发。面向计算机视觉研究人员、3D内容开发者、自动驾驶仿真工程师等群体,可应用于城市规划可视化、自动驾驶训练场景搭建、元宇宙城市内容创作、游戏开放世界构建等多个场景。

hyper-sd.github.io
Hyper-SD是聚焦于低步数高效图像合成的开源技术框架官方站点,核心面向AI图像生成领域的开发者、研究人员及应用开发者提供技术支持。站点核心功能包含完整的技术论文说明、开源代码仓库入口、不同步数推理效果的样例展示,同时提供模型部署的实操教程。目标用户覆盖AI计算机视觉领域研究人员、AIGC应用开发工程师、图像生成工具开发者等群体,可用于快速图像生成API开发、端侧AI图像生成功能落地、图像生成效率优化研究等场景。
charactergen.github.io
CharacterGen是一个专注于3D角色生成的开源技术框架,核心功能包括单图转3D角色网格、多视图扩散校准、高分辨率纹理生成,主要面向3D美术从业者、游戏开发人员、动画制作团队、AI图形研究人员,可应用于游戏角色批量制作、虚拟数字人快速建模、动画项目角色资产搭建、学术研究模型性能验证等场景,无需复杂的多视角拍摄或手动雕刻基础模型,即可基于单张2D角色图像生成外观一致、姿势规范的3D角色资产。

genworlds.com
GenWorlds是一款专注于多智能体系统搭建的开源开发框架,核心定位是降低复杂多智能体应用的开发门槛,支持开发者快速构建高可靠性的智能协作系统。其核心功能包括自定义环境配置、可扩展架构适配、即插即用组件调用、多类型认知过程设置以及协调协议自定义。主要面向AI应用开发者、智能系统研究员、企业技术开发团队、高校计算机相关专业师生等群体,可应用于智能客服系统搭建、协作办公工具开发、虚拟仿真场景构建、分布式任务处理系统研发等多个场景,帮助开发者减少底层逻辑开发工作量,聚焦业务场景的功能实现。

lakesail.com
LakeSail是一个基于Rust语言开发的开源计算框架,核心定位为统一处理流处理、批处理与人工智能工作负载,面向大数据领域提供一体化的计算解决方案。框架支持将不同类型的计算任务整合到同一执行引擎中运行,避免多引擎切换带来的性能损耗与架构复杂度。核心功能包含统一执行引擎、多负载类型支持、原生Rust性能优化、开源社区协作开发、兼容主流大数据生态等,主要面向大数据开发工程师、AI算法工程师、后端架构师以及开源技术贡献者,适用于企业级大数据处理 pipeline 搭建、人工智能推理训练任务部署、实时离线混合计算场景开发等使用场景。

claw-code.codes
Claw Code是基于Python和Rust开发的Claude Code AI智能体框架开源重写版本,面向开发人员、AI框架研究者以及开源项目贡献者,提供可本地部署、可自定义修改的AI智能体开发基础框架,支持开发者基于该框架构建适配自身需求的AI编码辅助工具,也可供AI框架学习者研究Claude Code的架构实现逻辑,适用于本地AI开发环境搭建、自定义编码智能体开发、开源框架二次开发等场景。

agno.com
Agno是一个开源代码库,面向开发者提供构建自定义AI代理的开发框架,支持模型无关的架构设计,集成了记忆管理与外部工具调用能力。核心功能包含多模型适配、结构化记忆存储、工具接入扩展、异步任务处理与快速部署支持,可帮助开发者降低AI代理开发门槛,适配不同规模的AI应用开发需求。目标用户为AI应用开发者、全栈开发工程师、机器学习研究人员,适合用于搭建智能问答助手、自动化工作流代理、多模态交互AI应用等开发场景。
costwen.github.io
Ouroboros3D是面向3D内容创作领域的统一3D生成开源框架,核心是将基于扩散的多视图图像生成与3D重建能力集成到递归扩散流程中,通过自条件机制实现两个模块的联合训练适配。其核心功能包括多视图图像递归生成、3D模型实时重建、几何一致性校验、推理过程可视化、自定义训练参数配置。目标用户覆盖3D算法研究人员、计算机图形学开发者、3D内容创作从业者、高校相关专业师生、AI生成内容技术爱好者。可应用于3D内容批量创作、数字孪生模型构建、游戏素材快速生成、学术研究算法验证、元宇宙场景搭建等多个场景,帮助用户降低3D内容生成的技术门槛,提升3D模型生成的几何稳定性。

crewai.com
CrewAI是一款开源AI多智能体协作框架,核心定位是让开发者便捷构建多个AI Agent协同工作的应用系统。其核心功能包括角色定义与任务分配、Agent间消息传递、工具调用集成、流程编排控制,能够实现复杂任务的自动化分解与协作完成。该工具面向AI开发者、技术团队和自动化工程师,适用于业务流程自动化、数据分析流水线和多Agent系统开发等场景。

browser-use.com
作为开源AI浏览器自动化框架,专注于为开发者和RPA场景提供AI驱动的浏览器操作能力,支持自主导航网页、表单填写、数据提取等功能,搭配反检测、多LLM适配、全球代理等特色能力,广泛用于网页搜索、在线购物、数据采集、网站测试等场景。

aws.amazon.com
Amazon Q是AWS推出的AI助手平台,核心定位是为开发者和企业用户提供基于AWS生态的智能辅助服务。其核心功能包括代码生成与补全、AWS架构咨询、企业知识问答、数据分析辅助,能够帮助用户更高效地使用AWS服务解决技术问题。该工具面向AWS开发者、运维工程师和企业IT团队,适用于代码开发、云架构设计和企业知识管理等场景。

cyberhost.github.io
CyberHost是一个端到端音频驱动的人体动画生成框架,核心定位是为音频内容匹配符合逻辑的人体全身动态效果。其核心功能包括基于区域码本注意力机制的人体动作生成,可保障手部动作完整性与人物身份一致性;采用双U-Net架构作为基础结构,配合运动帧策略实现动画的时间延续性;支持零样本音频驱动人体视频生成,无需针对特定人物提前训练即可输出自然动态。目标用户覆盖计算机视觉研究人员、动画制作从业者、数字内容创作者、人机交互开发人员等,可应用于虚拟人直播动作生成、短视频数字人内容制作、元宇宙虚拟形象驱动、动画前期动作预演等多种场景。

botticellibots.com
BotticelliBots是面向.NET生态开发者的开源机器人开发框架站点,核心为开发者提供基于.NET Core的通用聊天机器人构建能力。站点集成数据库对接、队列代理适配、多AI引擎接入、语音引擎联动四大核心模块,支持跨平台部署与高负载场景调度。目标用户覆盖.NET后端开发者、企业智能服务开发团队、开源技术爱好者,可应用于企业客服机器人搭建、智能语音交互系统开发、高负载消息分发机器人部署等多种场景,帮助开发者降低自研机器人的底层架构搭建成本。

ml-explore.github.io
MLX是苹果机器学习研究团队推出的数组计算框架,核心定位是为苹果芯片平台的机器学习研发提供高效灵活的底层支持。框架API设计与NumPy高度相似,同时支持可组合函数转换、惰性计算、多设备统一内存访问三大核心特性,可大幅降低苹果生态下机器学习模型的开发与部署成本。目标用户覆盖机器学习研究者、算法工程师、苹果生态应用开发者等群体,适用于模型原型快速验证、苹果设备端模型性能优化、深度学习基础算子开发等多种场景。

yukun-huang.github.io
DreamWaltz-G是一款面向3D内容创作领域的文本驱动3D头像与全身动画生成框架官网,核心定位是为3D创作者、研究人员提供可控性强的3D数字人生成解决方案。核心功能包括文本驱动3D头像生成、骨架引导的全身动画制作、混合3D高斯实时渲染,目标用户覆盖计算机图形学研究人员、游戏3D美术设计师、虚拟数字人创作者、动画制作从业者等群体,可应用于虚拟偶像内容制作、游戏角色原型设计、学术3D生成方法验证、短视频虚拟角色动画创作等多种场景,帮助用户降低3D数字人内容的制作门槛,提升生成内容的视角与姿势一致性。

docs.nerf.studio
nerfstudio是面向神经辐射场(NeRF)领域的开源开发框架官方文档站点,核心定位是为NeRF研发与应用人员提供体系化的技术支撑资源。站点覆盖模块化框架接口说明、多场景数据预处理教程、训练过程可视化操作指引三类核心内容,目标用户包含计算机视觉领域研究人员、3D内容开发从业者、高校相关专业学生、NeRF技术爱好者等群体,可满足用户学习NeRF基础原理、复现前沿模型、开发自定义3D重建应用、调试模型训练参数等多类场景需求。

kaibanjs.com
KaibanJS是面向JavaScript开发者的AI智能体构建与协调框架,核心定位是降低AI多智能体系统的开发门槛,支持开发者基于熟悉的JS生态快速搭建分布式AI任务处理系统。核心功能包括智能体任务拆分与自动协同机制、原生JavaScript全生态兼容支持、类微服务架构的任务流编排能力,适配AI应用开发、多模态数据处理、自动化工作流搭建等场景,帮助开发者无需额外学习新语言即可开发复杂AI系统。

simular.ai
Agent S是Simular AI推出的开放智能代理框架,核心定位是通过图形用户界面实现与计算机系统的自主交互,帮助用户完成各类复杂多步骤的计算机操作任务。核心功能包括经验增强分层任务规划,可将复杂任务拆解为可执行的子任务序列;具备叙事记忆与情景记忆能力,可从过往交互中沉淀操作经验优化执行逻辑;支持多系统跨平台适配,可在Windows、macOS等主流桌面系统环境下运行。目标用户覆盖AI研发人员、办公自动化从业者、批量操作处理人员、科研实验人员等,适用于批量文档处理、重复操作自动化、多步骤系统操作模拟、AI代理能力测试等多种场景,可降低复杂计算机操作的人力投入,提升任务执行的稳定性。

gitcode.com
CangjieMagic是基于仓颉编程语言打造的LLM Agent开发框架,核心定位是为仓颉生态开发者提供低门槛的大模型智能应用搭建能力。框架内置任务智能规划模块,可自动拆解复杂用户需求为可执行步骤;支持多工具模块化调用,可接入各类第三方API和自定义功能组件;提供标准化的Agent开发模板,减少重复代码编写工作。主要面向仓颉语言开发者、大模型应用开发人员、AI应用创业团队等群体,可用于搭建智能客服系统、自动化任务处理工具、行业知识库问答应用、个人智能助理等多种AI原生产品,帮助开发者将大模型能力快速集成到仓颉生态的各类应用中。

metaflow.org
Metaflow是一个面向数据科学与机器学习项目的开源框架,核心定位是帮助开发团队简化项目构建、版本管理与部署流程。它支持从数据处理、模型训练到结果交付的全流程开发,提供统一的接口和数据结构,减少不同工具间的适配成本。核心功能包括项目版本管理、流水线编排、数据工件存储、云资源调度等,目标用户是数据科学家、机器学习工程师以及数据科学团队。适合用于企业级数据项目开发、科研机构模型训练、创业公司AI产品落地等场景,能够协调团队协作,提升项目交付效率。