输入关键词搜索 AI 工具、分类,或直接跳转页面
Image Describer是一款基于人工智能技术的图像描述生成工具,核心定位是为用户提供自动化的图像内容解析与文本生成服务。其核心功能包括本地图片上传解析、自定义描述风格调整、多语言描述内容输出,可根据用户输入的提示词生成符合特定场景需求的描述内容。工具面向内容创作者、电商运营人员、视障群体、教育工作者、新媒体从业者等用户群体,可适用于社交媒体配图配文、商品详情页素材描述、视障用户图片内容感知、课件配图说明撰写等多种场景,帮助用户降低人工撰写图片描述的成本,提升图像内容的传播可及性。
按 图像识别与分析领域热度与收录质量排序,功能定位与 Image Describer 相近,可按定价与平台筛选对比。

iris.fun
Iris是运行在macOS系统上的本地ChatGPT客户端工具,为用户提供系统级快速访问ChatGPT服务的入口,集成多场景辅助功能,支持自定义配置与多账号管理,面向需要日常使用ChatGPT开展工作与学习的macOS用户打造,支持全局快速唤起、多模型切换、对话内容本地存储、自定义快捷键与界面样式、剪藏整合对话等核心功能,可应用于办公间隙快速查询信息、写作过程中辅助生成内容、学习时整理知识点、开发时查询代码片段等多种场景,帮助用户在不切换浏览器的情况下完成各类交互。

aiimagetotext.com
AIImagetoText是一款依托人工智能技术的在线图像文本提取工具,核心定位为帮助用户快速将各类图像载体中的文字转换为可编辑的数字化文本。该工具支持多种类型图像格式上传,可识别印刷体文字与清晰手写文字,处理完成后支持直接复制或导出文本内容。目标用户覆盖学生、办公职员、文字工作者、研究者等群体,适合处理课堂板书拍照转文字、书本内容摘录、手写笔记数字化、图片公告内容提取等使用场景。

describe.pictures
AI Describe Pictures是基于人工智能大模型打造的图片内容识别与描述生成平台,核心定位是为各类用户提供高效的图片文字转写服务。平台支持多场景图片识别,可生成不同风格的描述文本,同时支持中文等多语言输出。目标用户涵盖视觉障碍群体、内容创作者、电商运营人员、教育工作者等,可应用于无障碍信息适配、内容素材整理、商品详情撰写、教学资料制作等多种场景,帮助用户降低图片信息提取的人工成本,提升文本产出效率。

track-calories.com
Track Calories是一款基于人工智能技术,通过食物照片进行卡路里与营养成分追踪的在线饮食管理平台,核心为用户提供饮食数据记录与分析服务。平台支持上传食物照片快速识别食物品类,自动计算卡路里及各类营养元素含量,还可生成饮食报告,梳理日常饮食结构,支持手动添加记录、自定义食物数据库、多日数据趋势查看等功能。目标用户包括需要控制体重的健身人群、关注健康饮食的普通用户、患有慢性代谢疾病需要管控饮食的人群,适用于日常外出就餐记录、居家饮食规划、健身周期饮食追踪等多种场景。

storageiq.io
StorageIQ是一款基于人工智能技术的家庭物品库存管理平台,核心定位为帮助用户系统化管理家庭各类存放物品,解决物品遗忘存放位置、闲置浪费、过期未及时发现等问题。平台支持通过智能识别快速录入物品信息,支持多空间分类管理,可生成物品清单与库存提醒,适配家庭收纳整理、储物空间规划、闲置物品梳理等多种场景,满足普通家庭用户、租房用户、收纳爱好者等不同人群的物品管理需求。

faceplusplus.com.cn
Face++旷视是人工智能开放服务平台,面向开发者、企业客户提供计算机视觉相关的AI技术服务。平台核心功能包含人脸识别、人像处理、文字识别三大类能力,支持公有云API、离线SDK等多种接入方式,能够满足不同开发环境下的集成需求。目标用户覆盖应用开发者、企业技术团队、智能硬件厂商等群体,可用于身份核验场景、智能安防项目、内容审核系统搭建、移动端智能功能开发等多种业务场景,帮助用户降低AI技术研发成本,缩短相关功能的落地周期。

textin.com
TextIn是面向企业及个人用户的智能文档处理平台,主打OCR文字识别、文档格式转换、内容结构化提取等核心能力。平台支持对图片、扫描件、PDF等多类型载体的文字信息进行提取转换,可处理发票、合同、证件、表格等多种形态的文档内容,帮助用户完成文档信息的高效录入、整理与分析,适用于办公场景信息提取、批量文档数字化、财务票据核验、档案归档整理等多种使用场景。

doc2x.noedgeai.com
Doc2X是专注于多格式文档智能解析与转换的在线AI工具,核心定位为低门槛文档结构化处理平台。核心功能包括支持扫描件、PDF、图片类文档的文字与版式识别,可将非结构化文档转换为可编辑的Word、Markdown、Excel等格式,同时支持公式、表格、复杂排版的精准还原。目标用户覆盖学生、科研人员、办公职员、内容编辑等需要处理各类文档的群体,可应用于文献整理、办公文档编辑、扫描件信息提取、课件内容二次编辑等多种场景,无需复杂配置即可在线完成文档处理操作。

landing.ai
Landing AI是一个面向工业场景的计算机视觉AI开发平台,帮助企业快速构建、部署和管理定制化计算机视觉模型,无需深厚的算法开发基础。平台核心功能包含数据标注工具、模型自动化训练、部署工具包、模型性能优化以及项目团队协作,主要服务于工业制造、质量检测、物流仓储等领域的企业团队,适用于生产环节缺陷检测、零部件分拣计数、仓储货物识别等多种业务场景,可降低AI项目落地的技术门槛,缩短项目开发周期。

myplantin.com
PlantIn是一款面向植物相关人群提供植物识别与养护服务的工具类网站,依托AI技术为用户提供精准的植物识别、个性化养护指导、病虫害问题排查等服务。网站核心功能包含AI植物识别、个性化养护日历、植物病虫害诊断、养护知识库查询、植物生长记录等,支持用户识别未知植物,获取定制化养护方案,排查植物生长异常原因,记录植物生长过程。网站面向植物爱好者、家居绿植种植者、园艺工作者、户外徒步爱好者、学生、花艺从业者等不同群体,可应用于户外野生植物识别、室内绿植日常养护、植物病虫害治理、园艺学习研究等多个场景,帮助用户了解植物生长特性,做好日常养护管理。

imagetotext.cc
imagetotext.cc是一款专注于在线OCR文本提取的服务网站,核心定位是为用户提供无需下载安装的网页端图像转文字处理服务。网站支持从各类常规图像格式中提取可编辑文本,同时支持转换为多种可导出格式,满足不同用户的文本提取需求。网站支持批量上传处理,支持多语言识别,无需注册即可使用基础功能。目标用户包括内容创作者、办公行政人员、在校学生、数据整理人员、文案编辑、科研工作者等,适用于扫描文档文字提取、图片截图文字转写、手写笔记数字化、书籍内容整理、会议截图文字归档等多种使用场景。

npmjs.com
llama-ocr是一款开源npm库,核心定位为基于Llama 3.2 Vision模型的光学字符识别工具,可帮助开发者快速集成文本识别能力到项目中。核心功能包括支持本地与远程图像的OCR识别、提供免费与付费两种接口调用方案、后续规划支持PDF格式文件的内容提取,项目设计受Zerox启发,整体结构轻量化易集成。目标用户覆盖前端开发人员、Node.js后端开发者、小型工具开发团队等,可应用于文档数字化、图像内容转写、批量文本提取、小票信息录入等多种开发场景,降低OCR功能的接入门槛。

ubiai.tools
UBIAI是专注于文本领域的数据标注平台,支持多类型文本数据的标注、模型训练与部署全流程管理。平台内置OCR文本提取能力,可从扫描件、图片类文档中识别文本内容;搭载自动化标注功能,可通过学习用户标注习惯降低重复工作量;支持多语言标注,覆盖希伯来语、日语、阿拉伯语、印地语等数十种语言。平台面向NLP算法工程师、数据标注团队、行业数据分析人员,适用于医疗记录分析、金融文档处理、多语种内容审核、智能客服语料标注等多个场景,帮助用户标准化文本数据处理流程,提升标注效率。

renamify.co
Renamify是一款基于人工智能技术的照片文件批量重命名与分类整理工具,核心定位是为用户解决照片库杂乱、检索困难的问题。核心功能包括AI智能识别照片内容生成规范文件名、自动按场景或拍摄时间归类整理相册、端到端本地处理保障用户数据隐私。目标用户覆盖普通个人用户、摄影爱好者、新媒体从业者、家庭相册管理者等群体,可应用于日常照片整理、工作素材归档、家庭回忆分类、批量素材预处理等多种场景,帮助用户提升照片管理效率,降低手动整理的时间成本。

teachablemachine.withgoogle.com
Teachable Machine是谷歌推出的无代码机器学习模型创建网页工具,核心定位是降低机器学习应用门槛,让没有算法基础的用户也能完成简单AI模型的搭建。核心功能包括图像识别模型训练、音频识别模型训练、姿态识别模型训练三类,用户无需编写代码,仅需上传对应类型的样本数据即可完成自动训练。目标用户覆盖学生、教育工作者、创意从业者、小型项目开发者等群体,可用于课堂AI教学演示、互动艺术装置开发、小型智能识别工具制作等多个场景。

datalab.to
Datalab.to是专注于文档智能处理的开源AI工具平台,核心定位是为开发者、企业及相关从业者提供高性能的文档处理AI模型服务。平台核心功能包括高精度OCR识别、文档布局智能分析、PDF格式转Markdown导出,支持批量处理多类型文档文件。目标用户覆盖学术研究人员、企业办公人员、内容运营人员、前端开发人员、数据处理工程师等,可应用于学术文献批量整理、企业合同数字化归档、扫描文档内容提取、旧文档格式转换等多个场景,帮助用户降低文档处理的人力投入,提升内容流转效率。

seeingai.com
Seeing AI是微软推出的面向视障、低视力群体的AI辅助工具,核心定位是通过计算机视觉技术将视觉信息转化为语音反馈,帮助视觉障碍人群感知周边环境。核心功能包含实时场景语音描述、文本OCR朗读、商品条码识别,主要服务于视障人士、低视力用户以及相关照护人员,适用于日常出行、购物、阅读、社交互动等多个场景,工具依托持续的AI研究迭代功能,支持用户反馈参与产品优化。

omniparser.net
OmniParser是一款基于AI技术的图像结构化解析工具,核心定位是将非结构化的视觉内容转化为可编辑、可分析的结构化数据,支持解析用户界面屏幕截图与漫画页面。核心功能包含界面元素结构化提取、漫画文字识别与整理、自定义解析规则配置、结果导出与格式转换、多语言内容识别处理。适合产品经理、UI设计师、漫画创作者、数据分析师、内容运营等用户使用,可应用在竞品分析界面整理、漫画文字提取校对、UI界面数据结构化存储、界面原型内容转录等多个场景。

datavlab.ai
DataVLab是专注于为多个行业提供人工智能数据标注服务的平台,核心业务覆盖文本、图像、视频多模态数据标注,支持定制化标注需求开发,对接算法训练全流程。平台提供标注工具部署、标注团队管理、数据质量校验等服务,可满足不同规模的人工智能模型训练数据需求。目标用户包括人工智能算法团队、自动驾驶研发企业、计算机视觉创业项目、自然语言处理研究机构等,适用于模型训练数据准备、已有数据集清洗校正、定制化数据采集标注等场景。

srefhunt.com
SrefHunt是一个面向AI绘画创作者的社区平台,核心为Midjourney用户提供风格参考代码与创意提示词分享服务。平台支持用户上传分享自己使用的有效Midjourney风格参考链接,也可搜索浏览他人分享的创意素材,还能对内容进行点赞收藏与分类整理。目标用户涵盖AI绘画爱好者、专业视觉设计师、内容创作团队等,适合创作者寻找绘画灵感、复用成熟风格参考、交流AI绘画创作经验的场景。

deepengin.com
DeepEngin是一个提供全方位图像与视频内容审查API服务的平台,面向企业开发者与产品团队提供自动化内容合规检测能力。核心功能包含图像违规内容检测、视频帧多维度审查、自定义违规规则配置、调用数据统计分析与批量内容处理,可帮助平台快速完成用户生成内容的合规校验,降低人工审核成本,满足互联网内容社区、短视频平台、电商平台等场景下的内容安全监管需求。

faceshapedetector.ai
Face Shape Detector是一款基于人工智能技术的脸型分析工具,核心定位是通过人脸图像识别为用户提供精准的脸型判定及个性化外形建议。核心功能包括AI脸型自动识别、适配发型推荐、妆容风格匹配、配饰穿搭参考四类,支持用户上传自拍或实时拍摄完成检测。目标用户覆盖普通消费者、美妆从业者、发型设计师、穿搭博主等群体,可用于个人形象改造参考、美妆服务前置沟通、发型设计方案预选、穿搭内容创作素材收集等多种场景,帮助用户降低外形风格试错成本。

imaginprompt.com
ImaginPrompt: Image to Prompt是一款专注于AI图像逆向生成提示词的在线工具,核心定位是为AI绘画用户提供跨平台适配的提示词转换服务。支持上传本地图片或输入图片URL进行分析,生成匹配Midjourney v6、DALL-E 3、Stable Diffusion、Flux.1等主流绘画模型的提示词,还可根据需求调整提示词的风格权重、细节丰富度参数。目标用户涵盖AI绘画创作者、平面设计师、新媒体运营人员等,适用于复刻参考图风格、优化现有绘画提示词、批量生成同系列创作思路等场景,帮助用户降低提示词撰写门槛,提升AI绘画的产出匹配度。

yunkaoai.com
Yunkao AI是一款基于人工智能技术搭建的在线考试平台,面向各类机构及个人用户提供在线考试全流程服务,核心功能包含智能监考防作弊、智能组卷、自动判分、成绩分析等。能够满足企业招聘考核、培训机构测评、学校日常考试、行业资格认证等多种场景的在线考试需求,借助AI技术降低线下组织考试的成本,提升考试组织和管理的效率