输入关键词搜索 AI 工具、分类,或直接跳转页面
Teachable Machine是谷歌推出的无代码机器学习模型创建网页工具,核心定位是降低机器学习应用门槛,让没有算法基础的用户也能完成简单AI模型的搭建。核心功能包括图像识别模型训练、音频识别模型训练、姿态识别模型训练三类,用户无需编写代码,仅需上传对应类型的样本数据即可完成自动训练。目标用户覆盖学生、教育工作者、创意从业者、小型项目开发者等群体,可用于课堂AI教学演示、互动艺术装置开发、小型智能识别工具制作等多个场景。
按 图像识别与分析领域热度与收录质量排序,功能定位与 Teachable Machine 相近,可按定价与平台筛选对比。

faceplusplus.com.cn
Face++旷视是人工智能开放服务平台,面向开发者、企业客户提供计算机视觉相关的AI技术服务。平台核心功能包含人脸识别、人像处理、文字识别三大类能力,支持公有云API、离线SDK等多种接入方式,能够满足不同开发环境下的集成需求。目标用户覆盖应用开发者、企业技术团队、智能硬件厂商等群体,可用于身份核验场景、智能安防项目、内容审核系统搭建、移动端智能功能开发等多种业务场景,帮助用户降低AI技术研发成本,缩短相关功能的落地周期。

textin.com
TextIn是面向企业及个人用户的智能文档处理平台,主打OCR文字识别、文档格式转换、内容结构化提取等核心能力。平台支持对图片、扫描件、PDF等多类型载体的文字信息进行提取转换,可处理发票、合同、证件、表格等多种形态的文档内容,帮助用户完成文档信息的高效录入、整理与分析,适用于办公场景信息提取、批量文档数字化、财务票据核验、档案归档整理等多种使用场景。

doc2x.noedgeai.com
Doc2X是专注于多格式文档智能解析与转换的在线AI工具,核心定位为低门槛文档结构化处理平台。核心功能包括支持扫描件、PDF、图片类文档的文字与版式识别,可将非结构化文档转换为可编辑的Word、Markdown、Excel等格式,同时支持公式、表格、复杂排版的精准还原。目标用户覆盖学生、科研人员、办公职员、内容编辑等需要处理各类文档的群体,可应用于文献整理、办公文档编辑、扫描件信息提取、课件内容二次编辑等多种场景,无需复杂配置即可在线完成文档处理操作。

imagetotext.cc
imagetotext.cc是一款专注于在线OCR文本提取的服务网站,核心定位是为用户提供无需下载安装的网页端图像转文字处理服务。网站支持从各类常规图像格式中提取可编辑文本,同时支持转换为多种可导出格式,满足不同用户的文本提取需求。网站支持批量上传处理,支持多语言识别,无需注册即可使用基础功能。目标用户包括内容创作者、办公行政人员、在校学生、数据整理人员、文案编辑、科研工作者等,适用于扫描文档文字提取、图片截图文字转写、手写笔记数字化、书籍内容整理、会议截图文字归档等多种使用场景。

npmjs.com
llama-ocr是一款开源npm库,核心定位为基于Llama 3.2 Vision模型的光学字符识别工具,可帮助开发者快速集成文本识别能力到项目中。核心功能包括支持本地与远程图像的OCR识别、提供免费与付费两种接口调用方案、后续规划支持PDF格式文件的内容提取,项目设计受Zerox启发,整体结构轻量化易集成。目标用户覆盖前端开发人员、Node.js后端开发者、小型工具开发团队等,可应用于文档数字化、图像内容转写、批量文本提取、小票信息录入等多种开发场景,降低OCR功能的接入门槛。

ubiai.tools
UBIAI是专注于文本领域的数据标注平台,支持多类型文本数据的标注、模型训练与部署全流程管理。平台内置OCR文本提取能力,可从扫描件、图片类文档中识别文本内容;搭载自动化标注功能,可通过学习用户标注习惯降低重复工作量;支持多语言标注,覆盖希伯来语、日语、阿拉伯语、印地语等数十种语言。平台面向NLP算法工程师、数据标注团队、行业数据分析人员,适用于医疗记录分析、金融文档处理、多语种内容审核、智能客服语料标注等多个场景,帮助用户标准化文本数据处理流程,提升标注效率。

datalab.to
Datalab.to是专注于文档智能处理的开源AI工具平台,核心定位是为开发者、企业及相关从业者提供高性能的文档处理AI模型服务。平台核心功能包括高精度OCR识别、文档布局智能分析、PDF格式转Markdown导出,支持批量处理多类型文档文件。目标用户覆盖学术研究人员、企业办公人员、内容运营人员、前端开发人员、数据处理工程师等,可应用于学术文献批量整理、企业合同数字化归档、扫描文档内容提取、旧文档格式转换等多个场景,帮助用户降低文档处理的人力投入,提升内容流转效率。

datavlab.ai
DataVLab是专注于为多个行业提供人工智能数据标注服务的平台,核心业务覆盖文本、图像、视频多模态数据标注,支持定制化标注需求开发,对接算法训练全流程。平台提供标注工具部署、标注团队管理、数据质量校验等服务,可满足不同规模的人工智能模型训练数据需求。目标用户包括人工智能算法团队、自动驾驶研发企业、计算机视觉创业项目、自然语言处理研究机构等,适用于模型训练数据准备、已有数据集清洗校正、定制化数据采集标注等场景。

deepengin.com
DeepEngin是一个提供全方位图像与视频内容审查API服务的平台,面向企业开发者与产品团队提供自动化内容合规检测能力。核心功能包含图像违规内容检测、视频帧多维度审查、自定义违规规则配置、调用数据统计分析与批量内容处理,可帮助平台快速完成用户生成内容的合规校验,降低人工审核成本,满足互联网内容社区、短视频平台、电商平台等场景下的内容安全监管需求。

srefhunt.com
SrefHunt是一个面向AI绘画创作者的社区平台,核心为Midjourney用户提供风格参考代码与创意提示词分享服务。平台支持用户上传分享自己使用的有效Midjourney风格参考链接,也可搜索浏览他人分享的创意素材,还能对内容进行点赞收藏与分类整理。目标用户涵盖AI绘画爱好者、专业视觉设计师、内容创作团队等,适合创作者寻找绘画灵感、复用成熟风格参考、交流AI绘画创作经验的场景。

imaginprompt.com
ImaginPrompt: Image to Prompt是一款专注于AI图像逆向生成提示词的在线工具,核心定位是为AI绘画用户提供跨平台适配的提示词转换服务。支持上传本地图片或输入图片URL进行分析,生成匹配Midjourney v6、DALL-E 3、Stable Diffusion、Flux.1等主流绘画模型的提示词,还可根据需求调整提示词的风格权重、细节丰富度参数。目标用户涵盖AI绘画创作者、平面设计师、新媒体运营人员等,适用于复刻参考图风格、优化现有绘画提示词、批量生成同系列创作思路等场景,帮助用户降低提示词撰写门槛,提升AI绘画的产出匹配度。

faceshapedetector.ai
Face Shape Detector是一款基于人工智能技术的脸型分析工具,核心定位是通过人脸图像识别为用户提供精准的脸型判定及个性化外形建议。核心功能包括AI脸型自动识别、适配发型推荐、妆容风格匹配、配饰穿搭参考四类,支持用户上传自拍或实时拍摄完成检测。目标用户覆盖普通消费者、美妆从业者、发型设计师、穿搭博主等群体,可用于个人形象改造参考、美妆服务前置沟通、发型设计方案预选、穿搭内容创作素材收集等多种场景,帮助用户降低外形风格试错成本。

yunkaoai.com
Yunkao AI是一款基于人工智能技术搭建的在线考试平台,面向各类机构及个人用户提供在线考试全流程服务,核心功能包含智能监考防作弊、智能组卷、自动判分、成绩分析等。能够满足企业招聘考核、培训机构测评、学校日常考试、行业资格认证等多种场景的在线考试需求,借助AI技术降低线下组织考试的成本,提升考试组织和管理的效率

iris.fun
Iris是运行在macOS系统上的本地ChatGPT客户端工具,为用户提供系统级快速访问ChatGPT服务的入口,集成多场景辅助功能,支持自定义配置与多账号管理,面向需要日常使用ChatGPT开展工作与学习的macOS用户打造,支持全局快速唤起、多模型切换、对话内容本地存储、自定义快捷键与界面样式、剪藏整合对话等核心功能,可应用于办公间隙快速查询信息、写作过程中辅助生成内容、学习时整理知识点、开发时查询代码片段等多种场景,帮助用户在不切换浏览器的情况下完成各类交互。

imagetotext.io
Image to Text converter是一款基于OCR技术的在线图像转文本工具,支持从各类图片文件中提取可编辑的文字内容,无需下载安装客户端即可直接在浏览器中使用。核心功能包含多语言文字识别、手写文字识别、批量图片处理、结果直接编辑导出等,面向需要将图像文字转换为可编辑文档的用户,适用于扫描文档提取文字、手写笔记数字化、截图文字提取、书本内容录入等多种场景。

renamer.ai
Renamer.ai是一款依托AI技术实现文件智能重命名与整理的在线工具,核心定位是帮助用户解决文件命名混乱、批量整理效率低的问题。网站核心功能包括读取文件实际内容生成适配名称、批量处理多格式文件、支持自定义命名规则,可同步生成重命名后的下载包。目标用户覆盖办公人员、内容创作者、摄影师、学生、运营人员、档案管理员等,可应用于本地素材整理、工作文档分类归档、摄影照片重命名、网络下载文件整理、学术资料分类存储等多种场景,帮助用户优化文件管理流程,提升文件查找效率。

jpgtotext.com
jpgtotext.com是一款专注于图像文本提取的在线OCR工具,核心定位为无需下载安装即可直接在浏览器中完成各类图像到可编辑文本的转换。该工具支持多种常见图像格式的文本识别,可自动识别多国语言内容,还提供基础的文本编辑功能,识别结果支持多种格式导出。工具适合需要从图片中提取文字的办公人员、学生、内容创作者等用户,可应用于扫描文档数字化、图片文字摘抄、手写笔记整理、名片信息录入等多种场景。

imagetotext.me
imagetotext.me是一款基于浏览器运行的在线OCR文本识别工具,核心定位是帮助用户无需下载安装客户端,直接从各类图像中提取可编辑文本内容,无需注册账号即可使用。核心功能包含批量图像文本识别、多语言文本识别、识别结果在线编辑、多种格式导出等,支持手写体、印刷体等多种文本形式识别,适配学习、办公、信息整理等不同场景下的文本提取需求,用户可直接在网页端完成从识别到导出的全流程操作。

imagetotext.info
ImageToText.info是一款在线OCR文字识别工具,核心定位为帮助用户从各类图像文件中提取可编辑的文字内容。该工具支持多种常见图像格式的识别处理,可识别手写文字、印刷体文字,也能处理包含多栏文字的复杂图像,无需下载安装客户端软件,打开浏览器即可使用。目标用户包括学生、办公人员、文案编辑、内容创作者、图书馆工作人员、内容运营等,适用场景有扫描书本内容转文字、截图文字提取、手写笔记数字化、图片菜单转可编辑文本、老照片文字存档等。

olocr.com
OLOCR是一款提供免费在线文字识别服务的平台,支持对图像和PDF文件进行文字提取。核心功能包括多语种文字识别、批量文件处理、可识别多种格式内容、保留原排版格式、提供直接复制导出选项。目标用户包含需要提取论文文字的学生、整理扫描文档的办公人员、需要录入书籍内容的文字工作者等。可用于扫描文档转可编辑文字、图片截图文字提取、多页PDF批量文字识别、外文资料文字提取等场景。

handocr.com
HandOCR是一款专注于文字识别与文本处理的AI在线工具,核心定位为无需下载安装的云端文字识别处理平台,支持将图片、PDF中的手写与印刷文字转换为可编辑文本,同时内置AI文本摘要和文本改写功能,支持多语言识别输出。核心功能包含图片OCR识别、PDF文字提取、AI文本摘要、AI文本改写、多语种识别适配。目标用户覆盖学生、办公人员、文字工作者、研究者等群体,适合课堂笔记整理、办公文档数字化、文献资料录入、手写稿件转电子档等使用场景,帮助用户降低文字录入的工作量,提升文本处理效率。

artpromptsgen.com
Midjourney SREF Codes Library是一个面向AI绘画创作者,专注于收集整理Midjourney平台SREF代码与绘画提示词的资源库网站,同时提供AI辅助生成工具与使用指南。网站核心功能包含SREF代码检索、提示词生成、风格参考库整理、使用教程整合,支持创作者快速查找符合创作需求的参考代码,优化Midjourney绘画生成效果,适用于AI绘画创作时查找风格参考、生成精准提示词、学习SREF代码使用方法等场景。

imagetotext.cfd
Image to text是专注于图片文本提取的在线工具,核心定位为用户提供无需下载安装的轻量OCR识别服务。它支持多格式图片上传识别,可自动识别多国语言文本内容,还能对识别结果进行在线编辑校对。目标用户覆盖办公人群、学生群体、内容创作者、档案整理人员等,适用于纸质文档电子化、截图信息提取、印刷资料转录、外文内容识别等多种场景,能够帮助用户降低手动录入文本的时间成本,提升信息整理效率。

gitee.com
JavaVision是面向Java开发者的视觉智能识别开源项目,基于SpringBoot框架搭建,整合了PaddleOCR-V4文字识别、YoloV8物体识别、人脸识别、以图搜图等核心AI能力,同时支持灵活拓展语音识别、动物识别等多类AI场景。项目主打低门槛集成特性,开发者无需从零搭建AI算法链路,依托Java生态即可快速将视觉识别能力嵌入自身业务系统,适用于企业管理系统文字提取、安防场景异常检测、电商平台商品图片检索等多类开发场景,可帮助Java开发者降低AI应用开发的技术门槛。