输入关键词搜索 AI 工具、分类,或直接跳转页面
Tonic Textual是面向大语言模型开发场景的安全数据湖仓工具,核心定位是帮助企业处理非结构化数据以支撑生成式AI落地。其核心功能包括非结构化数据自动化提取治理、敏感信息自动去标识化、合成数据语义保真生成。目标用户覆盖企业AI研发团队、数据合规部门、数据工程团队等,可应用于大语言模型训练数据集搭建、非结构化数据隐私合规处理、企业内部知识库安全构建、AI应用推理数据预处理等多种场景,助力企业在符合数据合规要求的前提下高效完成AI相关的数据准备工作。
访问Tonic Textual官方网站,根据企业所用的云服务生态,选择对应云市场渠道或者官网直接注册账号,完成企业资质验证和服务开通,获取平台的使用权限。
进入平台的数据源配置页面,按照指引绑定企业对应的云存储服务,配置数据读取的权限、需要提取的数据路径和格式筛选规则,确认后启动数据自动提取任务。
在数据治理模块设置敏感信息识别规则,选择需要识别的敏感实体类型,以及对应的去标识化处理方式,系统会自动对提取到的非结构化数据完成敏感内容处理。
若需要生成合成数据,可在合成功能模块选择对应的数据批次,设置合成数据的规模、语义相似度要求等参数,提交任务后等待系统完成合成数据的生成。
处理完成后的数据可直接导出,也可配置对接至企业的大语言模型训练平台、知识库系统等下游工具,同时可在审计模块导出全流程的处理记录用于合规核查。
看完教程,直接上手试试
访问 Tonic Textual 官网