输入关键词搜索 AI 工具、分类,或直接跳转页面
收录各类AI语音生成器工具

slayerai.com
Slayer AI是专注于AI音频内容生成的在线平台,核心围绕自定义音频创作需求打造,支持音频故事、播客、冥想音频三类核心内容生成,还提供风格定制、多音色选择、内容导出等配套功能。目标用户覆盖内容创作者、冥想内容从业者、播客运营者、有声读物爱好者、教育工作者等群体,可应用于个人休闲音频制作、商业播客内容产出、冥想课程素材制作、儿童睡前故事生成、教学音频资源搭建等多个场景,用户无需专业音频录制设备和后期技能,即可通过文字指令生成符合需求的音频内容。

lovevoice.ai
Lovevoice AI是一个基于人工智能技术的语音合成平台,支持多语言多音色的文本转语音服务,可生成接近真人发音的音频内容。核心功能包含多音色语音生成、跨语言语音合成、SSML自定义参数调整、音频格式导出、长文本批量处理等,支持用户根据使用需求调整语音细节。主要面向内容创作者、跨境运营人员、教育工作者等有语音制作需求的用户,可应用于自媒体内容配音、视频旁白制作、多语言学习资料音频生成、有声读物录制等场景。

kid-voices-ai.com
KidVoice是一款专注于少儿语音生成的AI工具,依托大语言语音模型实现自然流畅的儿童与青少年语音合成输出,核心功能支持多年龄段儿童音色选择、多语言语音生成、语速语调自定义调整、音频格式导出、文本批量转语音,面向内容创作者、教育工作者、家长等人群,可用于制作儿童有声读物、英语启蒙音频、动画配音、亲子故事音频等多种场景,满足不同领域对少儿语音内容的创作需求。

terrakotta.ai
Terrakotta是一款AI驱动的网络电话服务平台,核心定位为面向商业场景提供智能语音交互与商业地产信息整合服务,支持个性化语音邮件处理、商业地产寻源匹配两大核心业务。平台通过AI技术自动处理来电,生成定制化语音邮件,同时为商业地产业内人士整合房源数据,提升沟通与寻源效率。目标用户涵盖商业地产经纪人、中小型企业管理者、自由职业者、租赁顾问、投资机构分析师等群体,可用于日常业务来电处理、商业地产房源搜寻对接等多种场景。

seedaudioai.ai
Seed Audio是一个专注于AI语音、演讲音频与音乐内容生成的生产级API平台,同时面向普通用户与开发者提供AI音频技术的使用指南与接入支持。平台支持文本转语音自然生成、演讲音频优化、AI音乐创作等核心能力,可帮助开发者快速集成音频生成能力到自有产品,也可帮助内容创作者快速产出符合需求的音频内容。适合AI应用开发者、内容创作者、音频制作从业者在产品开发、内容产出、项目制作等场景中使用。

anyspeech.io
AnySpeech是一款在线AI语音处理平台,核心定位为面向内容创作者与企业团队提供文字转语音、声音克隆等音频生成服务,帮助用户完成各类数字内容的配音创作。平台支持文本一键生成自然流畅的AI语音,提供多风格多语种音色选择,同时支持自定义AI声音克隆,满足不同场景下的声音一致性需求。目标用户涵盖内容创作者、营销人员、教育工作者、企业内容团队等,适用于视频配音、播客内容制作、课程音频制作、产品演示配音等多种使用场景,替代传统手动录音剪辑流程,提升音频内容制作效率。

aethexai.com
AethexAI是专为新兴市场打造的本地化语音智能体AI平台,核心定位是为开发者和企业提供适配区域语言与文化需求的语音AI解决方案。平台支持自定义语音智能体创建,提供本地化模型训练工具,可将训练完成的语音智能体部署到多终端设备,支持语音交互场景的二次开发。目标用户包括新兴市场的AI初创企业、应用开发者、本地化服务提供商,适用场景包括本地语音客服机器人开发、区域语言语音助手构建、线下语音交互终端适配等。

tts-generator.com
TTS-Generator.com是一个基于AI技术的在线文本转语音转换平台,面向有语音内容制作需求的用户提供免费转换服务。平台支持多国家多语言文本转换,内置多种不同风格的自然音色,可在线调整输出语音的语速、语调参数,转换完成后可直接下载音频文件。核心功能包括在线文本转语音、多语言音色选择、参数自定义调整、音频直接下载,适合内容创作者、教育工作者、新媒体运营等用户在快速制作语音内容的场景中使用。

voispark.com
VoiSpark是一个专注于AI语音生成服务的在线平台,提供文本转语音、语音克隆、自定义语音创建等多种AI语音处理功能。核心功能支持多语言多音色语音输出,可复刻指定人物语音特征,也支持用户调整语音的各项参数生成专属语音。目标用户包括内容创作者、配音从业者、自媒体运营者、教育内容开发者和企业营销人员,适用于短视频配音、有声书制作、视频旁白生成、广告配音、个性化语音助手训练等多种使用场景。

nepvox.com
Nepvox AI是一个集成语音处理与图像生成的综合性AI创作平台,核心提供文本转语音、语音转文本、文本转图像三类AI生成服务,同时开放API接口支持二次开发,面向内容创作者、开发者、自媒体从业者等群体,可满足播客节目配音、自媒体内容脚本整理、营销素材生成、产品功能集成、有声书制作等多种使用场景,兼顾在线工具快速使用与开发者集成需求,结合稳定的生成效果与透明的定价体系,为不同需求的用户提供AI生成服务。

vocospeech.com
VocoSpeech是一款专为Mac平台设计的离线AI语音生成与声音克隆应用,用户无需联网即可完成所有语音处理操作,保障音频数据隐私安全。核心功能包含单/多人声音克隆、多风格文本转语音生成、音频导出管理、语音参数自定义调整等,支持个人创作者、内容运营人员、配音从业者等不同用户群体使用,可满足有声书制作、视频配音、个人语音助理定制、播客内容生产等多种场景的语音处理需求。

untitledpen.com
UntitledPen是一个集成了AI配音、内容写作、文稿编辑与文本朗读功能的综合AI内容创作平台,支持用户一站式完成从内容创作到音频生成的全流程工作。核心功能包含多风格AI写作、高拟真文本转语音配音、文稿智能润色编辑、多语言内容朗读、自定义语音参数调整等,面向内容创作者、自媒体运营人员、学生、商务办公人员、配音从业者等群体,可满足自媒体脚本创作、有声书制作、课件音频生成、商务文稿润色、外文内容朗读等多种使用场景。

make-an-audio-2.github.io
Make-An-Audio 2是由浙江大学、字节跳动、香港中文大学联合研发的文本到音频生成技术官方展示站点,核心定位为面向学术研究与创意开发群体的音频生成技术演示平台。核心功能包括文本语义解析转音频、变长音频生成、音频时间一致性优化、音频生成效果对比展示。目标用户覆盖音频领域研究人员、AI技术开发者、内容创作从业者、高校计算机相关专业师生。使用场景包括学术研究中的技术效果验证、内容创作前期的音效小样生成、AI音频技术开发的算法参考、高校相关课程的技术案例演示。

tangoflux.github.io
TangoFlux是开源的文本到音频(TTA)生成模型平台,核心定位是为音频生成领域的研究者、开发者提供高效、对齐能力强的音频生成技术方案。核心功能包括基于CRPO框架的高对齐度文本转音频生成、30秒44.1kHz高音质音频快速生成、全开源的模型与代码资源开放。目标用户覆盖音频领域研究者、AI应用开发者、内容创作者、高校计算机相关专业学生等,可用于学术研究验证、音视频内容音频素材生成、AI音频应用原型开发、课程实践项目搭建等场景。

wois.io
Wois是一款面向全球用户的人工智能内容创作与人脉连接平台,核心定位是帮助用户生成真实音视频内容、沉淀数字资产、拓展跨领域专业人脉。平台支持自主引导式访谈录制,可生成自然流畅的个人音视频内容用于个人品牌搭建,同时提供数字胶囊存储功能,可永久留存个人故事、想法与回忆,还内置全球专业人士网络,支持不同领域用户互动交流。目标用户覆盖内容创作者、职场人士、行业专家、普通个人用户等,可应用于个人品牌运营、专业人脉拓展、数字遗产留存、跨领域经验交流、远程访谈内容生产等多个场景。

juststoryit.net
Just Story It是基于AI技术的音频故事创作平台,核心定位是帮助用户将文字创意转化为可收听的音频故事内容。平台支持用户自定义创建角色、设定故事环境,可选择不同故事流派、生成时长,还支持输入自定义情节方向完成内容创作,同时内置公共故事库供用户浏览收听他人创作的内容。目标用户覆盖故事创作者、有声内容爱好者、亲子教育从业者等群体,可用于个人创意表达、亲子有声读物制作、内容创作者音频素材产出等多种场景。

jasonppy.github.io
VoiceCraft是基于令牌填充技术的神经编解码器语言模型工具站,核心定位为面向音频创作、语音处理相关从业者与爱好者的语音编辑与生成服务平台。核心功能包含零样本语音克隆、上下文感知语音编辑、多场景语音生成三类,支持用户上传短语音样本快速复刻对应音色,也可针对已有录音精准修改局部内容,无需重新录制完整音频。目标用户覆盖音频内容创作者、播客主播、有声读物制作人、视频剪辑师、AI语音研发人员等群体,适用于有声读物内容纠错、播客口误修正、视频旁白音色统一、小语种语音素材生成、虚拟角色语音定制等多种场景,帮助用户降低音频内容制作的时间与人力成本。

roletts.com
Roletts是专注于AI语音内容创作的一站式工作平台,核心定位是为创作者提供从语音生成到数字人输出的全链路解决方案。平台支持多语种文本转语音、自定义语音参数设计、声音克隆以及数字人口播视频导出等核心功能,面向内容创作者、短视频制作者、教育从业者、企业营销人员等用户群体,可满足有声书制作、短视频配音、教学课件录制、品牌宣传视频生成等多场景的内容创作需求,帮助用户降低语音类内容的制作成本,提升内容产出效率。

voxumi.com
Voxumi是一款AI语音工作室工具,核心为用户提供语音生成、克隆及编辑相关的一站式服务。其核心功能包括文本转语音生成、自定义语音克隆、可视化语音编辑,同时支持多场景语音效果设计。工具面向内容创作者、音频从业者、影视制作人员、教育课程开发者等群体,可满足短视频配音、有声书制作、课程旁白录制、影视角色配音、虚拟数字人语音生成等多场景的语音制作需求,无需专业音频设备即可完成多样化语音内容产出。

aijinglemaker.net
AI Jingle Maker是一款专注于音频内容生成的AI工具,核心定位是通过人工智能技术将文本内容转化为可直接用于传播的音频素材。其核心功能包括AI语音生成、智能配乐匹配、广播级音频输出,支持用户快速制作电台短广告、台标标识、节目开场白、赞助商口播等内容。目标用户覆盖电台运营人员、播客创作者、自媒体博主、品牌营销人员、活动策划者等群体,可广泛应用于电台内容制作、播客节目包装、短视频片头制作、品牌活动宣传、商业广告音频产出等多个场景,无需专业音频录制和剪辑基础,即可获得符合商用标准的MP3格式音频文件。