输入关键词搜索 AI 工具、分类,或直接跳转页面

amazon.science
BASE TTS是亚马逊推出的大规模文本转语音合成模型展示站点,核心定位是呈现大参数TTS模型的语音合成效果。站点内置多场景语音合成样本展示、不同参数模型效果对比、跨语言语音合成演示三大核心功能,面向人工智能研究人员、语音技术开发者、内容创作从业者、语音交互产品设计者等群体,可用于学术研究参考、技术选型对比、合成语音效果测试、多语言语音产品原型验证等场景,帮助用户直观了解大参数TTS模型的技术特性与实际表现。

github.com
StyleTTS 2是一款开源文本转语音(TTS)模型项目,核心定位为通过语音语言模型与扩散技术实现高自然度语音合成。其核心功能包括无参考语音的风格自适应生成、端到端对抗训练提升语音自然度、多场景零样本语音合成。目标用户覆盖AI语音研发人员、音视频内容创作者、有声读物制作团队、语音交互产品开发者等。可用于有声读物批量制作、虚拟数字人语音生成、智能客服语音系统搭建、多语言语音内容生产等场景,为语音合成相关开发与创作提供可落地的技术方案。

smallest.ai
Lightning是smallest.ai推出的文本转语音模型服务页面,核心定位是为有语音合成需求的用户提供低延迟、轻量化的语音生成解决方案。核心功能包括多口音语音合成、高并发低延迟音频生成、自定义场景适配,支持英语、印地语等多种口音,后续会逐步扩展更多语言覆盖。目标用户覆盖语音机器人开发企业、有声内容创作者、多语言客服平台运营者、出海应用开发者等群体,适用于实时语音交互场景、有声读物批量制作、多语言客服应答生成、出海产品语音功能搭建等多个使用场景,能够帮助用户降低语音合成环节的延迟与运营成本。

outeai.com
OuteTTS-0.1-350M是OuteAI推出的基于纯语言模型的文本转语音合成模型产品页,核心定位为展示低参数轻量型TTS模型的技术方案与应用价值。该模型以LLaMa架构为基础,仅用350M参数即可实现高质量语音输出,支持语音克隆、多格式适配等核心功能,面向AI技术开发者、语音应用开发者、语音技术研究人员、内容创作从业者等群体,可用于语音类产品原型开发、语音技术研究实验、有声内容批量制作、轻量设备语音功能部署等场景,帮助用户降低TTS技术落地的资源门槛。