Smallest AI 是一个实时语音平台,专为构建生产级语音代理和音频API而设计。团队使用它部署对话式电话代理,执行外呼活动,并快速集成文本转语音、语音转文本和语音转换模型到他们的产品中。它的目标用户是需要在医疗、债务催收、房地产、电子商务以及其他电话密集型工作流程中实现低延迟大规模语音处理的开发者和企...
AudioDoc 将文档和粘贴的文本转化为可在浏览器中听的音频。上传 PDF、EPUB 或 markdown 文件,或者将原始文本粘贴到 TTS 工作室,即可听到由自然声音播讲。无需注册账户、订阅或信用卡验证即可开始使用。 文档库在生成音频的同时,按章节流式播放长文件,因此你无需等待整本书转换完成即可开始...
Noiz AI 是一个面向创作者的文本到语音和语音设计平台,旨在提供听起来自然而非机械的语音。你可以将脚本转化为配音音频,从短样本中克隆一个声音,或者通过文本或图像创造新声音,然后加入情感、音效以及多语言配音,适用于播客、视频和有声书。 其V2 Emotion Pro模型专注于呼吸、节奏和情感表现。你可以...
Rekam AI 是一个音频工作平台,能够将文本转换为逼真的语音、转录录音,并从短样本中克隆定制的声音。你可以无需信用卡,即刻使用免费的文本转语音和语音转文本工具;当需要扩展时,也可以升级到高端语音、声音设计和大批量制作。它专为需要配音、播客、教程、有声书和产品演示的创作者设计,提供一站式平台。 无需在不...
FineVoice 利用先进的人工智能技术,使用户能够快速创建逼真且类人化的语音和音频内容。它支持超过 154 种语言的 1,500 多种声音,适用于播客、视频、有声书、电子学习等多种场景。 FineVoice 的独特之处在于其即时语音克隆功能,用户只需 10 秒音频即可在 30 秒内复制任何声音。它还提...
ListenHub 是一个创作工作室,可以将文本和文档转换为可发布的音频、图像和视频,所有操作均可通过一个网页仪表盘完成。主页将工具分为 AI 播客、文本转语音、语音克隆、AI 视频、解说视频、AI 图像生成和 AI 幻灯片,新用户注册时可获得 10 次免费的 GPT-Image-2 生成次数。您选择输出类...
PodLM 将网址、粘贴的文本和文档转换为带有脚本和配音的播客,无需录音棚。您选择输入内容,服务会起草节目脚本,应用带有可选多说话人声音的 AI 旁白,并允许您下载完成的音频或通过内置分发助手发布。 NotebookLM 推广了文档转音频摘要,但 PodLM 将自己定位为专用的播客生成器,具备封面艺术、脚...
Sound Effect Generator 将文本提示转换为视频、游戏和播客的定制音频剪辑。使用 Google 登录,描述一个声音,比如鼓点循环或门铃声,然后几秒钟内即可从浏览器下载生成的文件。 库存库让你需要搜索成千上万的通用剪辑。Sound Effect Generator 允许你准确输入所需内容,...
AnyVoice 从3秒的音频样本克隆说话者的声音,并将输入的文本转换成听起来像他们的语音。您可以在浏览器中上传一段简短录音,或从包含数千个预制声音的社区库中选择。三种模式涵盖文本转语音、声音克隆和声音设计,用于构建无需参考音频的新声音。 3秒克隆门槛是其突出特点。大多数声音克隆工具需要30秒或更长时间的...
Rime 构建企业级音频生成模型,应用于对话式电话和应用体验中,延迟和语调决定了来电者是否继续通话。该平台提供600多种声音,支持银行、医疗、酒店和点餐场景中的口音、语速和正式程度控制。客户反馈生产环境中首字节时间低于100毫秒,实现实时对话。 通用文本转语音系统在实时通话中声音单调,且品牌名称发音不准确...
ChatQuick 可以将文字材料转化为音频。只需粘贴文稿、上传笔记,或者从一个主题开始,然后选择声音和语气,生成器即可返回播客节目、有声书章节、引导式冥想或简短的音频广告。文件可导出为 MP3 或 WAV 格式,适用于 Spotify、Apple Podcasts 或 Audible。 它的独特之处在于...
Tami Reader 将 PDF 转换为互动学习会话,您可以与文档对话、生成摘要、构建思维导图,并通过文本转语音功能收听。该 PDF 阅读助手还可以从上传的文件创建学习指南和测验,跟踪阅读目标,并内置文档编辑器。免费账户支持最大 10MB 的文件,付费等级将上限提高到 50MB 或 100MB。 Cha...
Voicv 通过 10 到 30 秒的样本克隆说话者的声音,然后将该模型用于文本转语音、语音转文本和会说话的虚拟形象视频。你只需上传一段简短的录音,从支持的八种语言中选择一种,即可生成保留原音频音高、音调和节奏的新语音。 大多数语音工具将克隆或文本转语音功能分开销售。Voicv 将零样本克隆、转录和虚拟形...
Shorts Ninja AI 将脚本转换为无面孔的短视频,并能直接安排发布到 TikTok 和 YouTube。您可以选择配音、视觉风格和音乐,平台随后使用 Flux、Kling 和 Luma Labs 等模型生成场景。每次渲染会消耗积分,完成一分钟视频大约需要 10 积分。 大多数 AI 视频制作工具...
Vogent是一个一站式平台,用于构建、测试和部署处理真实电话的语音代理。团队可以借助它,从一个想法直接实现上线,无需组装单独的语音、检测、路由和电话工具。 该平台在拖拽式的Flow Builder背后整合了IVR检测、语音活动检测、定制语音和会话流程路由。开发者还可以引入兼容OpenAI的模型,在通话过...
Inpodcast AI 是一个基于浏览器的播客工作室,可将文档、剧本和平面文本转换为私有音频剧集。您上传 PDF、Word、Markdown 或 TXT 文件,编写剧本或粘贴文本,然后选择音色、语言、时长和背景音乐,最后生成可下载的播客音频。工作流程涵盖文档转播客、剧本转播客以及独立文本转语音,全部在一个...
Arting.ai 在其 Arting AI 平台内集成了一个明星风格的语音生成器。在文本转语音页面,您可以输入文本,从包括明星风格选项的语音模型库中选择,并生成可下载的音频。相同的工作空间还涵盖图像、视频、聊天和学习工具,但本次介绍重点是语音部分。 TTS 工具宣称具有自然听感的输出,支持语音克隆、可定...
FineVoice AI语音克隆是FineVoice平台中的一项云语音克隆功能。它通过短音频样本建立数字化的语音复制品,捕捉语调、口音、音色和说话风格,使得新生成的语音听起来像原始说话者。 你可以选择即时语音克隆,利用大约10秒的音频在30秒内获得结果;或者选择专业语音克隆,获得更丰富的情感和细腻的表达。...