Murf AI 将文本、文档和脚本转换为逼真的语音,适用于视频、课程和电话客服。Murf Studio 提供 200 多种声音,涵盖 35 多种语言,支持音调、速度和发音控制,而 Falcon 文本转语音 API 针对实时语音代理,首音延迟低于 100 毫秒。Murf Dubbing 可将视频翻译成 40 ...
Smallest AI 提供实时语音代理及其底层音频模型:Lightning 文本转语音、Pulse 语音转文本、Electron 小型语言模型和 Hydra 语音转语音。团队可在浏览器沙盒中配置代理,连接电话或网页小部件,并通过 JavaScript、Python 或 REST 调用生产 API。 不同...
AudioDoc 将文档和粘贴的文本转化为可在浏览器中听的音频。上传 PDF、EPUB 或 markdown 文件,或者将原始文本粘贴到 TTS 工作室,即可听到由自然声音播讲。无需注册账户、订阅或信用卡验证即可开始使用。 文档库在生成音频的同时,按章节流式播放长文件,因此你无需等待整本书转换完成即可开始...
Noiz AI 将脚本转换为配音音频,可以从短样本克隆声音,或从文本或图像创造新声音,然后为播客、视频和有声书添加情感标签、音效和多语言配音。其 V2 Emotion Pro 模型注重呼吸、节奏和情感,而非单调的机器人式朗读。 大多数文本转语音工具在演示线路上效果不错,但长时间朗读时表现不佳。Noiz A...
Rekam AI 是一个音频工作平台,能够将文本转换为逼真的语音、转录录音,并从短样本中克隆定制的声音。你可以无需信用卡,即刻使用免费的文本转语音和语音转文本工具;当需要扩展时,也可以升级到高端语音、声音设计和大批量制作。它专为需要配音、播客、教程、有声书和产品演示的创作者设计,提供一站式平台。 无需在不...
Lalals将AI变声、文本转语音、音轨分离、音乐制作和母带处理整合到一个浏览器工作区中。您可以从3000多个声音中选择,将音轨拆分为最多23个声部,并在不切换不同应用的情况下制作完整歌曲。免费计划包括每月500个积分和访问10个声音的权限。 大多数创作者会分别购买变声器、音轨分离器和母带插件。Lalal...
SAM TTS 在浏览器中重现了 Windows XP 经典的 Microsoft SAM 文字转语音声音。输入一行文字,选择 Sam、Mike、Mary 或数十个 SAPI4 预设,调整音调和速度,然后预览或下载 WAV 文件,无需安装旧版 Windows 软件。 神经语音应用追求逼真效果,而 SAM ...
FineVoice Text to Speech 将书面脚本转换为富有表现力的音频,支持 154 种语言和口音中的 1500 多种声音。您可以粘贴文本、直接输入或导入 .txt、.docx 或 .srt 文件,然后在生成之前调整音调、速度、温度和情感标签。页面宣传无需注册即可在几秒钟内创建自然配音。 通用...
FineVoice 利用先进的人工智能技术,使用户能够快速创建逼真且类人化的语音和音频内容。它支持超过 154 种语言的 1,500 多种声音,适用于播客、视频、有声书、电子学习等多种场景。 FineVoice 的独特之处在于其即时语音克隆功能,用户只需 10 秒音频即可在 30 秒内复制任何声音。它还提...
Audio Converter AI 是一个基于浏览器的音频工作室,可以将录音、视频和社交链接转换为可编辑的文字稿,然后在同一工作区内叠加文本转语音、YouTube 工具和格式转换。支持上传 MP3、WAV、M4A、MP4 及其他常见格式,粘贴 YouTube 或 TikTok 链接,或在浏览器中录音。文字...
Santa Voice Generator by Fineshare 将书面节日文案直接转换为浏览器中的圣诞老人声音。粘贴文本或导入脚本,从 FineVoice 的库中选择 Santa 预设,无需安装桌面软件即可下载音频。该页面位于 FineShare 更广泛的 FineVoice 平台内,该平台还托管数千...
ListenHub 是一个创作工作室,可以将文本和文档转换为可发布的音频、图像和视频,所有操作均可通过一个网页仪表盘完成。主页将工具分为 AI 播客、文本转语音、语音克隆、AI 视频、解说视频、AI 图像生成和 AI 幻灯片,新用户注册时可获得 10 次免费的 GPT-Image-2 生成次数。您选择输出类...
Puretalk AI通过其RUTH助手平台为需要电话、网页聊天和短信处理但不想扩展呼叫中心的企业构建全渠道语音和文本代理。您可以使用无代码构建器或API创建能够预约、资格审核潜在客户并全天候回答常见问题的代理。同一套技术还包括专有的文本转语音引擎、用于外呼活动的批量呼叫功能,以及与日历和CRM的集成。 ...
TalePod 是一款儿童睡前故事应用程序,可以将孩子的名字、年龄和兴趣转化为带有柔和水彩插图的有声故事,制作时间不到一分钟。家长可以选择适合3至7岁儿童的六页漫画书,或带有绘画封面的较长章节故事,然后使用内置的文本转语音功能收听。 普通的故事应用只是将名字替换到相同的模板中。TalePod 提供两种不同...
PodLM 将网址、粘贴的文本和文档转换为带有脚本和配音的播客,无需录音棚。您选择输入内容,服务会起草节目脚本,应用带有可选多说话人声音的 AI 旁白,并允许您下载完成的音频或通过内置分发助手发布。 NotebookLM 推广了文档转音频摘要,但 PodLM 将自己定位为专用的播客生成器,具备封面艺术、脚...
Sound Effect Generator 将文本提示转换为视频、游戏和播客的定制音频剪辑。使用 Google 登录,描述一个声音,比如鼓点循环或门铃声,然后几秒钟内即可从浏览器下载生成的文件。 库存库让你需要搜索成千上万的通用剪辑。Sound Effect Generator 允许你准确输入所需内容,...
AnyVoice 从3秒的音频样本克隆说话者的声音,并将输入的文本转换成听起来像他们的语音。您可以在浏览器中上传一段简短录音,或从包含数千个预制声音的社区库中选择。三种模式涵盖文本转语音、声音克隆和声音设计,用于构建无需参考音频的新声音。 3秒克隆门槛是其突出特点。大多数声音克隆工具需要30秒或更长时间的...
Rime 构建企业级音频生成模型,应用于对话式电话和应用体验中,延迟和语调决定了来电者是否继续通话。该平台提供600多种声音,支持银行、医疗、酒店和点餐场景中的口音、语速和正式程度控制。客户反馈生产环境中首字节时间低于100毫秒,实现实时对话。 通用文本转语音系统在实时通话中声音单调,且品牌名称发音不准确...