AudioDoc 对比 Deep Voice 3

在 AudioDoc 和 Deep Voice 3 的对决中,哪个 AI Text to Speech (TTS) 工具脱颖而出?我们比较评论、定价、替代品、赞成票、功能等等。

AudioDoc 和 Deep Voice 3,哪一个更优?

当我们比较AudioDoc和Deep Voice 3时,这两个都是AI驱动的text to speech (tts)工具, 就赞成票而言,没有明显的赢家,因为这两种工具都获得了相同的数量。 成为决策过程的一部分。您的投票可能决定获胜者。

感觉叛逆?投票并搅动事情!

AudioDoc

AudioDoc

什么是 AudioDoc?

AudioDoc 将文档和粘贴的文本转化为可在浏览器中听的音频。上传 PDF、EPUB 或 markdown 文件,或者将原始文本粘贴到 TTS 工作室,即可听到由自然声音播讲。无需注册账户、订阅或信用卡验证即可开始使用。

文档库在生成音频的同时,按章节流式播放长文件,因此你无需等待整本书转换完成即可开始播放。另有一个专用的 TTS 工作室,支持快速粘贴并听取,同时提供可下载的录音片段,无水印。

它适合通勤者,希望li听文章、学生复习课程、作家校对草稿,或者任何需要免手操作或无障碍访问书面资料的人。访客会话持续24小时;注册的免费账户可以保存你的文档库和收听进度,超出此时间后仍可继续使用。

Deep Voice 3

Deep Voice 3

什么是 Deep Voice 3?

Deep Voice 3 是百度研究所基于 PyTorch 的开源实现,重现了 Deep Voice 3 文本转语音模型。它复现了卷积序列学习的可扩展神经 TTS,并提供预训练的 checkpoint 以及单 speaker 和多 speaker 的音频演示。

该项目包括在 LJSpeech 上训练的单 speaker 合成模型,以及在 VCTK 数据集上训练的 108 speaker 多 speaker 生成模型。演示页面托管了示例音频片段、注意力图以及预训练权重的 GitHub 链接。

该项目面向希望拥有 Deep Voice 3 参考实现的研究人员和开发者,而非托管语音 API。训练脚本、推理代码以及社区贡献均托管在公开的 GitHub 仓库中。

AudioDoc 赞同数

6

Deep Voice 3 赞同数

6

AudioDoc 顶级功能

  • 上传 PDF、EPUB 或 markdown 文件,逐章串流音频

  • 在 TTS 工作室粘贴最多 1000 个单词,立即播放

  • 包含美式、英式、日语和中文旁白声音

  • 下载生成的音频文件,无水印

  • 无需注册或信用卡即可作为访客开始使用

  • 记住播放进度,支持移动浏览器,无需应用

Deep Voice 3 顶级功能

  • Deep Voice 3 卷积序列 TTS 的 PyTorch 实现

  • 在 LJSpeech 上训练的预训练单一说话人模型,附带公开音频样本

  • 支持 108 位说话人的多说话人 VCTK 模型,含演示音频片段

  • GitHub 上的开源代码和预训练检查点

  • 带有注意力可视化和参考论文链接的演示页面

AudioDoc 类别

    Text to Speech (TTS)

Deep Voice 3 类别

    Text to Speech (TTS)

AudioDoc 定价类型

    Free

Deep Voice 3 定价类型

    Free

AudioDoc 使用的技术

Next.js
Google Analytics
Google Tag Manager
Ruby
Webpack
Tailwind CSS

Deep Voice 3 使用的技术

Cloudflare
Google Cloud
Google Analytics
Google Fonts
GitHub
Emotion

AudioDoc 标签

Text to Speech
Audiobooks
PDF Reader
Accessibility

Deep Voice 3 标签

text to speech
PyTorch
open source
neural TTS
speech synthesis
By Rishit