SpeechGen
SpeechGen.io é um estúdio online de texto para fala com mais de 5.000 vozes neurais em 150 idiomas. Cole ou envie textos, escolha uma voz, ajuste velocidade, tom, volume e tags SSML, e depois exporte arquivos MP3, WAV ou FLAC sem precisar de assinatura mensal.
O editor suporta trabalhos de forma longa, conversão de legendas em áudio, importação de documentos e um fluxo de clonagem de voz que constrói uma voz personalizada a partir de uma amostra de áudio curta. O SpeechGen também realiza transcrição de áudio para texto de arquivos enviados, vídeos e links do YouTube, com exportação em SRT e VTT.
Novas contas recebem créditos gratuitos para testar a síntese, e uso adicional pode ser comprado em pacotes de créditos pontuais via pagamento por cartão ou PayPal. Uma API está disponível para desenvolvedores que desejam automatizar a geração dentro de seus próprios fluxos de trabalho.
Mais de 5.000 vozes de IA em 150 idiomas com controles de velocidade, tom e prosódia SSML
Pacotes de créditos Pay-as-you-go em vez de assinaturas recorrentes
Clonagem de voz a partir de amostras enviadas ou gravadas com tags de estilo e gênero
Ferramentas de texto para fala para legendas, DOCX e PDF, além de transcrição de áudio e YouTube
Exporta em MP3, WAV e FLAC com histórico de arquivos na nuvem na sua conta
Enorme catálogo de vozes com controle no nível SSML no editor do navegador.
Pacotes de créditos evitam o bloqueio recorrente de assinaturas.
Combina TTS, clonagem, transcrição e ferramentas de legendas em uma conta só.
A matemática de créditos pode ser confusa porque o mesmo saldo cobre tanto TTS quanto transcrição.
Clonagem avançada e trabalhos de longa duração consomem créditos rapidamente em pacotes menores.
Quantas vozes o SpeechGen oferece?
O SpeechGen lista mais de 5.000 vozes realistas de IA abrangendo cerca de 150 idiomas e sotaques regionais. Você pode navegar pelo catálogo completo na página AI Voices e ouvir amostras antes de gerar.
O SpeechGen é baseado em assinatura?
Não. O SpeechGen utiliza créditos no modelo pay-as-you-go. Você compra um pacote de créditos quando precisa de mais minutos de síntese ou transcrição, e os créditos não utilizados permanecem na sua conta.
Quais formatos de áudio o SpeechGen pode exportar?
A fala gerada pode ser baixada em MP3, WAV ou FLAC. O editor também suporta marcação SSML para controle detalhado de pausas, ênfase, pronúncia e prosódia.
O SpeechGen suporta clonagem de voz?
Sim. Faça upload ou grave uma amostra curta e limpa, confirme os direitos de uso, e o SpeechGen cria uma voz clonada personalizada que você pode usar no editor principal de texto para fala.
O SpeechGen pode transcrever áudio ou vídeo?
Sim. O painel Audio to Text aceita arquivos de áudio e vídeo enviados ou links do YouTube, e retorna transcrições com exportações de legendas como SRT e VTT.

