Texto em voz
Digite ou cole o seu texto, ou solte um PDF, um arquivo do Word ou a foto de uma página. Escolha uma voz, ouça e baixe em MP3. A fala é gerada no seu próprio aparelho — o seu documento nunca sai do seu computador.
Como funciona
Um modelo de fala roda dentro do seu navegador e transforma o que você escreveu em voz — nada é enviado, então um contrato, um diagnóstico ou uma carta pessoal fica na sua máquina. Um PDF é lido direto da sua camada de texto, um arquivo do Word do seu próprio conteúdo, e a foto de uma página passa antes pelo nosso OCR, de modo que um livro ou uma carta impressa também funcionam. Números, valores e símbolos são escritos por extenso antes da leitura, então "€25" é lido como "vinte e cinco euros" em vez de ser engolido. Na primeira vez que você aperta Falar, o motor de voz é baixado uma única vez (cerca de 390 MB) e o seu navegador guarda depois disso.
Quais idiomas ele consegue falar?
Somente inglês, por enquanto. O modelo de voz que usamos é em inglês, e todo modelo multilíngue que testamos ou proíbe o uso comercial ou carrega uma licença copyleft que não vamos colocar num site pago. Preferimos entregar um idioma de forma honesta a uma dúzia sobre os quais não temos direito algum. Outros idiomas exigem a sua própria rodada de licenciamento.
Posso usar o áudio comercialmente?
Pode. O modelo de voz tem licença MIT e as vozes vêm de um banco de dados de fala que permite uso comercial, então um vídeo, um podcast ou um audiolivro não são problema. As vozes são sintéticas e não pertencem a ninguém, então você também não está imitando uma pessoa real.
Por que soa monótono em textos longos?
O modelo lê frase por frase, sem conhecer a história, então não consegue criar tensão como um narrador humano faz. Parágrafos curtos com pontuação clara soam bem melhor do que um bloco único e longo — vírgulas e pontos finais são o que ele usa para respirar.
Posso mudar a voz depois?
Pode — os controles de tom e velocidade daqui já resolvem quase tudo, e a velocidade é um alongamento de tempo de verdade, então uma voz mais lenta não vira uma voz mais grave. Para mais, baixe o MP3 e passe pelo nosso modificador de voz, ou leve direto para o estúdio de áudio.
Como são pronunciadas as siglas e os nomes incomuns?
Siglas comuns sem vogais — PDF, XML, HTML, RGPD — são soletradas letra por letra automaticamente, e combinações como MP3 ou 4K já saem certas sozinhas. Palavras em maiúsculas que contêm vogais são deixadas como palavras de propósito, então NASA e uma frase digitada em caixa alta continuam soando normais. Para o que ainda sair errado, escreva do jeito que deve soar: a voz lê exatamente o que você digita — e, como ela fala inglês, basta grafar um nome ou marca incomum foneticamente, como um leitor de inglês pronunciaria — "Nike" como "Nykee", "Cicek" como "Cheechek" — até soar certo.
