Da testo a voce
Scrivi o incolla il tuo testo, oppure trascina un PDF, un file Word o la foto di una pagina. Scegli una voce, ascolta e scaricala in MP3. La voce viene generata sul tuo dispositivo: il documento non lascia mai il tuo computer.
Come funziona
Un modello vocale gira dentro il tuo browser e trasforma ciò che scrivi in una voce: non viene caricato nulla, così un contratto, una diagnosi o una lettera privata restano sul tuo dispositivo. Un PDF viene letto direttamente dal suo strato di testo, un file Word dal proprio contenuto, e la foto di una pagina passa prima dal nostro OCR, quindi funzionano anche un libro o una lettera stampata. Numeri, importi e simboli vengono scritti per esteso prima della lettura, così "25 €" viene letto come "venticinque euro" invece di essere saltato. La prima volta che premi Leggilo, il motore vocale viene scaricato una sola volta (circa 390 MB) e poi il browser lo conserva.
Quali lingue sa parlare?
Per ora solo l'inglese. Il modello vocale che usiamo è inglese, e ogni modello multilingue che abbiamo provato o vieta l'uso commerciale o ha una licenza copyleft che non vogliamo su un sito a pagamento. Preferiamo offrire una sola lingua in modo onesto piuttosto che una dozzina su cui non abbiamo alcun diritto. Altre lingue richiedono un proprio giro di licenze.
Posso usare l'audio commercialmente?
Sì. Il modello vocale ha licenza MIT e le voci provengono da un database vocale che consente l'uso commerciale, quindi un video, un podcast o un audiolibro vanno benissimo. Le voci sono sintetiche e non appartengono a nessuno, quindi non stai nemmeno impersonando una persona reale.
Perché sui testi lunghi suona piatta?
Il modello legge frase per frase, senza conoscere il racconto, quindi non può costruire la tensione come farebbe un narratore umano. Paragrafi brevi con una punteggiatura chiara suonano nettamente meglio di un unico blocco lungo: virgole e punti sono ciò che usa per respirare.
Posso cambiare la voce dopo?
Sì — i cursori di tono e velocità qui coprono quasi tutto, e la velocità è un vero time-stretch, quindi una voce più lenta non diventa una voce più grave. Per il resto, scarica l'MP3 e passalo nel nostro modificatore di voce, oppure portalo direttamente nello studio audio.
Come si pronunciano le sigle e i nomi insoliti?
Le sigle comuni senza vocali — PDF, XML, HTML, RGPD — vengono scandite automaticamente lettera per lettera, e combinazioni come MP3 o 4K vengono pronunciate correttamente da sole. Le parole in maiuscolo che contengono vocali vengono lasciate di proposito come parole intere, così NASA e una frase digitata tutta in maiuscolo suonano comunque normali. Per tutto ciò che viene ancora pronunciato male, scrivilo come dovrebbe suonare: la voce legge esattamente ciò che digiti — e legge in inglese — quindi un nome insolito o un marchio si può semplicemente trascrivere in modo fonetico, come lo leggerebbe un lettore inglese — "Nike" come "Nykee", "Cicek" come "Cheechek" — finché non suona bene.
