👤 Pro — sans publicitéPro
Audio et vidéo

Synthèse vocale

Tapez ou collez votre texte, ou déposez un PDF, un fichier Word ou la photo d'une page. Choisissez une voix, écoutez, puis téléchargez le résultat en MP3. La voix est générée sur votre propre appareil — votre document ne quitte jamais votre ordinateur.

Gratuit — conversions illimitées, jusqu'à 500 mots par conversion. Un pass journalier ou un déblocage supprime la limite de mots.

Votre texte
Voix
Hauteur 0
Vitesse 1.0×
Qualité MP3

Comment ça marche

Un modèle vocal tourne à l'intérieur de votre navigateur et transforme votre écrit en voix — rien n'est envoyé, donc un contrat, un diagnostic ou une lettre privée reste sur votre machine. Un PDF est lu directement depuis sa couche de texte, un fichier Word depuis son propre contenu, et la photo d'une page passe d'abord par notre OCR, ce qui permet de faire lire un livre ou une lettre imprimée. Les nombres, les montants et les symboles sont écrits en toutes lettres avant la lecture, si bien que « 25 € » est lu « vingt-cinq euros » au lieu d'être avalé. Au premier appui sur Lire, le moteur vocal se télécharge une seule fois (environ 390 Mo) et votre navigateur le conserve ensuite.

Quelles langues peut-il parler ?

L'anglais uniquement, pour l'instant. Le modèle vocal que nous utilisons est anglais, et tous les modèles multilingues que nous avons testés interdisent l'usage commercial ou imposent une licence copyleft que nous ne mettrons pas sur un site payant. Nous préférons proposer honnêtement une seule langue plutôt qu'une douzaine auxquelles nous n'avons aucun droit. Les autres langues nécessitent leur propre travail de licence.

Puis-je utiliser l'audio commercialement ?

Oui. Le modèle vocal est sous licence MIT et les voix proviennent d'une base de données vocale qui autorise l'usage commercial : une vidéo, un podcast ou un livre audio ne posent donc aucun problème. Les voix sont synthétiques et n'appartiennent à personne, vous n'usurpez donc l'identité de personne non plus.

Pourquoi le rendu est-il plat sur les longs textes ?

Le modèle lit phrase par phrase, sans connaître l'histoire, il ne peut donc pas installer une tension comme le ferait un narrateur humain. Des paragraphes courts avec une ponctuation claire sonnent nettement mieux qu'un seul long bloc — les virgules et les points sont ce qui lui permet de respirer.

Puis-je changer la voix après coup ?

Oui — les curseurs de hauteur et de vitesse couvrent l'essentiel, et la vitesse est un véritable étirement temporel : une voix plus lente ne devient donc pas une voix plus grave. Pour aller plus loin, téléchargez le MP3 et passez-le dans notre modificateur de voix, ou déposez-le directement dans le studio audio.

Comment les abréviations et les noms inhabituels sont-ils prononcés ?

Les abréviations courantes sans voyelles — PDF, XML, HTML, RGPD — sont automatiquement épelées lettre par lettre, et des combinaisons comme MP3 ou 4K sortent correctement toutes seules. Les mots en majuscules qui contiennent des voyelles restent volontairement des mots : NASA, ou une phrase tapée en capitales, sonne donc toujours normalement. Pour tout ce qui sort encore mal, écrivez-le tel qu'il doit sonner en anglais : la voix lit exactement ce que vous tapez, donc un nom ou une marque inhabituels peuvent simplement s'écrire phonétiquement, comme les lirait un anglophone — « Nike » devient « Nykee », « Cicek » devient « Cheechek » — jusqu'à ce que le résultat sonne juste.

Convertburda — conversions universelles