Tekst naar spraak
Typ of plak je tekst, of sleep er een PDF, een Word-bestand of een foto van een bladzijde in. Kies een stem, luister en download het als MP3. De spraak wordt op je eigen toestel gemaakt — je document verlaat je computer nooit.
Hoe het werkt
Een spraakmodel draait in je eigen browser en maakt van je tekst een stem — er wordt niets geüpload, dus een contract, een diagnose of een persoonlijke brief blijft op je toestel. Een PDF wordt rechtstreeks uit zijn tekstlaag gelezen, een Word-bestand uit zijn eigen inhoud, en een foto van een bladzijde gaat eerst door onze OCR, zodat een boek of een gedrukte brief ook werkt. Getallen, bedragen en symbolen worden uitgeschreven vóór het voorlezen, zodat "€25" als "vijfentwintig euro" klinkt en niet wordt ingeslikt. De eerste keer dat je op Laat voorlezen drukt, wordt de spraak-engine één keer gedownload (ongeveer 390 MB); daarna houdt je browser hem bij.
Welke talen kan hij spreken?
Voorlopig alleen Engels. Het stemmodel dat we gebruiken is Engelstalig, en elk meertalig model dat we getest hebben verbiedt commercieel gebruik of draagt een copyleft-licentie die we niet op een betalende site willen zetten. We leveren liever één taal eerlijk dan een dozijn talen waar we geen recht op hebben. Andere talen vragen een eigen licentieronde.
Mag ik de audio commercieel gebruiken?
Ja. Het stemmodel valt onder de MIT-licentie en de stemmen komen uit een spraakdatabank die commercieel gebruik toelaat, dus een video, een podcast of een luisterboek mag gerust. De stemmen zijn synthetisch en zijn van niemand, dus je doet je ook niet voor als een echt persoon.
Waarom klinkt het vlak bij lange teksten?
Het model leest zin per zin, zonder het verhaal te kennen, en kan dus geen spanning opbouwen zoals een menselijke verteller. Korte alinea's met duidelijke leestekens klinken merkbaar beter dan één lang blok — komma's en punten zijn waarmee hij ademt.
Kan ik de stem achteraf nog wijzigen?
Ja — de schuiven voor toonhoogte en snelheid dekken het meeste, en snelheid is een echte time-stretch, zodat een tragere stem geen diepere stem wordt. Wil je meer, download dan de MP3 en haal hem door onze stemvervormer, of sleep hem meteen in de audiostudio.
Hoe worden afkortingen en ongewone namen uitgesproken?
Gangbare afkortingen zonder klinkers — PDF, XML, HTML, GDPR — worden automatisch letter voor letter gespeld, en combinaties zoals MP3 of 4K komen er vanzelf goed uit. Hoofdletterwoorden die wél klinkers bevatten, blijven bewust gewone woorden — zo klinken NASA en een zin die volledig in hoofdletters getypt is nog steeds normaal. Komt iets er toch verkeerd uit, schrijf het dan zoals het moet klinken: de stem is Engelstalig en leest exact wat je typt, dus een ongewone naam of merknaam kun je gewoon fonetisch spellen zoals een Engelse lezer hem zou uitspreken — "Nike" als "Nykee", "Cicek" als "Cheechek" — tot het goed klinkt.
