PDF naar Word
Haal de tekst van een PDF in een bewerkbaar Word-document dat je kunt aanpassen. Alles draait in je browser — je bestand verlaat nooit je apparaat.
Wat je krijgt (en wat niet)
Deze tool haalt de tekst uit een PDF en zet die in een bewerkbaar Word-document. Wanneer de PDF een normaal digitaal bestand is, leest hij de echte tekst rechtstreeks, dus de nauwkeurigheid is hoog. Is de PDF een scan (gewoon een afbeelding), dan leest hij de pagina's in plaats daarvan met OCR. Hoe dan ook krijg je bewerkbare woorden, geen pixelperfecte kloon van de originele opmaak — lettertypes, kolommen en de exacte positionering worden vereenvoudigd. Dat is ideaal om de inhoud van een document te hergebruiken; de opmaak exact reproduceren vergt gespecialiseerde betaalde software. Het draait allemaal in je browser — je PDF wordt nooit geüpload.
Wordt mijn PDF ergens naartoe geüpload?
Nee. Zowel de tekstextractie als de OCR draaien in je browser. Je document — en alles wat vertrouwelijk erin staat — verlaat nooit je apparaat.
Waarom is de opmaak niet identiek aan de PDF?
PDF en Word slaan pagina's heel anders op. Elk lettertype, elke kolom en elk kader getrouw naspelen vergt een zware commerciële engine. Deze tool richt zich erop de tekst er netjes en bewerkbaar uit te halen — dat dekt de meeste echte behoeften — in plaats van een perfecte visuele kopie na te jagen.
Werkt het op gescande PDF's?
Ja. Heeft een pagina geen digitale tekst, dan leest de tool hem automatisch met OCR (dezelfde engine als onze tool Afbeelding naar tekst (OCR)). OCR is nooit perfect, dus controleer het resultaat — maar het bespaart je het overtypen.
De eerste gescande pagina was traag — waarom?
De OCR-engine downloadt eenmalig een leesmodel (ongeveer 15–25 MB) de eerste keer dat het nodig is, en cachet het daarna. Digitale PDF's slaan OCR helemaal over en zijn vrijwel meteen klaar.
Welke talen kan de OCR lezen?
De ingebouwde OCR leest Engels. Digitale (niet-gescande) PDF's behouden welke taal ze ook bevatten, omdat hun echte tekst rechtstreeks wordt gebruikt.
Kan het een met wachtwoord beveiligde PDF openen?
Nee — verwijder eerst het wachtwoord in je PDF-lezer en zet daarna het ontgrendelde bestand om.
Een afgewerkte PDF weer omzetten in iets dat je kunt bewerken
Een PDF is bedoeld als eindpunt — prima om te versturen en te printen, frustrerend zodra je één regel moet aanpassen. Misschien is het originele document allang zoek, heeft een collega alleen de PDF, of wil je een paar alinea's hergebruiken in iets nieuws. Alles met de hand overtypen is traag en foutgevoelig. Deze tool haalt de tekst eruit en zet hem in een Word-document dat je kunt bewerken als elk ander — zo kun je een typfout herstellen, een cijfer bijwerken, een stuk vertalen of de inhoud hergebruiken — zonder vanaf een leeg blad te beginnen.
Digitale PDF's versus scans
Er bestaan twee soorten PDF, en de tool behandelt ze verschillend. Een digitale PDF — een die geëxporteerd is vanuit Word, een browser of een boekhoudpakket — bevat nog steeds de echte tekst, dus de tool leest hem rechtstreeks en de nauwkeurigheid is hoog. Een gescande PDF is eigenlijk gewoon een foto van een pagina, zonder enige tekst erin; daar valt de tool terug op OCR, die de letters herkent vanuit de afbeelding. Dit wordt automatisch per pagina bepaald, zodat een document dat beide mengt — een getypte brief met een gescande handtekeningpagina — verstandig wordt afgehandeld.
Bewerkbare tekst, geen fotokopie van de opmaak
Het helpt om te weten wat je krijgt: de woorden, klaar om te bewerken, in plaats van een pixelperfecte reconstructie van lettertypes, kolommen en kaders. Een complexe opmaak exact reproduceren is waar zware, commerciële converters geld voor vragen; deze tool richt zich bewust op het er netjes uitkrijgen van de inhoud, wat de meeste mensen in de praktijk ook echt nodig hebben. Eenmaal in Word kost het toepassen van koppen, een tabel of je eigen huisstijl maar een paar minuten en levert het een document op dat écht van jou is om mee te werken, in plaats van een waar je tegen moet vechten.
Het beste uit OCR halen
Moet een pagina door OCR gelezen worden, dan helpen een paar dingen. De ingebouwde lezer werkt met Engels; hoe scherper en rechter de scan, hoe beter het resultaat, dus een nette scan op 300 dpi wint het van een gehaaste, scheve foto met de telefoon. OCR is nooit foutloos — reken op af en toe een verkeerde letter, vooral bij ongebruikelijke lettertypes, vage druk of handschrift — dus geef het resultaat een korte controlelezing. Toch is een handvol tekens corrigeren nog altijd veel sneller dan een hele pagina overtypen, en dat is precies het punt.
Privacy zit in het ontwerp
Zowel de tekstextractie als de OCR draaien volledig in je browser, dus het document verlaat nooit je apparaat — er wordt niets geüpload, gelogd of bewaard. Dat is belangrijk voor contracten, hr-brieven, financiële overzichten en alles wat je liever niet op de server van iemand anders ziet staan. Het enige wat je eventueel eerst moet doen, is een wachtwoord verwijderen, want een beveiligde PDF moet ontgrendeld worden voordat zijn tekst gelezen kan worden. Bewaar je originele PDF als de definitieve versie, en behandel het Word-bestand als je werkkladversie.
