OCR PDF

Lees de tekst uit een gescande PDF — kopieer hem of sla hem op als .txt-bestand.

100% privé — draait volledig in je browser. Je gegevens worden op je apparaat verwerkt en nooit naar het internet verzonden.

Klik om te uploaden of sleep hier een gescande PDF heen

Eén PDF — met OCR gelezen op uw apparaat, nooit geüpload

Over OCR voor PDF's

Sommige PDF's bevatten helemaal geen tekst. Een gescand contract, een gefotografeerde kassabon, een fax, een oud boek uit de scanner van een bibliotheek — elke pagina is alleen een plaatje van tekst. U kunt het lezen, maar niet selecteren, kopiëren of doorzoeken.

OCR (optische tekenherkenning) lost dat op. Het bekijkt het plaatje van elke pagina, herkent de vormen van de letters en geeft u echte tekst terug die u kunt kopiëren, bewerken en doorzoeken.

Deze tool doet dat pagina voor pagina en toont de tekst zodra een pagina klaar is. U hoeft dus niet op het hele document te wachten voordat u begint.

Alles gebeurt op uw apparaat

Gescande PDF's zijn vaak de privé-exemplaren: een identiteitsbewijs, een brief van de bank, een medisch formulier, een ondertekend contract. De meeste online OCR-diensten willen dat u ze uploadt.

Deze niet. De OCR-engine (Tesseract, de opensource-engine achter veel professionele programma's) draait in uw browser:

  • Privé — de PDF verlaat nooit uw apparaat
  • Geen account, geen paginalimiet, geen watermerk

De eerste keer worden de engine en de taaldata gedownload — een paar megabyte. Uw browser bewaart ze, dus de volgende keer start het sneller.

Tekstpagina's en gescande pagina's in één bestand

Veel PDF's zijn gemengd. Getypte pagina's met een gescande handtekeningpagina aan het eind. Een scan waar iemand al OCR op heeft losgelaten. Een rapport met een paar gefotografeerde pagina's in het midden.

Standaard controleert de tool eerst elke pagina:

  • Een pagina die al echte tekst heeft, wordt gewoon overgenomen — exact, meteen, zonder OCR-fouten
  • Een pagina die alleen een plaatje is, wordt met OCR gelezen

Aan het eind ziet u hoeveel pagina's welke weg gingen. Haal het vinkje bij 'Pagina's die al echte tekst hebben' weg om OCR op elke pagina af te dwingen — handig als de oude tekstlaag fout of onleesbaar is.

Het beste resultaat krijgen

OCR is erg goed, maar het leest een plaatje, dus het plaatje doet ertoe:

  • Kies de juiste taal. Die bepaalt welke letters en accenten de engine verwacht. Franse tekst die als Engels wordt gelezen, verliest zijn é en ç.
  • Rechte, scherpe pagina's lezen het best. Een scheve telefoonfoto of een wazige fax geeft meer fouten.
  • Gewone gedrukte tekst leest goed. Handschrift, heel kleine letters en sierlettertypen lezen slecht.
  • Tabellen komen eruit als regels tekst, niet als tabel. Controleer bij een tabel daarna de kolommen.
  • Lees het resultaat altijd voordat u erop vertrouwt. Let op 1 / l / I, 0 / O en rn / m — de klassieke OCR-verwarringen.

Waarvoor mensen het gebruiken

  • Een alinea kopiëren uit een gescand contract of een brief
  • De tekst krijgen van een oud boek of artikel dat alleen als scan bestaat
  • Een gescande kassabon of factuur doorzoekbaar maken in uw notities
  • Citaten halen uit gescande onderzoeksartikelen en hand-outs
  • Formulieren en dossiers overnemen zonder ze met de hand over te typen
  • Een gefaxt document omzetten in iets wat u kunt bewerken

Goed om te weten

  • Een PDF die met een wachtwoord beveiligd is, moet eerst ontgrendeld worden — gebruik PDF ontgrendelen
  • Grote documenten kosten tijd: ongeveer 2–10 seconden per pagina op een computer, langer op een telefoon. Gebruik Pagina's om alleen het deel te lezen dat u nodig hebt
  • Stoppen bewaart elke pagina die al gelezen is
  • Het resultaat is platte tekst. Om de tekst in Word te krijgen, plakt u hem, of gebruikt u PDF naar Word voor PDF's die al tekst hebben
  • Heeft uw PDF op elke pagina echte tekst, dan is PDF naar tekst sneller en heeft het meer opmaakopties

Veelgestelde vragen

Is het gratis?

Ja. Geen account, geen paginalimiet, geen watermerk.

Wordt mijn PDF geüpload?

Nee. De pagina's worden in deze pagina getekend en gelezen, op uw eigen apparaat.

Welke talen leest het?

Engels, Spaans, Frans, Duits, Italiaans, Portugees, Nederlands, Chinees (vereenvoudigd), Japans en Koreaans. Kies er een voordat u begint.

Waarom staan er fouten in de tekst?

OCR raadt elke letter aan de hand van zijn vorm. Een wazige, scheve of laag-resolutie scan laat het vaker verkeerd raden. Controleer het resultaat en verbeter de paar fouten in het vak voordat u het kopieert.

Kan het mijn PDF doorzoekbaar maken?

Nog niet — het geeft u de tekst als een apart .txt-bestand. Uw originele PDF blijft ongewijzigd.

Zo gebruikt u het

  • Klik op Klik om te uploaden, of sleep uw gescande PDF op het vak
  • Kies de taal van de tekst
  • Typ een paginabereik als u maar een paar pagina's nodig hebt — of laat het leeg voor alle pagina's
  • Klik op Tekst lezen en kijk hoe de pagina's binnenkomen
  • Controleer de tekst en klik dan op Kopiëren of .txt downloaden

Verwante tools

We voegen regelmatig nieuwe tools toe — abonneer je op YouTube om bericht te krijgen bij elke nieuwe tool.

Meer tools

Alles bekijken

Aanbevolen apps

Alles bekijken