PT PDF Tools

PDF naar tekst-extractor

Haal selecteerbare tekst uit een PDF in je browser en kopieer of download die als TXT. Privé, gratis en zonder dat je bestanden uploadt.

🔒 Draait volledig in uw browser — niets wordt geüpload

Drop one PDF here or click to browse

Advertisement

Selecteerbare PDF-tekst lokaal uitpakken

Tekst uit een PDF kopiëren is niet altijd handig, zeker als het document veel pagina's heeft of je de tekst in een eenvoudige editor nodig hebt. Deze PDF naar tekst-tool leest de selecteerbare tekst van elke pagina en zet die in één tekstvak dat je kunt kopiëren of als TXT-bestand kunt downloaden. Alles draait volledig in je browser met pdfjs-dist, dus de bron-PDF wordt niet geüpload of opgeslagen door een externe dienst. De extractor is handig voor onderzoeksnotities, citaten, contracten, rapporten, facturen, handleidingen en elke PDF waarin al een tekstlaag zit.

Selecteerbare tekst versus gescande afbeeldingen

PDF's kunnen tekst op verschillende manieren opslaan. Een digitaal aangemaakte PDF, bijvoorbeeld geëxporteerd uit een tekstverwerker, bevat meestal echte selecteerbare tekst. Een gescande PDF kan alleen afbeeldingen van pagina's bevatten. Als een scan al met OCR is verwerkt, kan tekstextractie werken, omdat de OCR-laag achter de afbeelding verborgen zit. Bestaat het bestand alleen uit afbeeldingen, dan kan deze tool geen tekst uit pixels toveren; voer eerst OCR uit en haal daarna de ontstane tekstlaag eruit. Je browser laadt het document uit het lokale geheugen, vraagt elke pagina om de tekstinhoud en voegt de resultaten samen met paginalabels.

De uitvoer opschonen

De volgorde van tekst in een PDF hangt af van hoe het oorspronkelijke bestand is opgebouwd. Eenvoudige pagina's worden meestal netjes uitgepakt, terwijl lay-outs met meerdere kolommen, tabellen, kopteksten, voetteksten en gedraaide tekst handmatig opgeschoond moeten worden. Controleer de uitvoer voordat je die citeert of hergebruikt. De tool voegt paginascheidingen toe, zodat je tekst kunt terugvinden op de bronpagina en regeleinden of spaties kunt corrigeren die niet overeenkomen met de oorspronkelijke leesvolgorde. De uitvoer is platte tekst, die je gemakkelijk in een document plakt, in een code-editor doorzoekt, in een andere lokale workflow gebruikt of naast de oorspronkelijke PDF bewaart.

Hoe te gebruiken

  1. Voeg een PDF toeSleep één PDF-bestand naar de tekst-extractor of klik om te bladeren.
  2. Haal de tekst eruitLees de selecteerbare tekst van elke pagina lokaal uit met pdfjs-dist.
  3. Kopieer of downloadKopieer het resultaat uit het tekstvak of sla het op als .txt-bestand.

Veelgestelde vragen

Wordt de PDF geüpload bij tekstextractie?
Nee. pdfjs-dist leest de PDF in je browser en de uitgepakte tekst blijft op je apparaat.
Levert een gescande PDF tekst op?
Alleen als de scan al een OCR-tekstlaag bevat. Scans die alleen uit afbeeldingen bestaan, hebben eerst OCR nodig.
Kan ik de uitgepakte tekst kopiëren?
Ja. Gebruik de kopieerknop of download een .txt-bestand met de uitgepakte paginatekst.
Blijft de opmaak behouden?
De tool richt zich op selecteerbare tekst. Complexe kolommen, tabellen en de exacte lay-out moeten mogelijk handmatig worden opgeschoond.
Advertisement