PDF till text-extraktor
Extrahera markerbar text från en PDF i webbläsaren och kopiera eller ladda ned den som TXT. Privat, gratis och utan att någon fil laddas upp.
🔒 Körs helt i din webbläsare — ingenting laddas uppExtrahera markerbar PDF-text lokalt
Att kopiera text från en PDF är inte alltid smidigt, särskilt när dokumentet har många sidor eller du behöver texten i en enkel editor. Det här PDF till text-verktyget läser den markerbara texten på varje sida och lägger den i ett enda textfält som du kan kopiera eller ladda ned som TXT-fil. Det körs helt i webbläsaren med pdfjs-dist, så käll-PDF:en laddas inte upp eller lagras av någon extern tjänst. Extraktorn är användbar för researchanteckningar, citat, avtal, rapporter, fakturor, manualer och alla PDF-filer som redan har ett textlager.
Markerbar text jämfört med skannade bilder
PDF-filer kan lagra text på olika sätt. En digitalt skapad PDF, till exempel exporterad från ett ordbehandlingsprogram, innehåller oftast riktig markerbar text. En skannad PDF kan bara innehålla bilder av sidorna. Om en skanning redan har behandlats med OCR kan textextraktion fungera, eftersom OCR-lagret ligger dolt bakom bilden. Om den bara består av bilder kan det här verktyget inte hitta på text utifrån pixlar; kör OCR först och extrahera sedan det textlager som skapats. Webbläsaren läser in dokumentet från det lokala minnet, ber varje sida om dess textinnehåll och sätter ihop resultatet med sidetiketter.
Städa upp den extraherade texten
Textens ordning i en PDF beror på hur originalfilen byggdes. Enkla sidor extraheras oftast rent, medan layouter med flera kolumner, tabeller, sidhuvuden, sidfötter och roterad text kan behöva städas manuellt. Granska resultatet innan du citerar eller återanvänder det. Verktyget lägger till sidavgränsare så att du kan spåra texten tillbaka till källsidan och rätta radbrytningar eller mellanrum som inte stämmer med den ursprungliga läsordningen. Resultatet är ren text, vilket gör det enkelt att klistra in i ett dokument, söka i en kodeditor, använda i ett annat lokalt arbetsflöde eller spara bredvid den ursprungliga PDF:en.
Hur man använder
- Lägg till en PDFSläpp en PDF-fil på textextraktorn eller klicka för att bläddra.
- Extrahera textenLäs lokalt den markerbara texten på varje sida med pdfjs-dist.
- Kopiera eller ladda nedKopiera resultatet från textfältet eller spara det som en .txt-fil.