PDF till text-konverterare

Nästa: granska

Det snabbaste sättet att få ut orden ur en PDF. Det här verktyget läser textlagret som redan finns lagrat i PDF-filen, sida för sida, och ger dig ren text som du kan kopiera eller spara som en .txt-fil. Allt körs i din webbläsare, så ditt dokument laddas aldrig upp. En sak att veta direkt: verktyget läser text som redan finns i filen, så ett inskannat eller fotograferat dokument (en bild utan textlager) kommer ut tomt. För sådana filer använder du i stället ett OCR-verktyg.

Så extraherar du text ur en PDF

  1. 1

    Ladda upp PDF-filen

    Dra in den eller klicka för att välja. Filen stannar på din enhet och skickas aldrig till en server.

  2. 2

    Extrahera texten

    Verktyget läser varje sidas textlager och fogar ihop dem, med en markör före varje sida.

  3. 3

    Granska resultatet

    Den extraherade texten visas i en ruta, sida efter sida, redo att kontrolleras.

  4. 4

    Kopiera eller ladda ned

    Kopiera den till urklipp eller spara den som en .txt-fil för att återanvända den någon annanstans.

Vad verktyget läser, och vad det inte kan

Typ av PDF Resultat
Exporterad från Word, Google Docs, en webbläsare eller ett designverktyg Fullständig text, ren och komplett
En digital PDF med ett riktigt textlager Text extraherad sida för sida
En skanning eller ett foto sparat som PDF (endast bild) Tomt eller nästan tomt: det finns ingen text att läsa
En lösenordsskyddad PDF Kan inte läsas förrän du låser upp den först

Ingen OCR här: rätt verktyg för skanningar

Den här extraheraren kör inte OCR (optisk teckenigenkänning). Den kopierar texten som redan finns inne i PDF-filen, den läser inte pixlar. Om din fil är en skanning och inget kommer ut, kör den först genom ett OCR-verktyg, som omvandlar bilden till ett riktigt textlager som du sedan kan extrahera.

Så är texten upplagd

Varje sida skiljs åt av en markör --- Page N ---, så att du ser var en sida slutar och nästa börjar. Texten hämtas i den ordning den är lagrad i PDF-filen. De flesta dokument läses naturligt; några med ovanliga flerkolumnslayouter kan väva ihop kolumnerna, eftersom verktyget följer den ordning som lagrats i PDF-filen i stället för att gissa en läsväg.

Vanliga användningsområden

  • Mata en AI-modell. Språkmodeller tar ren text, inte PDF. Att extrahera först gör allt snabbare och mer förutsägbart.
  • Citera och söka. Kopiera ett stycke utan att slåss med PDF-visarens markering.
  • Återanvända innehåll. Flytta text till ett dokument, ett e-postmeddelande eller en anteckning utan att skriva om det.

Vanliga frågor

Nej. Det läser det inbäddade textlagret, och en skanning är bara en bild utan textlager, så den kommer ut tom. Använd ett OCR-verktyg för inskannade eller fotograferade dokument och extrahera sedan texten.

Nej. Extraheringen körs helt i din webbläsare, på din egen enhet. PDF-filen skickas aldrig till en server och inget lagras.

Några PDF-filer, särskilt flerkolumnslayouter, lagrar sin text i en annan ordning än du läser den. Verktyget följer den ordning som lagrats i PDF-filen, så kolumner kan vävas ihop. Dokument som exporterats från ordbehandlare kommer nästan alltid ut korrekt.

Inte medan de är låsta. Ta först bort lösenordet med ett verktyg för att låsa upp PDF och extrahera sedan texten.

Relaterade verktyg

Verktyget finns på andra språk