PDF till text-konverterare
Det snabbaste sättet att få ut orden ur en PDF. Det här verktyget läser textlagret som redan finns lagrat i PDF-filen, sida för sida, och ger dig ren text som du kan kopiera eller spara som en .txt-fil. Allt körs i din webbläsare, så ditt dokument laddas aldrig upp. En sak att veta direkt: verktyget läser text som redan finns i filen, så ett inskannat eller fotograferat dokument (en bild utan textlager) kommer ut tomt. För sådana filer använder du i stället ett OCR-verktyg.
Så extraherar du text ur en PDF
-
1
Ladda upp PDF-filen
Dra in den eller klicka för att välja. Filen stannar på din enhet och skickas aldrig till en server.
-
2
Extrahera texten
Verktyget läser varje sidas textlager och fogar ihop dem, med en markör före varje sida.
-
3
Granska resultatet
Den extraherade texten visas i en ruta, sida efter sida, redo att kontrolleras.
-
4
Kopiera eller ladda ned
Kopiera den till urklipp eller spara den som en .txt-fil för att återanvända den någon annanstans.
Vad verktyget läser, och vad det inte kan
| Typ av PDF | Resultat |
|---|---|
| Exporterad från Word, Google Docs, en webbläsare eller ett designverktyg | Fullständig text, ren och komplett |
| En digital PDF med ett riktigt textlager | Text extraherad sida för sida |
| En skanning eller ett foto sparat som PDF (endast bild) | Tomt eller nästan tomt: det finns ingen text att läsa |
| En lösenordsskyddad PDF | Kan inte läsas förrän du låser upp den först |
Ingen OCR här: rätt verktyg för skanningar
Den här extraheraren kör inte OCR (optisk teckenigenkänning). Den kopierar texten som redan finns inne i PDF-filen, den läser inte pixlar. Om din fil är en skanning och inget kommer ut, kör den först genom ett OCR-verktyg, som omvandlar bilden till ett riktigt textlager som du sedan kan extrahera.
Så är texten upplagd
Varje sida skiljs åt av en markör --- Page N ---, så att du ser var en sida slutar och nästa börjar. Texten hämtas i den ordning den är lagrad i PDF-filen. De flesta dokument läses naturligt; några med ovanliga flerkolumnslayouter kan väva ihop kolumnerna, eftersom verktyget följer den ordning som lagrats i PDF-filen i stället för att gissa en läsväg.
Vanliga användningsområden
- Mata en AI-modell. Språkmodeller tar ren text, inte PDF. Att extrahera först gör allt snabbare och mer förutsägbart.
- Citera och söka. Kopiera ett stycke utan att slåss med PDF-visarens markering.
- Återanvända innehåll. Flytta text till ett dokument, ett e-postmeddelande eller en anteckning utan att skriva om det.
Vanliga frågor
Nej. Det läser det inbäddade textlagret, och en skanning är bara en bild utan textlager, så den kommer ut tom. Använd ett OCR-verktyg för inskannade eller fotograferade dokument och extrahera sedan texten.
Nej. Extraheringen körs helt i din webbläsare, på din egen enhet. PDF-filen skickas aldrig till en server och inget lagras.
Några PDF-filer, särskilt flerkolumnslayouter, lagrar sin text i en annan ordning än du läser den. Verktyget följer den ordning som lagrats i PDF-filen, så kolumner kan vävas ihop. Dokument som exporterats från ordbehandlare kommer nästan alltid ut korrekt.
Inte medan de är låsta. Ta först bort lösenordet med ett verktyg för att låsa upp PDF och extrahera sedan texten.
Relaterade verktyg
Skapa sökbar PDF
Gör en skannad PDF sökbar och markerbar genom att lägga till ett osynligt OCR-textlager. Helt i din webbläsare; 7 språk med latinsk skrift.
Maskera PDF
Täck känsliga områden och skapa en ny plattad PDF i webbläsaren. Varje utmatningssida blir en JPEG-bild, utan ursprunglig text, länkar, formulär, lager eller källmetadata.
Extrahera bilder från PDF
Extrahera varje bild som är inbäddad i en PDF-fil och ladda ner dem individuellt eller som en enda ZIP, med bevarad ursprunglig upplösning.
PDF-formulär
Fyll i befintliga AcroForm-fält lokalt, behåll förifyllda värden och hämta en interaktiv eller uttryckligen tillplattad kopia.
Skanna PDF
Gör en lokal PDF av dokumentfoton i JPEG, PNG eller WebP. Lägg till högst 25 bilder, välj stående A4 eller US Letter och ladda inte upp några filer.
OCR för PDF
Hämta oformaterad text från skannade trycksaker i PDF-format med OCR i webbläsaren. Stöder 12 språk, filer upp till 20 MB och 40 sidor.
Verktyget finns på andra språk
- ตัวแปลง PDF เป็นข้อความ [TH]
- Konwerter PDF na tekst [PL]
- Công cụ chuyển PDF sang văn bản [VI]
- Conversor de PDF para texto [PT]
- PDF テキスト変換ツール [JA]
- محوّل PDF إلى نص [AR]
- PDF-naar-tekst-converter [NL]
- PDF 텍스트 변환기 [KO]
- Conversor de PDF a texto [ES]
- Konverter PDF ke Teks [ID]
- Convertisseur PDF en texte [FR]
- PDF-zu-Text-Konverter [DE]
- Convertitore da PDF a testo [IT]
- PDF to Text Converter [EN]
- Конвертер PDF в текст [RU]
- PDF'den Metne Dönüştürücü [TR]
- PDF 转文本转换器 [ZH]