Skapa sökbar PDF
Den här OCR-sessionen är inte längre tillgänglig
Välj en skannad PDF-fil
Endast PDF · 10 MB
Endast PDF, upp till 10 MB och 10 sidor
En skannad PDF är egentligen bara en trave bilder i en PDF-behållare, så du kan inte markera, kopiera eller söka i texten. Det här verktyget kör optisk teckenigenkänning (OCR) på varje sida i din webbläsare och bäddar in resultatet som ett osynligt textlager som är inriktat mot originalsidan. Sidans utseende behålls, medan Ctrl+F och textmarkering kan använda de igenkända orden. Igenkänningen kan göra fel och resultatet är inte en taggad tillgänglighets-PDF, så jämför viktig text med skanningen.
Så kör du OCR på en skannad PDF
-
1
Ladda upp skanningen
Dra in en skannad PDF (avtal, fakturor, arkiverade rapporter). Tryckt text fungerar bäst; handskrift gör det inte.
-
2
Välj språk
Välj dokumentets språk (engelska, spanska, franska, tyska, italienska, portugisiska eller nederländska) så att OCR-motorn laddar rätt teckenmodell.
-
3
Kör igenkänningen
Varje sida renderas i hög upplösning i din webbläsare och skickas till OCR-motorn. Långa dokument kan ta några minuter.
-
4
Textlagret bäddas in
De igenkända orden placeras som ett osynligt lager inriktat mot originalsidan, så varje sida ser oförändrad ut.
-
5
Ladda ner den nya PDF:en
Få en PDF som behåller originalskanningarna och nu är sökbar i alla moderna läsare.
När OCR fungerar bra (och när inte)
OCR-kvaliteten beror på skanningen. Jämför alltid viktiga namn, siffror och juridiska formuleringar med originalsidan.
| Indata | Vad du kan förvänta dig |
|---|---|
| Ren skanning av tryckt text | Ofta bra resultat, men korrekturläs viktig text. |
| Foto av en tryckt sida | Resultatet beror på fokus, ljus och sidans vinkel. |
| Gammal bok eller blekt skrivmaskinstryck | Kontrollera den igenkända texten noggrant. |
| Handskrift eller skrivstil | Stöds inte på ett tillförlitligt sätt. |
| Kvitton eller termoskrivarutskrift | Kontrollera siffror och svaga tecken noggrant. |
| Kraftigt genomslag från baksidan | Resultaten kan vara ofullständiga eller felaktiga. |
Sökbar PDF kontra PDF med enbart bild
- PDF med enbart bild: rena bitmappar, ingen text. Det din skanner ger som standard.
- Sökbar PDF: bitmappar plus ett osynligt textlager (det verktyget ger). Ser identisk ut, Ctrl+F fungerar.
- PDF/A: en arkivvariant av PDF som bäddar in sina teckensnitt och förbjuder externa resurser, ofta krävd av domstolar och arkiv. Det här verktyget ger en vanlig sökbar PDF, inte en certifierad PDF/A; konvertera och validera med ett särskilt PDF/A-verktyg om ditt arbetsflöde kräver det.
Tips för bästa resultat
- Börja med omkring 300 DPI. Det är ofta en bra balans mellan läsbara detaljer och bearbetningstid. Högre upplösning kräver mer tid och minne.
- Räta upp innan OCR. De flesta skannrar erbjuder automatisk rotation; även en liten lutning kan försämra igenkänningskvaliteten.
- Ett språk per körning. Motorn känner igen ett språk i taget, så välj det som dominerar. För ett tvåspråkigt dokument kör du det en gång per språk och behåller det bästa resultatet.
- Behåll alltid originalet. OCR ger små fel; det osynliga lagret är en bekvämlighet, inte ett bevis.
Vanliga frågor
Det ursprungliga sidinnehållet behålls. Den igenkända texten läggs till som ett osynligt lager inriktat mot det, så sidans utseende bör förbli oförändrat. Kontrollera resultatet om exakt visuell trohet är viktig.
Sju språk med latinsk skrift: engelska, spanska, franska, tyska, italienska, portugisiska och nederländska. Välj det som stämmer med ditt dokument. Skriftsystem som kyrilliska, arabiska och CJK (kinesiska, japanska, koreanska) finns inte i det här verktyget.
Inte tillförlitligt. Det här verktyget är avsett för tryckt text. Handskriftsigenkänning är en annan teknik, så kontrollera eller transkribera handskrivet material separat.
Nej. Resultatet är en vanlig sökbar PDF: dina ursprungliga sidbilder plus ett osynligt OCR-textlager. Det är ingen certifierad PDF/A-arkivfil. Om ditt arbetsflöde kräver PDF/A konverterar och validerar du resultatet med ett särskilt PDF/A-verktyg.
OCR körs helt i din webbläsare, så din käll-PDF skickas inte till en server för igenkänning. En vanlig lokal nedladdning stannar på din enhet. Endast om du väljer Skapa en nedladdningssida laddas den färdiga sökbara PDF:en upp till vår server. Käll-PDF:en stannar lokalt och det uppladdade resultatet sparas i upp till 7 dagar.
Relaterade verktyg
Word till PDF
Konvertera Word-dokument i .doc och .docx till PDF med sidlayout, bilder, tabeller och rubriker bevarade. Säker uppladdning, automatisk radering efter 2 timmar.
PNG till PDF-konverterare
Samla PNG-skärmbilder, skanningar eller designexporter i en PDF. Välj A4 eller Letter, orientering och marginaler före nedladdning.
PDF till JPG-konverterare
Konvertera PDF-sidor till JPG-bilder med den upplösning och kvalitet du behöver. Ladda ner enskilda sidor eller allt som en ZIP.
Excel till PDF-konverterare
Konvertera XLSX-, XLS- eller CSV-filer i webbläsaren till en liggande A4-PDF. Varje kalkylblad blir en tydlig tabellsida.
PDF till Excel-konverterare
Upptäck vanliga tabeller i en textbaserad PDF och ladda ner XLSX, CSV eller TSV lokalt. Granska tabellerna före export. Gräns: 20 MiB och 150 sidor.
JPG till PDF-omvandlare
Sammanfoga JPG-bilder till en enda PDF och styr sidstorlek, orientering och marginaler för avtal, kvitton och portföljer.