Skapa sökbar PDF

Välj en skannad PDF-fil

Endast PDF · 10 MB

Endast PDF, upp till 10 MB och 10 sidor

En skannad PDF är egentligen bara en trave bilder i en PDF-behållare, så du kan inte markera, kopiera eller söka i texten. Det här verktyget kör optisk teckenigenkänning (OCR) på varje sida i din webbläsare och bäddar in resultatet som ett osynligt textlager som är inriktat mot originalsidan. Sidans utseende behålls, medan Ctrl+F och textmarkering kan använda de igenkända orden. Igenkänningen kan göra fel och resultatet är inte en taggad tillgänglighets-PDF, så jämför viktig text med skanningen.

Så kör du OCR på en skannad PDF

  1. 1

    Ladda upp skanningen

    Dra in en skannad PDF (avtal, fakturor, arkiverade rapporter). Tryckt text fungerar bäst; handskrift gör det inte.

  2. 2

    Välj språk

    Välj dokumentets språk (engelska, spanska, franska, tyska, italienska, portugisiska eller nederländska) så att OCR-motorn laddar rätt teckenmodell.

  3. 3

    Kör igenkänningen

    Varje sida renderas i hög upplösning i din webbläsare och skickas till OCR-motorn. Långa dokument kan ta några minuter.

  4. 4

    Textlagret bäddas in

    De igenkända orden placeras som ett osynligt lager inriktat mot originalsidan, så varje sida ser oförändrad ut.

  5. 5

    Ladda ner den nya PDF:en

    Få en PDF som behåller originalskanningarna och nu är sökbar i alla moderna läsare.

När OCR fungerar bra (och när inte)

OCR-kvaliteten beror på skanningen. Jämför alltid viktiga namn, siffror och juridiska formuleringar med originalsidan.

Indata Vad du kan förvänta dig
Ren skanning av tryckt text Ofta bra resultat, men korrekturläs viktig text.
Foto av en tryckt sida Resultatet beror på fokus, ljus och sidans vinkel.
Gammal bok eller blekt skrivmaskinstryck Kontrollera den igenkända texten noggrant.
Handskrift eller skrivstil Stöds inte på ett tillförlitligt sätt.
Kvitton eller termoskrivarutskrift Kontrollera siffror och svaga tecken noggrant.
Kraftigt genomslag från baksidan Resultaten kan vara ofullständiga eller felaktiga.

Sökbar PDF kontra PDF med enbart bild

  • PDF med enbart bild: rena bitmappar, ingen text. Det din skanner ger som standard.
  • Sökbar PDF: bitmappar plus ett osynligt textlager (det verktyget ger). Ser identisk ut, Ctrl+F fungerar.
  • PDF/A: en arkivvariant av PDF som bäddar in sina teckensnitt och förbjuder externa resurser, ofta krävd av domstolar och arkiv. Det här verktyget ger en vanlig sökbar PDF, inte en certifierad PDF/A; konvertera och validera med ett särskilt PDF/A-verktyg om ditt arbetsflöde kräver det.

Tips för bästa resultat

  • Börja med omkring 300 DPI. Det är ofta en bra balans mellan läsbara detaljer och bearbetningstid. Högre upplösning kräver mer tid och minne.
  • Räta upp innan OCR. De flesta skannrar erbjuder automatisk rotation; även en liten lutning kan försämra igenkänningskvaliteten.
  • Ett språk per körning. Motorn känner igen ett språk i taget, så välj det som dominerar. För ett tvåspråkigt dokument kör du det en gång per språk och behåller det bästa resultatet.
  • Behåll alltid originalet. OCR ger små fel; det osynliga lagret är en bekvämlighet, inte ett bevis.

Vanliga frågor

Det ursprungliga sidinnehållet behålls. Den igenkända texten läggs till som ett osynligt lager inriktat mot det, så sidans utseende bör förbli oförändrat. Kontrollera resultatet om exakt visuell trohet är viktig.

Sju språk med latinsk skrift: engelska, spanska, franska, tyska, italienska, portugisiska och nederländska. Välj det som stämmer med ditt dokument. Skriftsystem som kyrilliska, arabiska och CJK (kinesiska, japanska, koreanska) finns inte i det här verktyget.

Inte tillförlitligt. Det här verktyget är avsett för tryckt text. Handskriftsigenkänning är en annan teknik, så kontrollera eller transkribera handskrivet material separat.

Nej. Resultatet är en vanlig sökbar PDF: dina ursprungliga sidbilder plus ett osynligt OCR-textlager. Det är ingen certifierad PDF/A-arkivfil. Om ditt arbetsflöde kräver PDF/A konverterar och validerar du resultatet med ett särskilt PDF/A-verktyg.

OCR körs helt i din webbläsare, så din käll-PDF skickas inte till en server för igenkänning. En vanlig lokal nedladdning stannar på din enhet. Endast om du väljer Skapa en nedladdningssida laddas den färdiga sökbara PDF:en upp till vår server. Käll-PDF:en stannar lokalt och det uppladdade resultatet sparas i upp till 7 dagar.

Relaterade verktyg