Extrahera bilder från PDF

Ladda upp PDF

Ladda upp en PDF och återställ varje inbäddad bild i sin ursprungliga upplösning. Extraheraren går igenom PDF:ens objektträd, hittar /XObject /Image-poster och exporterar varje bild som PNG, ingen skärmbild, ingen kvalitetsförlust från att rastrera hela sidan. Fungerar med skanningar, fotorika rapporter, produktkataloger och broschyrer.

Så extraherar du bilder från en PDF

  1. 1

    Ladda upp PDF:en

    Släpp en enda fil; krypterade PDF:er måste låsas upp först.

  2. 2

    Skanna objektträdet

    Extraheraren räknar upp varje bild-XObject över alla sidor.

  3. 3

    Förhandsgranska resultaten

    Du ser varje bild som en miniatyr med dess sidnummer och mått.

  4. 4

    Ladda ner individuellt eller som ZIP

    Ta en enskild resurs eller exportera allt i ett arkiv, namngett `image-p1-1.png`.

Hur bilder lever inuti en PDF

En PDF lagrar bilder som separata resurser (/XObject-strömmar) som refereras från sidinnehållet. Extraheraren läser varje ström i dess ursprungliga kodning och rekonstruerar filen som författaren bäddade in.

Format du kommer att se

PDF-filter Vad du får Typisk källa
/DCTDecode PNG (från en JPEG) Foton, produktbilder, skanningar
/FlateDecode + RGB PNG Logotyper, diagram, UI-skärmbilder
/JPXDecode PNG (från JPEG 2000) Arkivskanningar i hög upplösning
/CCITTFaxDecode PNG (från en skanning) Svartvit skannad text
/JBIG2Decode PNG (konverterad) Komprimerade skannade dokument

Extraheraren levererar alltid PNG: den kodar om råpixlarna i din webbläsare, så JPEG-, JPEG-2000- och CCITT-källor kommer också fram som PNG.

Vad den inte kan återställa

  • Vektorillustrationer. Logotyper ritade med PDF-banoperatorer är inte bilder, de lever i innehållsströmmen, inte som XObjects. Använd ett PDF-till-SVG-verktyg för dem.
  • Bakgrundsfärger och gradienter. De är ritning på sidnivå, inte inbäddade resurser.
  • Text renderad som konturer. Verkar vara “grafik” men är inte ett bildobjekt.

Tips när du arbetar med exporten

  • Kontrollera måtten. En 300x300-miniatyr på sidan kan faktiskt vara ett 3000x3000-original nedskalat vid renderingstillfället. Du får källans pixlar, inte visningsstorleken.
  • Respektera licensen. Att kunna extrahera en bild ger inte rättigheter att återanvända den. Stockbilder i en PDF förblir stockbilder när de plockas ut.
  • Skannade dokument. Om varje sida producerar en jättelik bild med text inbränd är PDF:en en skanning. Kör OCR på de exporterade PNG:erna för att återställa texten.

Vanliga frågor

PDF-sidor kan tillämpa en transformationsmatris på hur en bild ritas (vänd, rotera, snedställ). Extraheraren returnerar den lagrade bitmappen, råa pixlar. Om en utgivare lagrade bilden upp-och-ner och vände den vid renderingstillfället kommer exporten att se upp-och-ner ut. Rotera tillbaka den i valfri bildredigerare.

Endast efter att du låst upp dem. Kör först filen genom ett PDF-upplåsningsverktyg, ange ägarlösenordet, och extrahera sedan.

Ja. Bilderna läggs till i sidordning och varje filnamn innehåller sidnumret, till exempel image-p1-2.png, så att du ser vilken sida varje bild kommer från.

Nej. Käll-PDF:en öppnas och läses helt i din webbläsare och skickas aldrig till servern. Endast ZIP-arkivet med de extraherade bilderna laddas upp för att skapa det sessionsskyddade resultatet; det sparas i upp till 7 dagar och raderas därefter.

Relaterade verktyg

Verktyget finns på andra språk