Vad är en skannad PDF? Så skiljer du den från en digital PDF på 10 sekunder
En skannad PDF är en PDF vars sidor är bilder av papper, tagna med en skanner eller en mobilkamera, i stället för text och vektorformer som skrivits på en dator. Om inte OCR har lagt till ett dolt textlager kan du inte markera, söka i eller kopiera orden, och en skärmläsare hittar ingenting att läsa upp på sidan.
Du har fått en PDF och behöver veta vad den egentligen är: en fil som exporterats från ett ordbehandlingsprogram, en skanning av papper eller en skanning med igenkänd text. Svaret avgör om du kan söka i den, om en domstol eller myndighet godtar den och om den behöver OCR.
Den här förklaringen ger en exakt definition, ett test som tar 10 sekunder, en jämförelse av de tre typerna av PDF och en ordlista. Fakta kommer från W3C:s riktlinjer för tillgänglighet, amerikanska federala domstolar, USCIS, NARA:s och FADGI:s regler för digitalisering, GOV.UK och universitetens tillgänglighetsteam, plus det vi har lärt oss av att bygga ett verktyg för skanningseffekt.
Vad är en skannad PDF, egentligen?
En skannad PDF är en PDF-behållare som innehåller en rasterbild per sida, framställd genom att ett fysiskt ark fotograferas eller skannas. Bokstäverna du ser är pixlar, inte tecken. Programvara behandlar varje sida som ett foto, så vanlig textsökning, kopiering och omflödning av texten fungerar inte utan OCR.
USA:s distriktsdomstol för Northern District of California, som hänvisar till National Archives riktlinjer för överföring av handlingar, säger det på en rad: ”Skannad text är ett fotografi av en tryckt sida, framställt antingen med en digitalkamera eller med en skanner” (N.D. Cal., Preparing Your CM/ECF Filing). Själva PDF-formatet ändras inte: en skannad PDF är fortfarande en giltig ISO 32000-fil. Det som ändras är vad som finns inuti varje sida.
Tillgänglighetsteamet vid James Madison University beskriver resultatet ur läsarens perspektiv: ”PDF:er av skannade dokument är ofta bara bilder av dokument, ungefär som digitala fotografier, och innehåller vanligtvis ingen läsbar text” (JMU Digital Accessibility). Det enda faktumet förklarar nästan alla praktiska skillnader som tas upp nedan.
Här är definitionen uppdelad i delar som går att kontrollera, på samma sätt som en registrator eller en tillgänglighetsgranskare skulle titta på en fil.
- Sidinnehåll
- En bitmappsbild per sida (JPEG-, JBIG2-, CCITT- eller liknande komprimering), inte teckensnittsglyfer och vektorbanor.
- Textlager
- Inget i en PDF med bara bilder; ett osynligt OCR-lager i en sökbar skannad PDF.
- Källa
- En flatbäddsskanner eller en skanner med arkmatning, en multifunktionskopiator eller en mobilkamera med en skanningsfunktion som är inbyggd i operativsystemet.
- Typisk upplösning
- 200 till 400 ppi; 300 ppi är det vanligaste kravet för kontorstext.
- Färgläge
- Bitonalt (svartvitt, 1 bit), gråskala (8 bitar) eller färg (24 bitar).
- Beteende vid zoomning
- Kanterna blir synliga pixelblock vid kraftig förstoring.
- Filstorlek
- Oftast större per sida än en text-PDF, särskilt i gråskala eller färg.
Hur skiljer sig en skannad PDF från en digital PDF?
En skannad PDF lagrar bilder av sidor, medan en digital (digitalt skapad) PDF lagrar riktiga tecken, typsnitt och vektorgrafik som exporterats från ett program. En tredje typ, den skannade PDF:en med OCR, behåller sidbilden men lägger till dold maskinläsbar text under den, vilket gör den till en sökbar PDF.
District of Massachusetts drar samma gräns i sina regler för elektronisk inlämning: en skannad PDF kommer från papper som körts genom en optisk skanner, medan en ”elektroniskt konverterad” PDF skapas i ett ordbehandlingsprogram och är sökbar (D. Mass. CM/ECF Administrative Procedures). Tabellen ställer de tre typerna bredvid varandra.
| Egenskap | Digitalt skapad PDF | Skannad PDF med bara bilder | Skannad PDF + OCR (sökbar) |
|---|---|---|---|
| Hur den skapas | Export eller utskrift till PDF från Word, Google Dokument, en webbläsare eller valfritt program | Skanner, kopiator eller mobilkamera | Först skanning, sedan lägger ett OCR-program till text |
| Vad en sida innehåller | Tecken, inbäddade typsnitt, vektorlinjer, bilder | En rasterbild | En rasterbild plus osynlig text |
| Markera och kopiera text | Ja, exakt | Nej | Ja, men bara så exakt som OCR:en |
| Sökning med Ctrl/Cmd+F | Fungerar | Hittar ingenting | Fungerar, kan missa feltolkade ord |
| Skärmläsare | Läsbar, bäst med taggar | Tyst | Läsbar, ofta utan struktur |
| Zoom till 400 % | Skarpa kanter i alla storlekar | Pixlig | Pixlig |
| Typisk storlek per sida | Tiotals kB | Cirka 75 kB (bitonal) till över 1 MB (gråskala eller färg) | Samma som med bara bilder plus ett litet textlager |
| Ser ut som papper | Nej | Ja | Ja |
Storlekarna per sida i tabellen bygger på domstolars tester, inte på gissningar. Northern District of California skannade ett dokument på 317 sidor: bitonalt med 300 ppi blev det 23,86 MB, cirka 75 kB per sida, och i gråskala med 400 ppi nådde det 374,47 MB, cirka 1,2 MB per sida. Middle District of North Carolina konstaterar att 2 MB rymmer ungefär fyrtiofem sidor PDF-text, under 50 kB per sida.
Vad betyder skannad kopia jämfört med fotokopia?
En skannad kopia är en digital bildfil av ett pappersoriginal, som oftast levereras som en skannad PDF eller JPEG. En fotokopia är ett andra pappersark som skrivits ut av en kopiator. En bestyrkt kopia är en kopia som en behörig person har jämfört med originalet och skrivit under.
Folk använder ”skannad kopia” slarvigt, och de tre begreppen blandas ihop i formulär, mejl från HR och checklistor för visum. Skillnaderna spelar roll, eftersom en begäran om det ena inte uppfylls av de andra.
| Begrepp | Medium | Vem gör den | Vad den bevisar |
|---|---|---|---|
| Skannad kopia | Digital fil (PDF, JPEG, TIFF) | Vem som helst med skanner eller mobil | Att det finns en bild av dokumentet; ingenting om äktheten |
| Fotokopia | Papper | Vem som helst med kopiator | Samma sak: det är en reproduktion, inte originalet |
| Bestyrkt (vidimerad) kopia | Papper, ibland skannat i efterhand | En yrkesperson som har sett originalet | Att kopian stämmer med originalet, på den personens ord |
| Original | Papper eller ursprungligen digital fil | Utfärdaren | Själva dokumentet |
Den brittiska regeringen förklarar bestyrkande enkelt: ”Du kan bestyrka ett dokument som en korrekt kopia genom att låta en yrkesperson, till exempel en advokat, skriva under och datera det” (GOV.UK, Certifying a document). En skannad kopia av den bestyrkta sidan är fortfarande en skannad kopia; bestyrkandet finns på papperet, tillsammans med namnteckningen och datumet.
Så när en hyresvärd, arbetsgivare eller skola säger ”skicka en skannad kopia” menar de nästan alltid ”en tydlig digital bild av papperet, som PDF”. När de säger ”bestyrkt kopia” räcker det inte med en skanning, hur realistisk den än ser ut.
Hur ser du om en PDF är skannad?
För att se om en PDF är skannad försöker du markera ett ord på sidan och söka efter ett ord du kan se. Om ingenting markeras är PDF:en en fil med bara bilder. Zoomning, dokumentegenskaperna, typsnittslistan och filstorleken bekräftar sedan om filen är skannad, digital eller skannad med OCR.
De två första kontrollerna tar under 10 sekunder och fungerar i alla PDF-visare, även den som är inbyggd i Google Chrome och Microsoft Edge och i Förhandsvisning på macOS. Resten tar en minut och avgör de oklara fallen.
- Försök markera text. Dra markören över en rad. I en digitalt skapad PDF eller en PDF med OCR markeras enskilda ord. I en PDF med bara bilder markeras ingenting, eller så ritar vissa visare en rektangel runt hela sidbilden.
- Sök med Ctrl+F eller Cmd+F. Skriv ett ovanligt ord som du tydligt ser på första sidan. Noll träffar på ett ord som uppenbart finns där betyder att det inte finns något textlager. En träff betyder riktig text eller ett OCR-lager.
- Zooma till 400 %. Titta på kanten av en bokstav. Vektortext förblir knivskarp i alla zoomnivåer. En skannad sida visar pixeltrappsteg, mjuka grå kanter, prickar och ibland blockmönster från JPEG runt bokstäverna.
- Öppna dokumentegenskaperna. I Chromes PDF-visare använder du menyn med tre punkter och väljer Dokumentegenskaper; i Förhandsvisning på macOS väljer du Verktyg och sedan Visa inspektör. Fältet för producent eller program anger ofta en skanner, en kopiatormodell, en skanningsfunktion i mobilen eller en OCR-motor. Ett ordbehandlingsprogram eller ”Print to PDF” tyder på en digitalt skapad fil.
- Kontrollera typsnittslistan. PDF-program för datorn visar en flik för typsnitt i dokumentegenskaperna. En digitalt skapad PDF listar de typsnitt den använder. En skanning med bara bilder listar inga. En skanning med OCR listar ofta ett enda typsnitt som bara används för det osynliga lagret.
- Jämför storleken per sida. Dela filstorleken med antalet sidor. En text-PDF håller sig oftast under 50 kB per sida. En skanning i gråskala eller färg ligger ofta på flera hundra kB till över 1 MB per sida. Bitonala skanningar är kompakta, så storleken är den svagaste ledtråden.
Cleveland State Universitys lärobok om tillgänglighet rekommenderar samma snabba söktest: ”Om ordet markeras på sidan har den sökbar text och är inte en skannad bild av text” (Heather Caprette, Cleveland State University).
Metadata är en ledtråd, inte ett bevis. Fälten Producent och Skapare kan redigeras i många verktyg, även vårt, så lita mer på hur sidinnehållet beter sig när du markerar och zoomar än på vad egenskapspanelen säger.
Varför är skannade dokument svåra att söka i och läsa?
Skannade dokument är svåra att söka i och läsa eftersom en PDF med bara bilder inte innehåller några tecken som program kan indexera. Sökmotorer, skrivbordssökning, kopiera och klistra in, översättningsverktyg och skärmläsare behöver alla text. Utan ett OCR-lager är den skannade PDF:en en bild som bara seende läsare kan använda.
W3C:s Web Accessibility Initiative är rakt på sak i teknik PDF7 i WCAG-riktlinjerna: ”Ett dokument som består av skannade bilder av text är i sig otillgängligt, eftersom dokumentets innehåll är bilder och inte sökbar text” (W3C WAI, WCAG-teknik PDF7).
Samma W3C-sida räknar upp vad som går förlorat: ”Hjälpmedel kan inte läsa eller extrahera orden; användare kan inte markera, redigera, ändra storlek på eller bryta om texten, och de kan inte heller ändra text- och bakgrundsfärger; och upphovspersoner kan inte bearbeta PDF:en för tillgänglighet.” Botemedlet är OCR, så att det finns riktig text bakom bilden.
Georgetown Universitys tillgänglighetskontor lägger till den praktiska följden för alla som är beroende av hjälpmedel: ”Skannade PDF:er är en samling bilder och därför oläsliga för de flesta vanliga skärmläsare” (Accessibility at Georgetown).
Offentliga utgivare har gått längre. Brittiska Government Digital Service hävdar att information som publiceras i PDF, jämfört med HTML, är svårare att hitta, använda och underhålla (GDS-bloggen, GOV.UK). En skannad PDF med bara bilder är den extrema versionen av det problemet: inte ens orden är maskinläsbara.
| Uppgift | Digitalt skapad | Skanning med bara bilder | Skanning + OCR |
|---|---|---|---|
| Uppläsning med skärmläsare | Hela texten | Ingen | Text, ofta i fel ordning |
| Ombrytning i mobilen | Möjlig om den är taggad | Nej | Sällan |
| Kopiera ett citat | Exakt | Skriv av för hand | Kan innehålla OCR-fel |
| Hittas av skrivbordssökning | Ja | Bara filnamnet | Ja |
| Maskinöversättning | Ja | Kräver OCR först | Ja |
Vad gör OCR med en skannad PDF?
OCR, optisk teckenigenkänning, läser bokstavsformerna i en skannad PDF och skriver in motsvarande maskinläsbar text i ett osynligt lager bakom varje sidbild. Sidan ser exakt likadan ut, men den blir en sökbar PDF: ord kan hittas, markeras, kopieras och läsas upp.
Federal Agencies Digital Guidelines Initiative definierar det precist: ”Optical Character Recognition (OCR) är processen att omvandla en rasterbild av text till sökbar elektronisk text” (FADGI Technical Guidelines, 3:e uppl., 2023). OCR fungerar på maskinskriven, tryckt och, mindre pålitligt, handskriven text.
Vad OCR fixar i ett skannat dokument
- Sökning med Ctrl/Cmd+F och fulltextindexering börjar fungera.
- Text kan markeras, kopieras och klistras in i andra dokument.
- Skärmläsare får ord att läsa upp, vilket uppfyller W3C:s grundläggande åtgärd i PDF7.
- Domstolssystem som kräver textsökbara inlagor kan godta filen.
Vad OCR inte fixar
- Bildkvaliteten. Sidan är fortfarande en bild, så zoomning ger fortfarande pixlighet. JMU påpekar att för den som zoomar in ”blir resultatet pixligt och förvrängt eftersom e-texten ligger under bilden av texten”.
- Noggrannheten. Oskärpa, snedställning, låg upplösning och prickbrus orsakar feltolkningar, till exempel att ”rn” blir ”m” eller ”1” blir ”l”. Den dolda texten kan vara fel även om bilden ser rätt ut.
- Strukturen. Rubriker, läsordning, tabellceller och alt-text för bilder behöver fortfarande taggas manuellt för full tillgänglighet.
- Filstorleken. Sidbilderna finns kvar, så en skannad PDF med OCR är nästan lika stor som versionen med bara bilder.
När ber organisationer om en skannad kopia?
Organisationer ber om en skannad kopia när originalet finns på papper och de behöver en digital handling: bevis i invandringsärenden, domstolsbilagor, HR:s introduktionsdokument, undertecknade avtal och kvitton. Var och en sätter sina egna regler för format, upplösning och filstorlek, och vissa domstolar kräver sökbara PDF:er i stället för sådana med bara bilder.
Bevis i invandringsärenden (USCIS)
U.S. Citizenship and Immigration Services godtar skannade eller fotograferade bevis vid digital inlämning. Instruktionen är kort: ”Använd en skanner eller ta bilder av varje dokument”, och ”Se till att varje bild du bifogar är tydlig och att all text går att läsa” (USCIS, Tips for Filing Forms Online). Varje fil får vara upp till 12 MB, som PDF, JPG eller JPEG, med TIF eller TIFF godkänt för vissa formulär.
Federala domstolsinlagor (CM/ECF)
Federala system för elektronisk inlämning godtar bara PDF, och många domstolar föredrar digitalt skapade filer. Southern District of Florida anger att ”inlagor och huvuddokument som lämnas in elektroniskt i CM/ECF måste vara i textsökbart PDF-format” (S.D. Fla. CM/ECF FAQ). Skannade PDF:er är främst till för bilagor och undertecknat papper som saknar digitalt original.
Skanningsinställningar och storleksgränser varierar mellan domstolar. Western District of Washington kräver skanning i 300 dpi, svartvitt om inte färg är nödvändigt för innehållet, och sätter ett tak på 100 MB per dokument (W.D. Wash. technical FAQ). District of Minnesota begränsar varje bilaga till 35 MB i sina rutiner för brottmål inom ECF.
HR, hyresvärdar, skolor och banker
Arbetsgivare och hyresvärdar vill oftast ha en skannad kopia av en id-handling, ett examensbevis, ett undertecknat anställningserbjudande eller en hyressida. De publicerar sällan tekniska regler; de flesta nämner bara en gräns för mejlbilagor och ber om att varje ord ska vara läsbart. När en portal inte anger några gränser är en gråskale-PDF i 300 dpi under 10 MB en rimlig standarduppskattning, inte en fastställd regel.
| Mottagare | Format | Regel för storlek eller upplösning | Krävs sökbar text? |
|---|---|---|---|
| USCIS digital inlämning | PDF, JPG, JPEG (TIF/TIFF för vissa formulär) | 12 MB per fil | Nej, men texten måste vara läsbar |
| W.D. Wash. domstol | 300 dpi, svartvitt; 100 MB per dokument | Beror på dokumenttyp | |
| S.D. Fla. domstol | Domstolens gränser gäller | Ja för huvuddokument | |
| D. Minn. brottmål (ECF) | 35 MB per bilaga | Kontrollera lokala regler | |
| Arbetsgivare eller hyresvärd | PDF eller bild | Oftast en mejlgräns | Sällan |
Kan en skannad PDF arkiveras som PDF/A?
En skannad PDF kan sparas som PDF/A, den arkiveringsversion av PDF som fastställs i ISO 19005, eftersom PDF/A tillåter sidbilder. PDF/A lägger till regler för läsning på lång sikt, som inbäddade typsnitt och inget krypteringsstöd, men det gör inte en sida med bara bilder sökbar. OCR är ett separat steg.
PDF/A släpptes första gången den 1 oktober 2005 och förbjuder funktioner som gör filer svåra att öppna årtionden senare, som typsnittslänkning och kryptering (Wikipedia, PDF/A). Microsoft Office kan exportera filer som följer ISO 19005-1 direkt från sina alternativ för att spara som PDF.
Domstolar som kräver PDF/A avråder ofta helt från att skanna. Eastern District of Oklahoma rekommenderar att PDF/A-dokument skapas i ett ordbehandlingsprogram i stället för att skrivas ut och skannas, för att hålla nere filstorleken och säkerställa textsökbara filer (E.D. Okla. PDF/A FAQ).
- Digitalt skapad PDF/A
- Minst och helt sökbar; bäst när ett digitalt original finns.
- Skannad PDF/A med OCR
- Arkivvärdig och sökbar; rätt val för handlingar som bara finns på papper.
- PDF/A med bara bilder
- Giltig för bevarande, men varken sökbar eller tillgänglig.
Hur får en digital PDF samma utseende som en skannad PDF?
En digital PDF får ett skannat utseende när varje sida rastreras till en bild och ges samma ofullkomligheter som en riktig skanner: lätt rotation, oskärpa, brus, grå- eller papperston. Resultatet är en PDF med bara bilder som beter sig som en skanning, utan att du skriver ut något eller äger en skanner.
Det är precis vad vårt kostnadsfria verktyg för skanningseffekt gör. Det renderar varje PDF-sida i din webbläsare, lägger på de effekter du väljer och sparar varje sida som en JPEG-bild i en ny PDF. Filerna bearbetas lokalt och laddas inte upp till någon server.
- Rotation
- −10° till 10°, standard 1°, plus slumpmässig variation per sida upp till 10°.
- Oskärpa
- 0 till 1, standard 0,3, mjukar upp vektorkanter på samma sätt som en skanners optik.
- Brus
- 0 till 1, standard 0,1, lägger till sensorliknande prickar.
- Ljusstyrka och kontrast
- 0 till 2 vardera, standard 1.
- Gulton
- 0 till 2, standard 0, tonar sidan som gulnat papper.
- Färgrymd
- Gråskala (standard) eller Färg.
- Upplösning
- 1× till 3×; PDF-sidor renderas vid 72 dpi gånger skalan, så 2× blir ungefär 144 dpi och 3× ungefär 216 dpi.
Eftersom resultatet bara innehåller bilder ärver det alla egenskaper som beskrivs ovan: ingen markerbar text, ingen sökning, större filer, ingen uppläsning med skärmläsare. Det är poängen för den som behöver ett dokument som ser ut som en skannad kopia, och en nackdel för den som behöver det sökbart. Spara originalfilen digitalt.
För hela arbetsflödet, inklusive avvägningar mellan upplösning och filstorlek, läs hur du konverterar en PDF till en skannad PDF. För alla sex metoderna, från utskrift och skanning till inbyggda alternativ i operativsystemet, se hur du får en PDF att se skannad ut. Utgår du i stället från ett mobilfoto? Guiden om att göra om en bild till en skannad PDF går igenom JPG och PNG.
Vi byggde vårt verktyg för att lägga på ett skannat utseende, och den vanligaste frågan vi får är egentligen ”vad var det jag skapade?”. Det ärliga svaret är en PDF med bara bilder. Den ser ut som papper, men orden är pixlar. Om en läsare behöver söka i den eller få den uppläst bör du spara det digitala originalet bredvid, eller köra OCR i efterhand. Vi vill hellre att folk vet det innan de klickar på Ladda ned.Teamet bakom Make PDF look scanned — de som byggt webbverktyget och Chrome-tillägget
Ordlista för skannade dokument: vilka termer spelar roll?
Ett skannat dokument kommer med ett eget ordförråd: dpi och ppi, bitdjup, bitonalt, OCR, rastrera, PDF/A och JBIG2. Att känna till dessa sju termer räcker för att förstå alla skanningskrav från en domstol, myndighet eller arbetsgivare, och för att bedöma en skannad PDF du får.
- dpi / ppi
- Punkter eller pixlar per tum: hur många bildsampel som täcker en tum papper. NARA kräver minst 300 ppi för moderna texthandlingar och 400 ppi för fotografier och handlingar med fina detaljer. PDF-sidors geometri använder 72 punkter per tum, vilket är anledningen till att en rendering i 1× motsvarar 72 dpi.
- Bitdjup
- Bitar som lagras per pixel. Bitonalt är 1 bit, gråskala är 8 bitar (256 nyanser), och en typisk färgskanning är 24 bitar (8 bitar i var och en av tre kanaler).
- Bitonalt
- FADGI:s definition: ”Digitala bilder framställda med bara två färger, svart och vitt.” Det minsta läsbara formatet för vanlig text.
- OCR
- Optisk teckenigenkänning: programvara som omvandlar bokstavsformerna i en bild till maskinläsbar text, vilket skapar en sökbar PDF.
- Rastrera
- Att omvandla vektortext och vektorformer till ett rutnät av pixlar. Att rastrera en digital PDF gör den till en PDF med bara bilder.
- PDF/A
- ISO 19005, arkiveringsdelmängden av PDF, som släpptes 2005; den förbjuder funktioner som kryptering och typsnittslänkning.
- JBIG2
- En komprimeringsmetod för bitonala skanningar som lagrar återkommande symboler bara en gång. BBC News rapporterade 2013 att vissa kontorskopiatorer som använde ett förlustbehäftat JBIG2-läge ändrade siffror i skanningar, ofta så att en 6:a blev en 8:a; i ett test blev ett rums mått på 21,11 m i stället 14,13 m.
- PDF med bara bilder
- En skannad PDF helt utan textlager.
- Sökbar PDF
- En PDF med riktig text eller OCR-text som går att söka i och markera.
JBIG2-fallet är det starkaste argumentet för att spara original. En skannad kopia är en bild, och bilder kan ändras av komprimering utan att någon märker det (BBC News, 2013). NARA betraktar även brus som en oönskad artefakt som ”inte är en del av källmaterialet” (36 CFR 1236 Subpart E).
Vanliga frågor om skannade PDF:er: vad undrar folk mer?
De här frågorna om skannade PDF:er kommer oftast från personer som har fått en fil, behöver skicka en skannad kopia eller måste uppfylla en domstols- eller myndighetsregel. Varje svar står för sig, så du kan hoppa direkt till det som matchar din situation och agera utifrån det.
Vad är en skannad PDF i enkla ord?
En skannad PDF är en PDF gjord av foton av pappersidor. Texten du ser är en del av en bild, så du kan inte markera eller söka i den om inte OCR har använts.
Är en skannad PDF samma sak som en skannad kopia?
Nästan. En skannad kopia är vilken digital bild som helst av ett pappersdokument, och en skannad PDF är det vanligaste filformatet för att leverera en sådan. En skannad kopia kan också vara en JPEG eller TIFF.
Hur ser jag om en PDF är skannad på 10 sekunder?
Försök markera ett ord, tryck sedan Ctrl+F eller Cmd+F och sök efter ett ord du kan se. Om ingenting markeras och sökningen inte hittar något är PDF:en en skanning med bara bilder. Zooma till 400 % för att bekräfta: skannad text ser pixlig ut.
Kan en skannad PDF vara sökbar?
Ja. OCR lägger till ett osynligt textlager bakom sidbilderna, vilket gör en skannad PDF till en sökbar PDF. Sidan ser fortfarande ut som en skanning, och feltolkade ord kan förekomma i den dolda texten.
Varför kan jag inte kopiera text från min PDF?
PDF:en är med största sannolikhet en skanning utan OCR, så det finns inga tecken att kopiera. Southern District of Floridas domstols-FAQ konstaterar samma sak: om en PDF inte är textsökbar går texten inte att kopiera. Kör OCR eller be om det digitala originalet.
Är skannade PDF:er tillgängliga för skärmläsare?
Inte utan OCR. W3C:s riktlinjer kallar skanningar med bara bilder i sig själva otillgängliga. Efter OCR kan skärmläsare läsa upp texten, men full tillgänglighet kräver även taggar för rubriker, läsordning och tabeller.
Varför är en skannad PDF så stor?
Varje sida är en hel bild. En gråskalesida i 400 ppi kan bli större än 1 MB, medan en textsida från ett ordbehandlingsprogram ofta är under 50 kB. Att skanna i 300 ppi i gråskala eller svartvitt håller nere storleken.
Vilken upplösning bör ett skannat dokument ha?
För maskinskriven eller tryckt text är 300 dpi standardkravet i amerikanska federala domstolar och NARA:s minimikrav för texthandlingar. Foton och fina detaljer kräver 400 ppi.
Är en skannad kopia en juridisk eller bestyrkt kopia?
Nej, en skannad kopia bevisar i sig ingenting om äktheten. En bestyrkt kopia är undertecknad och daterad av en yrkesperson som har sett originalet, som GOV.UK förklarar. Fråga den som begär kopian vilken typ de behöver.
Kan jag få en digital PDF att se ut som en skannad PDF?
Ja. Det kostnadsfria verktyget Make PDF look scanned rastrerar varje sida och lägger till rotation, oskärpa, brus och papperston i din webbläsare. Resultatet är en PDF med bara bilder, så spara originalet om du behöver sökbarhet.
Måste en skannad PDF vara PDF/A?
Bara om den som begär det säger det. Vissa domstolar och arkiv kräver PDF/A för lagring på lång sikt. En skannad PDF kan sparas som PDF/A, helst med OCR så att den även blir sökbar.
Kan jag skanna flera PDF:er samtidigt?
Med vårt verktyg, ja: Batchskanning bearbetar flera filer och laddar ned dem som en enda ZIP, med en skannad PDF per inmatad fil.
Vad är det korta svaret om skannade PDF:er?
En skannad PDF är en bild av papper inuti en PDF. Testa den genom att markera och söka i texten, lägg till OCR när du behöver sökbarhet eller tillgänglighet, skicka en digitalt skapad PDF när en domstol föredrar det, och använd ett skannat utseende bara när det är utseendet, inte äktheten, som läsaren behöver.
Om det är utseendet du behöver: öppna det kostnadsfria skanningsverktyget, behåll standardvärdena Gråskala som färgrymd och 2× upplösning, och kontrollera förhandsvisningen innan du laddar ned.
Behöver du en PDF som ser ut som en skannad kopia?
Släpp en digital PDF i gratisverktyget, ställ in lutning, brus och papperston och ladda ned en bildbaserad PDF som ser ut som en riktig skanning. Allt körs i din webbläsare.