Mikä on skannattu PDF? Näin erotat sen digitaalisesta PDF:stä 10 sekunnissa

Skannattu PDF on PDF, jonka sivut ovat kuvia paperista – kuvattuna skannerilla tai puhelimen kameralla – eikä tietokoneella kirjoitettua tekstiä ja vektorimuotoja. Ellei OCR ole lisännyt piilotettua tekstikerrosta, et voi valita, hakea tai kopioida sen sanoja, eikä ruudunlukuohjelma lue sivulta mitään.

Make PDF look scanned — 5 tähden arvio Chrome Web Storessa
2026 – ilmainen skannausefektityökalu, joka toimii paikallisesti selaimessasi, ilman rekisteröitymistä

Sait PDF:n ja haluat tietää, mikä se oikeasti on: tekstinkäsittelyohjelmasta viety tiedosto, skannaus paperista, vai skannaus tunnistetulla tekstillä. Vastaus ratkaisee, voitko hakea siitä tekstiä, hyväksyykö tuomioistuin tai viranomainen sen, ja tarvitseeko se OCR:ää.

Tämä selitys antaa tarkan määritelmän, 10 sekunnin testin, kolmen PDF-tyypin vertailun ja sanaston. Tiedot perustuvat W3C:n saavutettavuusohjeisiin, Yhdysvaltain liittovaltion tuomioistuimiin, USCIS:ään, NARA:han ja FADGI:n digitointisääntöihin, GOV.UK:hon ja yliopistojen saavutettavuustiimeihin, sekä siihen, mitä tiedämme skannausefektityökalun rakentamisesta.

Mikä skannattu PDF tarkalleen on?

Skannattu PDF on PDF-säiliö, joka sisältää yhden rasterikuvan sivua kohden, tuotettuna kuvaamalla tai skannaamalla fyysinen paperiarkki. Näkemäsi kirjaimet ovat pikseleitä, eivät merkkejä. Ohjelmisto käsittelee jokaista sivua kuin valokuvaa, joten pelkkä tekstihaku, kopiointi ja uudelleentaitto eivät toimi ilman OCR:ää.

Yhdysvaltain Kalifornian pohjoisen piirikunnan käräjäoikeus toteaa National Archivesin siirto-ohjeisiin viitaten yhdellä lauseella: ”Skannattu teksti on valokuva tulostetusta sivusta, tuotettuna joko digitaalikameralla tai skannerilla” (N.D. Cal., Preparing Your CM/ECF Filing). PDF-muoto itsessään ei muutu: skannattu PDF on yhä kelvollinen ISO 32000 -tiedosto. Se, mikä muuttuu, on sisältö jokaisen sivun sisällä.

James Madisonin yliopiston saavutettavuustiimi kuvailee lopputulosta lukijan näkökulmasta: ”Skannattujen asiakirjojen PDF:t ovat usein vain kuvia asiakirjoista, digitaalisten valokuvien tapaan, eivätkä yleensä sisällä luettavaa tekstiä” (JMU Digital Accessibility). Tuo yksi tosiasia selittää lähes jokaisen alla käsitellyn käytännön eron.

Tässä on määritelmä pilkottuna tarkastettaviin osiin, samaan tapaan kuin arkistovirkailija tai saavutettavuustarkastaja tarkastelisi tiedostoa.

Sivun sisältö
Yksi bittikarttakuva sivua kohden (JPEG-, JBIG2-, CCITT- tai vastaava pakkaus), ei fonttimerkkejä ja vektoripolkuja.
Tekstikerros
Ei mitään pelkästä kuvasta koostuvassa PDF:ssä; näkymätön OCR-kerros haettavassa skannatussa PDF:ssä.
Lähde
Tasoskanneri tai arkinsyöttöskanneri, monitoimikopiokone, tai puhelimen kamera käyttöjärjestelmään sisäänrakennetulla skannaussovelluksella.
Tyypillinen tarkkuus
200–400 ppi; 300 ppi on yleisin vaatimus toimistotekstille.
Väritila
Kaksisävyinen (1-bittinen mustavalkoinen), harmaasävy (8-bittinen) tai värillinen (24-bittinen).
Zoomauskäyttäytyminen
Reunat muuttuvat näkyviksi pikselilohkoiksi suurella suurennoksella.
Tiedostokoko
Yleensä suurempi sivua kohden kuin tekstipohjaisessa PDF:ssä, varsinkin harmaasävynä tai värillisenä.

Miten skannattu PDF eroaa digitaalisesta PDF:stä?

Skannattu PDF tallentaa kuvia sivuista, kun taas digitaalinen (alun perin sähköinen) PDF tallentaa oikeita merkkejä, fontteja ja vektorigrafiikkaa, jotka on viety ohjelmistosta. Kolmas laji, skannattu PDF OCR:llä, säilyttää sivun kuvana mutta lisää piilotetun koneluettavan tekstin sen alle, mikä tekee siitä haettavan PDF:n.

Massachusettsin piirikunta vetää saman rajan sähköisen arkistoinnin säännöissään: skannattu PDF syntyy paperista, joka on ajettu optisen skannerin läpi, kun taas ”sähköisesti muunnettu” PDF luodaan tekstinkäsittelyohjelmasta ja on tekstihaettava (D. Mass. CM/ECF Administrative Procedures). Taulukko asettaa kolme lajia rinnakkain.

Kolme PDF-lajia: digitaalisesti syntynyt, pelkästä kuvasta koostuva skannaus ja skannaus OCR:llä
OminaisuusDigitaalisesti syntynyt PDFKuvapohjainen skannattu PDFSkannattu PDF + OCR (haettava)
Miten se syntyyVienti tai tulostus PDF:ksi Wordista, Google Docsista, selaimesta tai mistä tahansa sovelluksestaSkanneri, kopiokone tai puhelimen kameraEnsin skannaus, sitten OCR-ohjelmisto lisää tekstin
Mitä sivu sisältääMerkkejä, upotettuja fontteja, vektoriviivoja, kuviaYksi rasterikuvaYksi rasterikuva ja näkymätön teksti
Tekstin valinta ja kopiointiKyllä, tarkastiEiKyllä, mutta vain yhtä tarkasti kuin OCR
Ctrl/Cmd+F-hakuToimiiEi löydä mitäänToimii, saattaa jättää huonosti tunnistetut sanat väliin
RuudunlukuohjelmatLuettava, parhaimmillaan merkittynäHiljainenLuettava, usein ilman rakennetta
Zoomaus 400 %:iinTerävät reunat missä tahansa koossaPikseloitunutPikseloitunut
Tyypillinen koko sivua kohdenKymmeniä kilotavujaNoin 75 kt (kaksisävyinen) – yli 1 Mt (harmaasävy tai väri)Sama kuin kuvapohjainen plus pieni tekstikerros
Näyttää paperiltaEiKylläKyllä

Taulukon sivukohtaiset koot on johdettu oikeuslaitosten testeistä, ei arvauksista. Kalifornian pohjoinen piirikunta skannasi 317-sivuisen asiakirjan: kaksisävyisenä 300 ppi:llä tuloksena oli 23,86 Mt, noin 75 kt sivua kohden, ja harmaasävynä 400 ppi:llä 374,47 Mt, noin 1,2 Mt sivua kohden. Pohjois-Carolinan keskinen piirikunta huomauttaa, että 2 Mt vastaa noin 45 sivua PDF-tekstiä, alle 50 kt sivua kohden.

Mitä skannattu kopio tarkoittaa verrattuna valokopioon?

Skannattu kopio on paperisen alkuperäiskappaleen digitaalinen kuvatiedosto, yleensä toimitettuna skannattuna PDF:nä tai JPEG-kuvana. Valokopio on kopiokoneella tulostettu toinen paperiarkki. Oikeaksi todistettu kopio on mikä tahansa kopio, jonka valtuutettu henkilö on tarkistanut alkuperäistä vasten ja allekirjoittanut.

Ihmiset käyttävät ilmaisua ”skannattu kopio” väljästi, ja nämä kolme termiä menevät sekaisin lomakkeissa, HR-sähköposteissa ja viisumitarkistuslistoissa. Erot ovat tärkeitä, koska yhden pyytäminen ei täyty muilla.

Skannattu kopio, valokopio ja oikeaksi todistettu kopio vertailtuna
TermiVälineKuka sen tekeeMitä se todistaa
Skannattu kopioDigitaalinen tiedosto (PDF, JPEG, TIFF)Kuka tahansa, jolla on skanneri tai puhelinEttä kuva asiakirjasta on olemassa; ei mitään aitoudesta
ValokopioPaperiKuka tahansa, jolla on kopiokoneSama: se on jäljennös, ei alkuperäinen
Oikeaksi todistettu (aito) kopioPaperi, joskus skannattu jälkikäteenAmmattilainen, joka on nähnyt alkuperäisenEttä kopio vastaa alkuperäistä, kyseisen henkilön sanan mukaan
AlkuperäinenPaperi tai alun perin digitaalinen tiedostoAsiakirjan antajaItse asiakirja

Britannian hallitus selittää oikeaksi todistamisen suoraan: ”Voit todistaa asiakirjan oikeaksi kopioksi hankkimalla siihen ammattihenkilön, kuten lakimiehen, allekirjoituksen ja päiväyksen” (GOV.UK, Certifying a document). Skannattu kopio tuosta oikeaksi todistetusta sivusta on yhä skannattu kopio; todistus elää paperilla, allekirjoituksineen ja päiväyksineen.

Kun vuokranantaja, työnantaja tai koulu sanoo ”lähetä skannattu kopio”, he tarkoittavat lähes aina ”selkeä digitaalinen kuva paperista, PDF-muodossa”. Kun he sanovat ”oikeaksi todistettu kopio”, pelkkä skannaus ei riitä, vaikka se näyttäisi kuinka aidolta tahansa.

Miten tunnistat, onko PDF skannattu?

Tunnistaaksesi, onko PDF skannattu, yritä valita sivulta sana ja hae sanaa, jonka näet. Jos mikään ei korostu, PDF on kuvapohjainen. Zoomaus, asiakirjan ominaisuudet, fonttiluettelo ja tiedostokoko vahvistavat sitten, onko tiedosto skannattu, digitaalinen vai skannattu OCR:llä.

Kaksi ensimmäistä tarkistusta vievät alle 10 sekuntia ja toimivat missä tahansa PDF-katseluohjelmassa, mukaan lukien Google Chromen, Microsoft Edgen ja macOS Esikatselun sisäänrakennetut katseluohjelmat. Loput vievät minuutin ja ratkaisevat epäselvät tapaukset.

  1. Yritä valita tekstiä. Vedä kohdistinta rivin yli. Digitaalisesti syntyneessä tai OCR:llä käsitellyssä PDF:ssä yksittäiset sanat korostuvat. Kuvapohjaisessa PDF:ssä mikään ei korostu, tai jotkin katseluohjelmat piirtävät suorakulmion koko sivukuvan ympärille.
  2. Hae Ctrl+F:llä tai Cmd+F:llä. Kirjoita erottuva sana, jonka näet selvästi sivulla yksi. Nolla osumaa sanaan, joka selvästi on siellä, tarkoittaa, ettei tekstikerrosta ole. Osuma tarkoittaa oikeaa tekstiä tai OCR-kerrosta.
  3. Zoomaa 400 %:iin. Katso kirjaimen reunaa. Vektoriteksti pysyy partaveitsenterävänä millä tahansa zoomilla. Skannattu sivu näyttää pikseliportaat, himmeät harmaat reunukset, rakeisuuden ja joskus JPEG-lohkokuviot kirjainten ympärillä.
  4. Avaa asiakirjan ominaisuudet. Chromen PDF-katseluohjelmassa käytä kolmen pisteen valikkoa ja valitse Asiakirjan ominaisuudet; macOS Esikatselussa käytä Työkalut, sitten Näytä tarkastaja. Tuottaja- tai sovelluskenttä nimeää usein skannerin, kopiokonemallin, puhelimen skannaustoiminnon tai OCR-moottorin. Tekstinkäsittelyohjelma tai ”Print to PDF” viittaa digitaalisesti syntyneeseen tiedostoon.
  5. Tarkista fonttiluettelo. Tietokoneen PDF-ohjelma näyttää Fontit-välilehden asiakirjan ominaisuuksissa. Digitaalisesti syntynyt PDF luettelee käyttämänsä kirjasintyypit. Kuvapohjainen skannaus ei luettele yhtään. OCR-käsitelty skannaus luettelee usein yhden fontin, jota käytetään vain näkymättömässä kerroksessa.
  6. Vertaa kokoa sivua kohden. Jaa tiedostokoko sivumäärällä. Tekstipohjainen PDF pysyy yleensä alle 50 kt:ssa sivua kohden. Harmaasävy- tai värillinen skannaus on usein useita satoja kilotavuja tai yli 1 Mt sivua kohden. Kaksisävyiset skannaukset ovat kompakteja, joten koko on heikoin vihje.

Clevelandin osavaltionyliopiston saavutettavuusoppikirja suosittelee samaa nopeaa hakutestiä: ”Jos sana korostuu sivulla, siinä on haettavaa tekstiä sen sijaan, että se olisi tekstin skannattu kuva” (Heather Caprette, Cleveland State University).

Sekalaisten tulosten tulkintaTeksti valikoituu, mutta zoomaus näyttää pikseleitä: skannattu PDF OCR:llä. Teksti valikoituu ja zoomaus pysyy terävänä: digitaalisesti syntynyt. Mikään ei valikoidu ja zoomaus näyttää pikseleitä: kuvapohjainen. Mikään ei valikoidu, mutta reunat pysyvät terävinä: teksti muunnettu vektoriääriviivoiksi, harvinainen neljäs tapaus, joka käyttäytyy haussa kuin skannaus.

Metadata on vihje, ei todiste. Tuottaja- ja luoja-kenttiä voi muokata monella työkalulla, myös omallamme, joten luota siihen, mitä sivun sisältö tekee valinnan ja zoomauksen alla, ennemmin kuin siihen, mitä ominaisuuspaneeli kertoo.

Skannatut asiakirjat ovat vaikeita hakea ja lukea, koska kuvapohjainen PDF ei sisällä merkkejä, joita ohjelmisto voisi indeksoida. Hakukoneet, työpöytähaku, kopiointi ja liittäminen, käännöstyökalut ja ruudunlukuohjelmat tarvitsevat kaikki tekstiä. Ilman OCR-kerrosta skannattu PDF on kuva, jota vain näkevät lukijat voivat käyttää.

W3C:n Web Accessibility Initiative sanoo asian suoraan WCAG-ohjeiston tekniikassa PDF7: ”Asiakirja, joka koostuu skannatuista tekstikuvista, on lähtökohtaisesti saavuttamaton, koska asiakirjan sisältö on kuvia, ei haettavaa tekstiä” (W3C WAI, WCAG Technique PDF7).

Sama W3C-sivu listaa, mikä menetetään: ”Avustavat teknologiat eivät voi lukea tai poimia sanoja; käyttäjät eivät voi valita, muokata, muuttaa kokoa tai taittaa tekstiä uudelleen eivätkä muuttaa tekstin ja taustan värejä; ja tekijät eivät voi muokata PDF:ää saavutettavuuden vuoksi.” Sen korjauskeino on OCR, jotta kuvan takana olisi oikeaa tekstiä.

Georgetownin yliopiston saavutettavuustoimisto lisää käytännön seurauksen kaikille, jotka luottavat avustavaan teknologiaan: ”Skannatut PDF:t ovat kuvien kokoelmia, minkä vuoksi ne ovat useimmille tavallisille ruudunlukuohjelmille lukukelvottomia” (Accessibility at Georgetown).

Julkisen sektorin julkaisijat ovat menneet pidemmälle. Britannian hallituksen digitaalipalvelu (GDS) toteaa, että verrattuna HTML:ään PDF-muodossa julkaistu tieto on vaikeampi löytää, käyttää ja ylläpitää (GDS blog, GOV.UK). Kuvapohjainen skannattu PDF on tämän ongelman äärimmäinen versio: edes sanat eivät ole koneluettavia.

Mikä toimii kussakin PDF-lajissa
TehtäväDigitaalisesti syntynytKuvapohjainen skannausSkannaus + OCR
Ruudunlukuohjelman tulosteKoko tekstiEi mitäänTeksti, usein väärässä järjestyksessä
Uudelleentaitto puhelimellaMahdollista, jos merkittyEiHarvoin
Lainauksen kopiointiTarkastiKirjoita käsin uudelleenVoi sisältää OCR-virheitä
Löytyy työpöytähaullaKylläVain tiedostonimiKyllä
KonekäännösKylläVaatii ensin OCR:nKyllä

Mitä OCR tekee skannatulle PDF:lle?

OCR, optinen merkintunnistus, lukee kirjainmuodot skannatussa PDF:ssä ja kirjoittaa vastaavan konetekstin näkymättömään kerrokseen jokaisen sivukuvan taakse. Sivu näyttää täsmälleen samalta, mutta siitä tulee haettava PDF: sanat voidaan löytää, valita, kopioida ja lukea ääneen.

Federal Agencies Digital Guidelines Initiative määrittelee sen tarkasti: ”Optinen merkintunnistus (OCR) on prosessi, jossa tekstin rasterikuva muunnetaan haettavaksi sähköiseksi tekstiksi” (FADGI Technical Guidelines, 3rd ed., 2023). OCR toimii kirjoitetulle, painetulle ja, epäluotettavammin, käsinkirjoitetulle tekstille.

Mitä OCR korjaa skannatussa asiakirjassa

Mitä OCR ei korjaa

OCR toimii kuvalle, ei paperilleTunnistuslaatu riippuu skannauksesta. Puhdas 300 ppi:n sivu suorilla riveillä tunnistuu paljon paremmin kuin vino, kohiseva puhelinkuva. Jos skannaus aiotaan käsitellä OCR:llä, skannaa se ensin suorana ja terävänä.

Milloin organisaatiot pyytävät skannattua kopiota?

Organisaatiot pyytävät skannattua kopiota, kun alkuperäinen on olemassa paperilla ja he tarvitsevat digitaalisen tallenteen: maahanmuuttotodisteet, oikeuden todistusaineiston, HR:n perehdytystiedostot, allekirjoitetut sopimukset ja kuitit. Jokainen asettaa omat sääntönsä muodolle, tarkkuudelle ja tiedostokoolle, ja jotkin tuomioistuimet vaativat haettavia PDF-tiedostoja kuvapohjaisten sijaan.

Maahanmuuttotodisteet (USCIS)

Yhdysvaltain kansalaisuus- ja maahanmuuttopalvelu hyväksyy skannattua tai kuvattua todistusaineistoa verkkohakemuksissa. Sen ohje on lyhyt: ”Käytä skanneria tai ota kuvia jokaisesta asiakirjasta”, ja ”Varmista, että jokainen liittämäsi kuva on selkeä ja kaikki teksti on luettavissa” (USCIS, Tips for Filing Forms Online). Jokainen tiedosto voi olla enintään 12 Mt, PDF-, JPG- tai JPEG-muodossa, TIF tai TIFF hyväksytään joissakin lomakkeissa.

Liittovaltion oikeuden jätöt (CM/ECF)

Liittovaltion sähköiset jättöjärjestelmät hyväksyvät vain PDF:n, ja monet tuomioistuimet suosivat digitaalisesti syntyneitä tiedostoja. Floridan eteläinen piirikunta toteaa, että ”sähköisesti CM/ECF:ään jätettyjen asiakirjojen/pääasiakirjojen on oltava tekstihaettavassa PDF-muodossa” (S.D. Fla. CM/ECF FAQ). Skannatut PDF:t ovat pääosin todistusaineistoa ja allekirjoitettua paperia, jolla ei ole digitaalista alkuperäistä.

Skannausasetukset ja kokorajat vaihtelevat tuomioistuimittain. Washingtonin läntinen piirikunta vaatii 300 dpi:n skannausta, mustavalkoisena ellei väri ole olennainen, ja rajaa jokaisen asiakirjan 100 Mt:iin (W.D. Wash. technical FAQ). Minnesotan piirikunta rajaa jokaisen todisteen 35 Mt:iin rikosasioiden ECF-ohjeissaan.

HR, vuokranantajat, koulut ja pankit

Työnantajat ja vuokranantajat haluavat yleensä skannatun kopion henkilöllisyystodistuksesta, tutkintotodistuksesta, allekirjoitetusta työtarjouksesta tai vuokrasopimuksen sivusta. He harvoin julkaisevat teknisiä sääntöjä; useimmat mainitsevat sähköpostin liitetiedostorajan ja pyytävät, että jokainen sana on luettavissa. Kun portaali ei listaa rajoja, 300 dpi:n harmaasävy-PDF alle 10 Mt:n koossa on järkevä oletusarvio, ei ilmoitettu sääntö.

Yleiset skannatun kopion vaatimukset pyytäjän mukaan
PyytäjäMuotoKoko- tai tarkkuussääntöHaettava teksti vaaditaan?
USCIS-verkkohakemusPDF, JPG, JPEG (TIF/TIFF joihinkin lomakkeisiin)12 Mt tiedostoa kohdenEi; tekstin tulee olla luettavissa
W.D. Wash. -tuomioistuinPDF300 dpi, mustavalkoinen; 100 Mt asiakirjaa kohdenRiippuu asiakirjatyypistä
S.D. Fla. -tuomioistuinPDFTuomioistuimen rajat pätevätKyllä, pääasiakirjoille
D. Minn. rikosasioiden ECFPDF35 Mt todistetta kohdenTarkista paikalliset säännöt
Työnantaja tai vuokranantajaPDF tai kuvaYleensä sähköpostin rajaHarvoin
Pidä koko pienenäTekstiasiakirjoille harmaasävy tai kaksisävyinen 300 dpi:llä on yleensä pienin luettavissa oleva vaihtoehto. Pelkän tekstin värilliset skannaukset voivat olla moninkertaisesti suurempia lisäämättä tietoa. Oppaamme värillisen PDF:n muuttamisesta mustavalkoiseksi käsittelee kompromisseja.

Voiko skannatun PDF:n arkistoida PDF/A-muodossa?

Skannatun PDF:n voi tallentaa PDF/A-muodossa, PDF:n ISO 19005 -arkistoversiona, koska PDF/A sallii sivukuvat. PDF/A lisää sääntöjä pitkäaikaista lukemista varten, kuten upotetut fontit ja salauksen kiellon, mutta se ei tee kuvapohjaisesta sivusta haettavaa. OCR on erillinen vaihe.

PDF/A julkaistiin ensimmäisen kerran 1. lokakuuta 2005, ja se kieltää ominaisuudet, jotka vaikeuttavat tiedostojen avaamista vuosikymmenten päästä, kuten fonttien linkittämisen ja salauksen (Wikipedia, PDF/A). Microsoft Office voi viedä ISO 19005-1 -yhteensopivia tiedostoja suoraan Tallenna PDF:ksi -valinnoistaan.

Tuomioistuimet, jotka vaativat PDF/A:ta, ohjaavat usein jättäjiä pois skannaamisesta kokonaan. Oklahoman itäinen piirikunta neuvoo, että tiedostokokojen pitämiseksi pienenä ja tekstihaettavuuden varmistamiseksi PDF/A-asiakirjat tulisi luoda tekstinkäsittelyohjelmassa sen sijaan, että ne tulostetaan ja skannataan (E.D. Okla. PDF/A FAQ).

Digitaalisesti syntynyt PDF/A
Pienin ja täysin haettava; paras vaihtoehto, kun digitaalinen alkuperäinen on olemassa.
Skannattu PDF/A OCR:llä
Arkistollinen ja haettava; oikea valinta pelkästään paperilla oleville tallenteille.
Kuvapohjainen PDF/A
Kelvollinen säilytykseen, mutta ei haettava tai saavutettava.

Miten digitaalinen PDF muunnetaan skannatuksi PDF:ksi?

Digitaalinen PDF muuttuu skannatun PDF:n näköiseksi, kun jokainen sivu rasteroidaan kuvaksi ja siihen lisätään oikean skannerin epätarkkuudet: lievä kierto, sumennus, kohina, harmaa tai paperin sävy. Lopputulos on kuvapohjainen PDF, joka käyttäytyy kuin skannaus, ilman tulostamista tai skannerin omistamista.

Juuri niin ilmainen skannausefektityökalumme toimii. Se piirtää jokaisen PDF-sivun selaimessasi, käyttää valitsemasi efektit ja tallentaa jokaisen sivun JPEG-kuvana uuden PDF:n sisään. Tiedostot käsitellään paikallisesti eikä niitä lähetetä palvelimelle.

Kierto
−10°…10°, oletus 1°, plus satunnainen sivukohtainen vaihtelu enintään 10°.
Sumennus
0…1, oletus 0,3, pehmentää vektorireunoja samaan tapaan kuin skannerin optiikka.
Kohina
0…1, oletus 0,1, lisää anturimaista rakeisuutta.
Kirkkaus ja kontrasti
0…2 kumpikin, oletus 1.
Kellertävyys
0…2, oletus 0, sävyttää sivun vanhentuneen paperin näköiseksi.
Väriavaruus
Harmaasävy (oletus) tai Värillinen.
Tarkkuus
1×–3×; PDF-sivut renderöidään 72 dpi kertaa kerroin, joten 2× on noin 144 dpi ja 3× noin 216 dpi.

Koska tuloste on kuvapohjainen, se perii kaikki edellä kuvatut ominaisuudet: ei valittavaa tekstiä, ei hakua, suurempi tiedosto, ei ruudunlukuohjelman tulostetta. Se on juuri se, mitä henkilö tarvitsee, jos asiakirjan pitää näyttää skannatulta kopiolta, ja haitta sille, joka tarvitsee sen haettavaksi. Säilytä alkuperäinen digitaalinen tiedosto.

Koko työnkulkua varten, mukaan lukien tarkkuuden ja tiedostokoon kompromissit, lue miten PDF muunnetaan skannatuksi PDF:ksi. Kaikki kuusi tapaa, tulostuksesta ja skannauksesta sisäänrakennettuihin käyttöjärjestelmävaihtoehtoihin, löydät oppaasta miten PDF tehdään skannatun näköiseksi. Aloitatko puhelinkuvasta? Opas kuvan muuntamisesta skannatuksi PDF:ksi käsittelee JPG- ja PNG-tiedostoja.

Käytä skannausilmettä rehellisestiSkannausefekti muuttaa sitä, miltä tiedosto näyttää, ei sitä, onko se aito. Älä käytä sitä väärentääksesi tai muuttaaksesi virallisia asiakirjoja, henkilöllisyystodistuksia tai allekirjoituksia, jotka eivät ole omiasi. Jotkin tuomioistuimet ja viranomaiset vaativat tekstihaettavia PDF-tiedostoja, joten kuvapohjainen tiedosto voidaan hylätä; tarkista säännöt ennen lähettämistä.
Rakensimme työkalumme lisäämään skannausilmeen, ja yleisin kysymys, jonka saamme, on oikeastaan ”mitä minä juuri tein?” Rehellinen vastaus on kuvapohjainen PDF. Se näyttää paperilta, mutta sanat ovat pikseleitä. Jos lukijan pitää hakea siitä tekstiä tai kuulla se luettuna, säilytä digitaalinen alkuperäinen sen rinnalla, tai aja OCR jälkikäteen. Haluaisimme mieluummin, että ihmiset tietävät sen ennen kuin he painavat Lataa.
Make PDF look scanned -tiimi — verkkotyökalun ja Chrome-laajennuksen tekijät

Skannatun asiakirjan sanasto: mitkä termit ovat tärkeitä?

Skannattu asiakirja tuo mukanaan oman sanastonsa: dpi ja ppi, bittisyvyys, kaksisävyinen, OCR, rasterointi, PDF/A ja JBIG2. Näiden seitsemän termin tunteminen riittää lukemaan minkä tahansa tuomioistuimen, viranomaisen tai työnantajan skannausvaatimuksen ja arvioimaan vastaanottamasi skannatun PDF:n.

dpi / ppi
Pistettä tai pikseliä tuumaa kohden: kuinka monta kuvanäytettä peittää yhden tuuman paperia. NARA vaatii vähintään 300 ppi:tä nykyaikaisille tekstiasiakirjoille ja 400 ppi:tä valokuville ja hienoja yksityiskohtia sisältäville tallenteille. PDF-sivugeometria käyttää 72 pistettä tuumaa kohden, minkä vuoksi 1×-renderöinti vastaa 72 dpi:tä.
Bittisyvyys
Pikseliä kohden tallennettujen bittien määrä. Kaksisävyinen on 1 bitti, harmaasävy 8 bittiä (256 sävyä), ja tyypillinen värillinen skannaus 24 bittiä (8 bittiä kutakin kolmea kanavaa kohden).
Kaksisävyinen
FADGI:n määritelmä: ”Digitaalisia kuvia, jotka on tuotettu käyttäen vain kahta väriä, mustaa ja valkoista.” Pienin luettavissa oleva muoto pelkälle tekstille.
OCR
Optinen merkintunnistus: ohjelmisto, joka muuttaa kuvan kirjainmuodot konetekstiksi, tehden haettavan PDF:n.
Rasterointi
Vektoritekstin ja -muotojen muuntaminen pikseliruudukoksi. Digitaalisen PDF:n rasterointi muuttaa sen kuvapohjaiseksi PDF:ksi.
PDF/A
ISO 19005, PDF:n arkistollinen osajoukko, julkaistu 2005; se kieltää ominaisuudet kuten salauksen ja fonttien linkittämisen.
JBIG2
Pakkausmenetelmä kaksisävyisille skannauksille, joka tallentaa toistuvat symbolit vain kerran. BBC News raportoi vuonna 2013, että jotkin toimistokopiokoneet, jotka käyttivät häviöllistä JBIG2-tilaa, muuttivat numeroita skannauksissa, usein kääntäen 6:n 8:ksi; yhdessä testissä huoneen 21,11 m:n mitta muuttui 14,13 m:ksi.
Kuvapohjainen PDF
Skannattu PDF ilman tekstikerrosta lainkaan.
Haettava PDF
PDF, jossa on oikeaa tai OCR-tekstiä, jota voi hakea ja valita.

JBIG2-tapaus on vahvin peruste alkuperäiskappaleiden säilyttämiselle. Skannattu kopio on kuva, ja kuvia voi muuttaa pakkaus ilman että kukaan huomaa (BBC News, 2013). NARA käsittelee myös kohinaa ei-toivottuna artefaktina, joka ”ei kuulu lähdemateriaaliin” (36 CFR 1236 Subpart E).

Skannattu PDF: mitä muuta kysytään?

Nämä skannattua PDF:ää koskevat kysymykset nousevat useimmin esiin ihmisiltä, jotka ovat saaneet tiedoston, tarvitsevat lähettää skannatun kopion, tai joiden pitää täyttää tuomioistuimen tai viranomaisen sääntö. Jokainen vastaus toimii itsenäisesti, joten voit hypätä suoraan siihen, joka vastaa omaa tilannettasi ja toimia sen mukaan.

Mikä on skannattu PDF yksinkertaisesti selitettynä?

Skannattu PDF on PDF, joka koostuu valokuvista paperisivuista. Näkemäsi teksti on osa kuvaa, joten et voi valita tai hakea sitä, ellei OCR:ää ole käytetty.

Onko skannattu PDF sama asia kuin skannattu kopio?

Lähes. Skannattu kopio on mikä tahansa digitaalinen kuva paperisesta asiakirjasta, ja skannattu PDF on yleisin tiedostomuoto sen toimittamiseen. Skannattu kopio voi olla myös JPEG tai TIFF.

Miten voin tunnistaa, onko PDF skannattu, 10 sekunnissa?

Yritä valita sana, paina sitten Ctrl+F tai Cmd+F ja hae sanaa, jonka näet. Jos mikään ei korostu eikä haku löydä mitään, PDF on kuvapohjainen skannaus. Zoomaa 400 %:iin varmistaaksesi: skannattu teksti näyttää pikseloituneelta.

Voiko skannattu PDF olla haettava?

Kyllä. OCR lisää näkymättömän tekstikerroksen sivukuvien taakse, muuttaen skannatun PDF:n haettavaksi PDF:ksi. Sivu näyttää yhä skannaukselta, ja väärin tunnistettuja sanoja voi esiintyä piilotetussa tekstissä.

Miksi en voi kopioida tekstiä PDF:stäni?

PDF on todennäköisesti skannaus ilman OCR:ää, joten siinä ei ole kopioitavia merkkejä. Floridan eteläisen piirikunnan tuomioistuimen FAQ toteaa saman: jos PDF ei ole tekstihaettava, sen tekstiä ei voi kopioida. Aja OCR tai pyydä digitaalinen alkuperäinen.

Ovatko skannatut PDF:t ruudunlukuohjelmille saavutettavia?

Eivät ilman OCR:ää. W3C:n ohjeisto kutsuu kuvapohjaisia skannauksia lähtökohtaisesti saavuttamattomiksi. OCR:n jälkeen ruudunlukuohjelmat voivat lukea tekstin ääneen, mutta täysi saavutettavuus vaatii myös merkinnät otsikoille, lukujärjestykselle ja taulukoille.

Miksi skannattu PDF on niin suuri?

Jokainen sivu on täysi kuva. Harmaasävysivu 400 ppi:llä voi ylittää 1 Mt, kun taas tekstinkäsittelyohjelmasta viety tekstisivu on usein alle 50 kt. Skannaaminen 300 ppi:llä harmaasävynä tai mustavalkoisena pitää koon pienenä.

Millainen tarkkuuden pitäisi olla skannatussa asiakirjassa?

Kirjoitetulle tai painetulle tekstille 300 dpi on vakiovaatimus Yhdysvaltain liittovaltion tuomioistuimissa ja NARA:n vähimmäisvaatimus tekstiasiakirjoille. Valokuvat ja hienot yksityiskohdat vaativat 400 ppi:tä.

Onko skannattu kopio laillinen tai oikeaksi todistettu kopio?

Ei, skannattu kopio itsessään ei todista mitään aitoudesta. Oikeaksi todistettu kopio on ammattilaisen allekirjoittama ja päiväämä henkilön toimesta, joka on nähnyt alkuperäisen, kuten GOV.UK selittää. Kysy pyytäjältä, kumpaa hän tarvitsee.

Voinko tehdä digitaalisesta PDF:stä skannatun PDF:n näköisen?

Kyllä. Ilmainen Make PDF look scanned -työkalu rasteroi jokaisen sivun ja lisää kierron, sumennuksen, kohinan ja paperin sävyn selaimessasi. Tuloste on kuvapohjainen PDF, joten säilytä alkuperäinen, jos tarvitset hakua.

Pitääkö skannatun PDF:n olla PDF/A-muodossa?

Vain jos pyytäjä niin sanoo. Jotkin tuomioistuimet ja arkistot vaativat PDF/A:ta pitkäaikaista säilytystä varten. Skannatun PDF:n voi tallentaa PDF/A-muodossa, mielellään OCR:n kanssa, jotta se on myös haettava.

Voinko skannata useita PDF:iä kerralla?

Työkalullamme kyllä: joukkoskannaus käsittelee useita tiedostoja ja lataa ne yhtenä ZIP-arkistona, yksi skannattu PDF per syötetiedosto.

Mikä on lyhyt vastaus skannatuista PDF-tiedostoista?

Skannattu PDF on kuva paperista PDF:n sisään käärittynä. Testaa se valitsemalla ja hakemalla tekstiä, lisää OCR, kun tarvitset hakua tai saavutettavuutta, lähetä digitaalisesti syntynyt PDF, kun tuomioistuin suosii sitä, ja käytä skannausilmettä vain, kun lukija tarvitsee ulkonäköä, ei aitoutta.

Jos tarvitset ulkonäköä, avaa ilmainen skannaustyökalu, pidä oletusarvoinen Harmaasävy-väriavaruus ja 2× tarkkuus, ja tarkista esikatselu ennen lataamista.

Tarvitsetko PDF:n, joka näyttää skannatulta kopiolta?

Pudota digitaalinen PDF ilmaiseen työkaluun, säädä vinous, kohina ja paperin sävy ja lataa kuvapohjainen PDF, joka näyttää aidolta skannaukselta. Kaikki tapahtuu selaimessasi.