PDF skannatuksi PDF:ksi: näin muunnat, tasoitat ja pidät sen luettavana
Kun PDF muunnetaan skannatuksi PDF:ksi, jokainen sivu piirretään kuvana uuteen PDF:ään, jolloin tekstikerros, linkit ja lomakekentät muuttuvat litteiksi pikseleiksi. Luettavaan ja pieneen tiedostoon riittää 2× tarkkuus ja harmaasävy; lisää kevyt kohina ja vinous vain, jos haluat myös skannausilmeen.
PDF muunnetaan skannatuksi PDF:ksi, koska jokin portaali vaatii kuvapohjaisen tiedoston, kollega on pyytänyt tasoitetun kopion, tai lomakkeen pitää näyttää siltä kuin se olisi kulkenut toimiston skannerin läpi. Tämä opas käy läpi kompromissit (tarkkuus, väri, tiedostokoko, haettavuus, tuomioistuinten säännöt) tarkkojen työkaluasetusten, Yhdysvaltain liittovaltion tuomioistuinten lukujen ja kansallisarkiston sekä FADGI:n vertailuarvojen avulla.
Mitä PDF skannatuksi PDF:ksi -muunnos tekee?
PDF skannatuksi PDF:ksi -muunnos ottaa digitaalisen PDF:n jokaisen sivun, piirtää sen kankaalle valitulla pikselitiheydellä ja tallentaa tuloksen kuvana uuden PDF:n sisään. Lopputulos näyttää samalta, mutta jokainen sana, rivi ja logo on nyt osa yhtä sivukohtaista kuvaa.
Oikea skanneri tekee saman asian paperille digitaalisen sivun sijaan. Kalifornian pohjoisen piirin liittovaltion käräjäoikeus (U.S. District Court for the Northern District of California) kuvaa tuloksen suoraan: ”Skannattu teksti on valokuva painetusta sivusta, jonka on tuottanut joko digitaalikamera tai skanneri.” Kun sivusta on tullut valokuva, sen sanojen valitseminen, kopiointi tai hakeminen ei enää onnistu, ennen kuin joku ajaa sille tekstintunnistuksen (OCR).
Kaksi läheistä termiä sekoitetaan usein keskenään. PDF:n tasoittaminen tarkassa merkityksessä tarkoittaa vuorovaikutteisten tasojen (lomakekentät, kommentit, leimat) yhdistämistä sivun sisältöön, jolloin teksti voi silti pysyä valittavana. PDF:n rasterointi tarkoittaa kaiken, myös tekstin, muuttamista pikseleiksi. PDF:n muuntaminen skannatuksi PDF:ksi on tämä toinen, voimakkaampi toimenpide.
Tulos voi olla kahdenlainen. Puhdas kuvapohjainen PDF pitää sivun terävänä ja suorana. Skannausilmeinen PDF lisää kevyen vinouden, lievän epätarkkuuden, kohinaa ja paperin sävyn. Ilmainen PDF skannatuksi PDF:ksi -työkalumme tuottaa molemmat samoista asetuksista. Taustatietoa siitä, mikä lasketaan skannatuksi tiedostoksi, löydät oppaasta mikä on skannattu PDF.
Mikä muuttuu, kun PDF:stä tulee skannattu PDF?
Kun PDF:stä tulee skannattu PDF, näkyvä sivu pysyy samana, mutta kaikki sivun koneluettava sisältö korvautuu pikseleillä. Teksti, fontit, linkit, lomakekentät ja huomautukset lakkaavat olemasta erillisiä objekteja. Tiedostokoko yleensä kasvaa, ja haku, kopiointi ja ruudunlukuohjelmat lakkaavat toimimasta, ennen kuin tiedostolle ajetaan tekstintunnistus.
Taulukko vertaa tyypillistä tekstinkäsittelyohjelmasta vietyä PDF:ää samaan tiedostoon sen jälkeen, kun se on muunnettu sivukuviksi. "Jälkeen"-sarakkeen käytös pätee mihin tahansa rasterointimenetelmään, myös työkaluumme, koska jokainen sivu tallennetaan JPEG-kuvana uuden PDF:n sisään.
| Elementti | Alkuperäinen digitaalinen PDF | PDF skannatuksi PDF:ksi -muunnoksen jälkeen |
|---|---|---|
| Tekstikerros | Oikeat merkit, jotka voi valita, kopioida ja hakea | Poissa sivulta; sanat ovat olemassa vain pikseleinä |
| Fontit | Upotetut tai viitatut fonttitiedostot | Fontteja ei tarvita; kirjainmuodot on paistettu kuvaan |
| Linkit | Napsautettavat URL-osoitteet ja sisäiset hypyt | Linkkiteksti näkyy yhä, mutta ei enää ole napsautettava |
| Lomakekentät | Täytettävät ruudut, valintaruudut, pudotusvalikot | Ei enää täytettäviä; tarkista esikatselusta, mitkä arvot piirtyivät kuvaan |
| Huomautukset | Kommentit, korostukset, leimat erillisinä objekteina | Ei enää muokattavia objekteja; jäljelle jäänyt on osa kuvaa |
| Asiakirjan metatiedot | Luontisovelluksen asettamat otsikko, tekijä ja muut ominaisuudet | Uusi PDF kirjoitetaan; otsikko, tekijä, aihe, avainsanat, tuottaja ja luoja voidaan asettaa työkalun lisäasetuksista |
| Tiedostokoko | Pieni tekstisivuilla | Yleensä suurempi; riippuu tarkkuudesta, värimoodista ja sivumäärästä |
| Haettavuus | Ctrl+F ja ruudunlukuohjelmat toimivat | Ei haettava eikä saavutettava ennen kuin OCR lisää tekstikerroksen |
Kaksi riviä ansaitsee tarkemman katsauksen. Lomakekenttien ja huomautusten kohdalla se, mikä säilyy visuaalisesti, riippuu siitä, piirtääkö sivun renderöijä ne; täytetyn kentän arvo näkyy yleensä painettuna tekstinä, kun taas ponnahduskommentti saattaa kadota, joten tarkista aina reaaliaikainen esikatselu. Metatietojen kohdalla lisäasetuspaneeli antaa kirjoittaa ominaisuudet, jotka haluat uuden PDF:n kantavan; tarkista ne ennen tiedoston lähettämistä.
Kokoa koskeva rivi yllättää ihmiset eniten. Pohjois-Carolinan keskisen piirin käräjäoikeus toteaa, että 2 megatavua vastaa noin 45 sivua PDF-tekstiä, ja lisää sanatarkasti: ”Useimmat skannatut PDF:t eivät ole haettavia, ja niiden tiedostokoko on suuri.” Tekstipohjainen PDF kuvaa kirjaimia; skannattu PDF tallentaa jokaisen niiden pikselin.
Miten PDF muunnetaan skannatuksi selaimessa?
PDF muunnetaan skannatuksi PDF:ksi selaimessa avaamalla ilmainen työkalu osoitteessa pdflookscanned.com/scan, pudottamalla tiedosto sisään, asettamalla tarkkuus, värimoodi ja skannausefektit, tarkistamalla reaaliaikainen esikatselu ja lataamalla tulos. Koko prosessi tapahtuu paikallisesti laitteellasi, ja se kestää kauemmin vain pitkillä asiakirjoilla tai korkealla tarkkuudella.
- Avaa skanneri. Siirry osoitteeseen pdflookscanned.com/scan millä tahansa nykyaikaisella tietokoneen tai puhelimen selaimella, tai avaa Chrome-laajennuksen sivupaneeli. Tiliä tai rekisteröitymistä ei tarvita.
- Lisää PDF:si. Vedä tiedosto pudotusalueelle tai napsauta valitaksesi sen. PDF:t käytetään sellaisenaan, joten sivun asettelu, fontit ja kuvat, jotka näet nyt, ovat täsmälleen se, mikä renderöidään.
- Valitse tarkkuus. Jätä Tarkkuus-asetus oletukseen 2× (noin 144 dpi) tavallisille kirjeille ja lomakkeille. Siirrä se arvoon 2,5× tai 3× (noin 216 dpi), jos tiedostossa on alaviitteitä, pientä tekstiä tai tiheitä taulukoita.
- Valitse väriavaruus. Pidä Harmaasävy (oletus) tekstiasiakirjoissa; vaihda Värilliseen vain, kun värillä on merkitystä, kuten kaavioissa, korostetuissa lausekkeissa tai värillisessä logossa.
- Aseta ulkoasu. Puhdasta tasoitusta varten aseta Kierto, Kierron vaihtelu, Sumennus ja Kohina arvoon 0. Skannausilmettä varten pidä oletukset (Kierto 1°, Sumennus 0,3, Kohina 0,1) tai säädä niitä hieman.
- Hienosäädä kirkkautta ja paperin sävyä. Kirkkaus ja Kontrasti ovat oletuksena 1; nosta Kontrastia hieman, jos harmaa teksti näyttää heikolta. Kellertävyys lisää vanhentuneen paperin sävyn ja on oletuksena 0.
- Lisää tarvittaessa lisäasetuksia. Valinnaisesti: teksti- tai kuvavesileima, leima tai allekirjoituskuva, jonka käyttöoikeus sinulla on, ja asiakirjan metatietokentät (otsikko, tekijä, aihe, avainsanat, tuottaja, luoja).
- Tarkista esikatselu ja lataa. Zoomaa esikatselun pienimpään tekstiin. Jos se on selkeästi luettavissa, lataa uusi skannattu PDF; jos ei, nosta tarkkuutta ja tarkista esikatselu uudelleen.
Jos lähteesi on Word-tiedosto, Google-doc tai laskentataulukko, vie se ensin PDF-muotoon (Wordissa: Tiedosto, Tallenna nimellä, PDF; Google Docsissa: Tiedosto, Lataa, PDF-dokumentti). Työkalu osaa lukea DOCX- ja XLSX-tiedostot suoraan, mutta se poimii vain raa'an tekstin ja ladontaa sen uudelleen A4-sivuille 11 pisteen Helveticalla, joten muotoilu, taulukot ja kuvat katoavat.
Vieminen ensin PDF-muotoon säilyttää asettelun täsmälleen suunnitellun kaltaisena. Kattava opas PDF:n muuttamiseen skannatun näköiseksi vertaa tätä reittiä viiteen muuhun menetelmään.
Mikä tarkkuus pitää skannatun PDF:n luettavana?
Skannattu PDF pysyy luettavana, kun jokainen kirjain saa riittävästi pikseleitä. Työkalumme renderöi PDF-sivut 72 dpi kerrottuna Tarkkuus-asetuksella, joten 1× on noin 72 dpi, 2× noin 144 dpi ja 3× noin 216 dpi. Todellinen arkistoskannaus tähtää 200–300 ppi:hin, joten 3× sopii pienelle tekstille.
Luku 72 juontuu siitä, miten PDF mittaa sivuja. PDF- ja PostScript-geometria perustuu 72 pisteeseen tuumalla, joten US Letter -sivu on 612 × 792 pistettä. Renderöinti 1×-tarkkuudella antaa 612 × 792 pikseliä, 2×-tarkkuudella 1 224 × 1 584 pikseliä ja 3×-tarkkuudella 1 836 × 2 376 pikseliä. Pikselimäärä kasvaa mittakaavan neliönä.
- 1× (noin 72 dpi)
- Letter-sivu 612 × 792 px. Sopii isoihin otsikoihin ja diaesityksiin; leipäteksti alkaa hajota. Pienimmät tiedostot.
- 1,5× (noin 108 dpi)
- Letter-sivu 918 × 1 188 px. Riittää 12 pisteen tekstille ruudulla; heikko alaviitteille.
- 2× (noin 144 dpi, oletus)
- Letter-sivu 1 224 × 1 584 px. Selkeä leipäteksti kirjeille, laskuille ja lomakkeille; tasapainoinen valinta.
- 2,5× (noin 180 dpi)
- Letter-sivu 1 530 × 1 980 px. Käytä, kun asiakirjassa on sekä tavallista tekstiä että pieniä merkintöjä.
- 3× (noin 216 dpi)
- Letter-sivu 1 836 × 2 376 px. Paras sopimuksille, joissa on pientä painotekstiä, tiheitä taulukoita ja allekirjoituksia, joiden on pysyttävä terävinä.
Miten pieni teksti käyttäytyy kullakin skannatun PDF:n tarkkuudella
Yksinkertainen laskutoimitus näyttää, miksi pieni teksti tarvitsee enemmän pikseleitä. 8 pisteen alaviite on fonttikokona 8/72 tuumaa korkea. 1×-tarkkuudella se on noin 8 pikseliä koko kirjaimen korkeudelta yläpidennykset ja alapidennykset mukaan lukien, mikä sumentaa pienaakkoset "e" ja "c" yhteen. 2×-tarkkuudella siitä tulee noin 16 pikseliä, ja 3×-tarkkuudella noin 24 pikseliä, mikä on mukavasti luettavissa vielä kevyen sumennuksen ja JPEG-pakkauksen jälkeenkin.
Vertailun vuoksi Yhdysvaltain kansallisarkisto (National Archives) vaatii vähintään 300 ppi nykyaikaisille tekstimuotoisille asiakirjoille ja 400 ppi valokuville ja hienovaraista yksityiskohtaa vaativille asiakirjoille 36 CFR 1236 -asetuksen E-osan mukaisesti. FADGI (Federal Agencies Digital Guidelines Initiative) luokittelee sitomattomat asiakirjat tähtitasoihin 200 ppi:stä (yksi tähti) 250:n ja 300:n kautta aina 400 ppi:hin (neljä tähteä) vuoden 2023 teknisissä ohjeissaan. Nämä tavoitteet suojaavat paperisia alkuperäiskappaleita.
PDF skannatuksi PDF:ksi -muunnos lähtee liikkeelle täydellisestä digitaalisesta sivusta, ei rypistyneestä paperista, joten se ei tarvitse arkistotason tiheyttä näyttääkseen terävältä. Kokemuksemme mukaan 2× riittää tavalliselle 10–12 pisteen tekstille, ja 3× (216 dpi) asettuu juuri FADGI:n yhden tähden tason yläpuolelle pienelle painotekstille.
NARA lisää hyödyllisen varoituksen samassa asetuksessa: ”Virasto ei voi luottaa pelkästään laitteiston teknisiin tietoihin, kuten skannerin ppi-asetuksiin tai kameran anturin megapikseleihin, varmistaakseen digitaalisen kuvan laadun.” Käytännössä kannattaa arvioida esikatselua, ei lukuarvoa.
Harmaa, väri vai kaksisävyinen: mikä pitää tiedoston pienenä?
Kaksisävyiset (puhtaasti mustavalkoiset) tiedostot ovat pienimpiä, harmaasävy asettuu keskelle, ja väri on suurin samalla tarkkuudella. PDF skannatuksi PDF:ksi -muunnoksessa harmaasävy on käytännön oletus: se pitää pehmennetyt kirjainreunat sulavina ja pysyy paljon väriä pienempänä. Käytä väriä vain, kun väri kantaa tietoa.
Vahvimmat todelliset luvut tulevat Kalifornian pohjoisesta piiristä, joka skannasi saman 317-sivuisen asiakirjan kahdella tavalla. Kaksisävyisenä tiedostona 300 ppi:llä se painoi 23,86 megatavua ja pysyi luettavana; harmaasävynä 400 ppi:llä se kasvoi 374,47 megatavuun. Se on noin viisitoista kertaa suurempi samoilla sivuilla, ja syynä on sekä värisyvyys että korkeampi tarkkuus.
| Moodi | Bittiä per pikseli | Suhteellinen koko | Sopii parhaiten |
|---|---|---|---|
| Kaksisävyinen (mustavalkoinen) | 1 | Pienin | Tuomioistuinjättöjen pelkkä teksti; ei moodi työkalussamme |
| Harmaasävy (työkalussa: Harmaasävy) | 8 | Keskikokoinen | Kirjeet, sopimukset, lomakkeet, kaikki allekirjoituksia sisältävä |
| Väri (työkalussa: Värillinen) | 24 | Suurin | Kaaviot, värilliset leimat, valokuvat, korostettu teksti |
Työkalumme tarjoaa Harmaasävyn ja Värillisen ja tallentaa jokaisen sivun JPEG-kuvana. JPEG on tehokas harmaasävyille, mutta kuten FADGI toteaa: ”tavanomainen JPEG-käsittely tuo mukanaan 8×8 pikselin lohkoja, jotka eivät selvästikään kuulu alkuperäiseen sisältöön.” 2×- tai 3×-tarkkuudella nuo lohkot näkyvät tekstissä harvoin.
Jos tarvitset aitoa yksibittistä mustavalkoista, oppaamme värillisen PDF:n muuttamisesta mustavalkoiseksi selittää eron ja vaihtoehdot.
Skannatun PDF:n tiedostokokorajat, joihin voit törmätä
Latausrajat tekevät värivalinnasta käytännöllisen, ei pelkästään esteettisen. Washingtonin läntinen piiri asettaa 100 megatavun rajan per asiakirja ja pyytää 300 dpi:n mustavalkoisia skannauksia, ellei väri ole olennainen. Minnesotan piiri rajaa jokaisen todistusaineiston 35 megatavuun rikosasioiden sähköisen jättämisen ohjeissaan. USCIS rajaa jokaisen ladatun todistetiedoston 12 megatavuun.
Tasoita PDF puhtaasti vai lisää skannausilme?
Valitse puhdas tasoitus, kun vastaanottaja tarvitsee vain kuvapohjaisen PDF:n ilman muokattavaa tekstiä, ja valitse skannausilme, kun tiedoston pitää muistuttaa skannerin läpi kulkenutta paperia. Sama työkalu tekee molemmat: aseta Kierto, Kierron vaihtelu, Sumennus ja Kohina arvoon 0 puhdasta tasoitusta varten, tai pidä ne nollan yläpuolella aitouden vuoksi.
Puhdas tasoitus on usein oikea valinta: lopullisen sopimuksen lähettäminen niin, ettei kukaan voi hiljaa kirjoittaa lauseketta uudelleen tekstieditorilla, täytetyn lomakkeen lukitseminen niin, ettei sen arvoja voi muuttaa kenttä kerrallaan, tai sivujen toimittaminen järjestelmään, joka hylkää fontteja tai lomakekenttiä sisältävät PDF:t. Tässä vinous tai pisarakohina ei tuo mitään lisäarvoa.
| Asetus (vaihteluväli) | Puhdas tasoitus | Kevyt skannausilme | Vahva skannausilme |
|---|---|---|---|
| Kierto (−10°…10°) | 0° | 1° (oletus) | 1,5°–2° |
| Kierron vaihtelu (0–10°) | 0 | 0,5 | 1 |
| Sumennus (0–1) | 0 | 0,3 (oletus) | 0,4–0,5 |
| Kohina (0–1) | 0 | 0,1 (oletus) | 0,2–0,3 |
| Kirkkaus / Kontrasti (0–2) | 1 / 1 | 1 / 1,1 | 1,05 / 1,2 |
| Kellertävyys (0–2) | 0 | 0–0,2 | 0,3–0,5 |
| Reunus | Ei | Ei | Kyllä |
| Väriavaruus / Tarkkuus | Harmaasävy tai Värillinen / 2×–3× | Harmaasävy / 2× | Harmaasävy / 2× |
Skannausilmeen arvot jäljittelevät virheitä, joita arkistoijat pyrkivät poistamaan. NARA:n asetus määrittelee kohinan ”yhdeksi tai useammaksi ei-toivotuksi kuva-artefaktiksi digitoidussa asiakirjassa, joka ei kuulu lähdemateriaaliin” ja listaa vinouden ja virheellisen rajauksen tarkistettavien virheiden joukkoon. Pieni annos kumpaakin näyttää uskottavalta; liika näyttää huonolta kopiolta.
Kaksi varoitusta skannausilmeeseen. Sumennus yli noin 0,5 pehmentää pientä tekstiä nopeasti, joten nosta Tarkkuutta, kun nostat Sumennusta. Kiertokulma yli 2° leikkaa sivun kulmia ja näyttää huolimattomalta eikä realistiselta. Täyden katsauksen artefakteihin ja valmiisiin yhdistelmiin löydät skannausefektioppaastamme.
Milloin skannattu PDF vaaditaan tai hylätään?
Skannattua PDF:ää pyydetään joskus (kuvapohjaiset lataukset, tasoitetut lopulliset kopiot), mutta se usein hylätään silloin, kun tekstihaku on tärkeää. Liittovaltion tuomioistuimet ja saavutettavuussäännöt suosivat yleensä tekstihaettavia PDF:iä, joten tarkista vastaanottajan säännöt ennen kuin muunnat PDF:n skannatuksi PDF:ksi, ja säilytä alkuperäinen tiedosto.
Tuomioistuimet ovat selkein esimerkki. Liittovaltion tuomioistuinjärjestelmän UKK toteaa, että ”CM/ECF-järjestelmät on suunniteltu hyväksymään vain PDF-muotoisia asiakirjoja”, mutta yksityiskohdat vaihtelevat piirikunnittain. Floridan eteläinen piiri on tiukka: ”sähköisesti CM/ECF:ään jätettyjen kannekirjelmien ja pääasiakirjojen on oltava tekstihaettavassa PDF-muodossa”, ja todisteiden tulisi olla haettavia aina kun mahdollista.
Muut piirikunnat ilmaisevat mieluummin suosituksen kuin kiellon. Massachusettsin piiri kirjoittaa, että ”PDF-muotoon vietyjä, ei skannattuja, asiakirjoja suositaan CM/ECF-jättämisessä”. Minnesotan piiri toteaa: ”Tekstihaettavia skannattuja PDF-asiakirjoja suositaan, mutta ne eivät ole pakollisia.” Oklahoman itäinen piiri neuvoo luomaan PDF/A-tiedostoja suoraan tekstinkäsittelyohjelmasta tulostamisen ja skannaamisen sijaan, jotta tiedostot pysyvät pieninä ja haettavina.
Saavutettavuus on toinen hylkäämisen syy. W3C:n WCAG-tekniikka PDF7 toteaa: ”asiakirja, joka koostuu skannatuista tekstikuvista, on luonnostaan saavuttamaton, koska sen sisältö on kuvia, ei haettavaa tekstiä”. Virastojen, yliopistojen ja monien yritysten julkisten asiakirjojen on täytettävä WCAG-vaatimukset, joten kuvapohjainen tiedosto on niille väärä muoto, ellei siihen lisätä OCR:ää.
Tekstikerroksen palauttaminen OCR:llä
Jos tarvitset sekä tasoitetun ulkoasun että haettavuuden, muunna ensin ja aja sitten OCR tietokoneen PDF-ohjelmassa, joka tarjoaa "tunnista teksti" tai "tee haettavaksi" -toiminnon. OCR asettaa näkymättömän tekstin sivukuvan taakse, jolloin tiedosto näyttää skannatulta, mutta Ctrl+F toimii jälleen. Tarkista tärkeät asiakirjat huolella, koska OCR arvioi kirjaimet.
Onko PDF:n muuntaminen skannatuksi PDF:ksi verkossa turvallista?
PDF:n muuntaminen skannatuksi PDF:ksi verkossa on turvallista, kun käsittely tapahtuu selaimessasi. Työkalumme renderöi sivut paikallisesti pdf.js:llä ja selaimen canvas-elementillä, joten tiedostoa ei lähetetä käsittelevälle palvelimelle. Ensimmäisen käynnin jälkeen se myös toimii ilman verkkoyhteyttä, minkä avulla voit todentaa tämän itse.
Paikallinen käsittely on tärkeää juuri niille tiedostoille, joita ihmiset tasoittavat: allekirjoitetut sopimukset, palkkatiedot, hoitolomakkeet, verotiedot. Monet verkkomuuntimet lähettävät PDF:n, käsittelevät sen palvelimella ja palauttavat tuloksen, mikä tarkoittaa, että kopio on olemassa, ainakin hetken, laitteistolla, jota et hallitse. Selaimessa tapahtuvassa renderöinnissä sivut eivät koskaan poistu laitteelta, joka ne avasi.
- Yhteydetön testi. Lataa skanneri kerran, katkaise internetyhteys ja muunna tiedosto. Jos se toimii ilman yhteyttä, mitään ei lähetetty.
- Ei tiliä. Rekisteröitymistä ei ole, joten mihinkään identiteettiisi ei liity asiakirjahistoriaa.
- Sama moottori Chromessa. Chrome-laajennus, joka on saanut 5 tähden arvion Chrome Web Storessa, ajaa täsmälleen samaa paikallista moottoria sivupaneelissa.
Miten monta PDF:ää muunnetaan skannatuiksi kerralla?
Monta PDF:ää muunnetaan skannatuiksi kerralla avaamalla joukkoskannaussivu osoitteessa pdflookscanned.com/scan/bulk, lisäämällä kaikki tiedostot, valitsemalla yhdet asetukset ja lataamalla kaikki yhtenä ZIP-arkistona. Jokaisesta syöttötiedostosta tulee oma skannattu PDF samalla tarkkuudella, värimoodilla ja efekteillä.
- Avaa joukkoskannaus. Siirry osoitteeseen pdflookscanned.com/scan/bulk (Chrome-laajennuksessa lisää vain useita tiedostoja).
- Lisää tiedostot. Pudota PDF:t sisään. Myös sekalaiset syötteet, kuten JPG tai PNG, toimivat; jokaisesta kuvasta tulee yksisivuinen PDF.
- Valitse yhteiset asetukset. Aseta Tarkkuus, Väriavaruus ja efektiliukusäätimet kerran; ne koskevat jokaista tiedostoa.
- Lataa ZIP. Aja erä ja lataa ZIP, ja pistokoe muutamasta tuloksesta pienen tekstin luettavuuden varmistamiseksi.
Joukkoskannaus pitää tiedostot tarkoituksella erillään; se ei yhdistä niitä yhdeksi asiakirjaksi. Jos tarvitset yhden yhdistetyn skannatun PDF:n, yhdistä lähde-PDF:t ensin (esimerkiksi macOS:n Esikatselussa vetämällä sivut yhdestä PDF:stä toisen sivupalkkiin, tai tulostamalla useita asiakirjoja yhdessä Windowsin "Microsoft Print to PDF" -tulostimeen), ja muunna sitten yhdistetty tiedosto kerran.
Joukkotyö on myös se tilanne, jossa Kierron vaihtelu auttaa: jokainen sivu saa hieman erilaisen satunnaisen vinouden, mikä näyttää luonnollisemmalta pitkässä asiakirjassa.
Miten tarkistat, että tulos on skannattu PDF?
Tarkista muunnettu tiedosto yrittämällä valita tekstiä, hakemalla sanaa ja zoomaamalla pienimpään painotekstiin. Aito skannattu PDF ei anna valita mitään muuta kuin koko sivun kuvia, ei löydä sanoja Ctrl+F:llä ja pysyy silti selkeästi luettavana 200 prosentin zoomauksessa. Tarkista myös tiedostokoko ja sivumäärä.
Clevelandin osavaltionyliopiston saavutettavuusopas kuvaa nopeimman testin: ”Jos sana korostuu sivulla, sillä on haettava teksti sen sijaan, että se olisi skannattu tekstikuva.” Kunnollisen muunnoksen jälkeen mikään ei korostu, ja kohdistimen vetäminen valitsee sivukuvan sanojen sijaan.
Miten korjaat PDF skannatuksi PDF:ksi -ongelmat?
Useimmat PDF skannatuksi PDF:ksi -ongelmat johtuvat neljästä asetuksesta: liian matala tarkkuus (sumea teksti), liian korkea tarkkuus tai väri (valtava tiedosto), ei-PDF-lähde (väärä sivukoko) ja päälle jätetty kierto (vinot sivut). Jokaiseen on suora korjaus työkalussa, lueteltuna alla ensin muutettavan asetuksen kanssa.
Sumea tai rikkoutunut teksti skannatussa PDF:ssä
Nosta Tarkkuus arvoon 2,5× tai 3×, ja laske sitten Sumennus arvoon 0,1–0,2 tai 0 puhdasta tasoitusta varten. Jos ohut harmaa teksti yhä haalistuu, nosta Kontrasti noin arvoon 1,2. Sumennus ja kohina lisätään renderöinnin jälkeen, joten 1×-tarkkuudella jopa pieni sumennusarvo voi tehdä 9 pisteen tekstistä lukukelvottoman.
Skannattu PDF-tiedosto on valtava
Vaihda Väriavaruus Harmaasävyyn, jos asiakirja on tekstiä, ja laske sitten Tarkkuus 3×:stä 2×:een tai 1,5×:een. Myös Kohina vie tilaa, koska satunnaiset pisteet ovat JPEG:lle vaikeita pakata, joten pidä Kohina arvossa 0,1 tai alempana pitkissä asiakirjoissa. Hyvin pitkille tiedostoille jaa ne osiin ja muunna erikseen.
Väärä sivukoko skannatuksi muuntamisen jälkeen
PDF-sivut säilyttävät alkuperäisen kokonsa ja asettelunsa. Jos tulosteessasi näkyy A4-sivuja pelkällä Helvetica-tekstillä, lähde oli DOCX-, laskentataulukko-, TXT- tai HTML-tiedosto, jonka työkalu ladontaa uudelleen tekstinä A4-sivuille. Vie alkuperäinen tiedosto ensin PDF-muotoon omasta sovelluksestaan ja muunna sitten se PDF.
Sivut ovat vinossa tai kulmat leikkautuvat
Aseta Kierto ja Kierron vaihtelu arvoon 0 suoraa sivua varten. Oletukset (Kierto 1°) ovat siellä aitouden vuoksi, mutta oikeudenkäyntiasiakirjan tai automaattiseen käsittelyyn menevän lomakkeen tulisi yleensä olla suora. Jos haluat vinoutta, pidä se alle 2°:n, jotta kulmat pysyvät sivun sisällä.
Allekirjoitus tai leima näyttää pikselöityneeltä
Allekirjoitusviivat ovat ohuita ja kärsivät ensimmäisenä matalalla tarkkuudella. Käytä 2,5× tai 3×, pidä Sumennus enintään arvossa 0,3, ja jos asetat leima- tai allekirjoituskuvan lisäasetuksista, aloita korkearesoluutioisesta PNG-tiedostosta. Sijoita vain allekirjoituksia ja leimoja, joiden käyttöön sinulla on valtuudet.
Rakensimme Tarkkuus-säätimen PDF:n oman 72 pisteen ruudukon ympärille, jotta luvut pysyvät rehellisinä: 2× on 144 dpi, 3× on 216 dpi, mitään ei piiloteta. Siksi oletukset ovat 2× Harmaasävyllä: riittävän terävä tavalliselle leipätekstille ja paljon pienempi kuin saman sivun värillinen renderöinti. Pidämme kaiken paikallisena selaimessa, koska tiedostot, joita ihmiset tasoittavat, ovat yleensä juuri niitä, joita he vähiten haluavat lähettää palvelimelle.Make PDF look scanned -tiimi — verkkotyökalun ja Chrome-laajennuksen tekijät
PDF skannatuksi: usein kysytyt kysymykset
Nämä PDF skannatuksi PDF:ksi -vastaukset kattavat kysymykset, joita ihmiset kysyvät useimmin muuntamisen jälkeen: mitä piilotetulle tekstille ja metatiedoille tapahtuu, voiko muutoksen peruuttaa, miten OCR sopii kuvaan, mitkä asetukset kannattaa valita ja toimiiko työkalu puhelimissa. Jokainen vastaus kuvaa sitä, mitä työkalu todella tekee.
Poistaako PDF:n muuntaminen skannatuksi PDF:ksi piilotetun tekstin?
Kyllä, sivun sisällöstä. Uudet sivut ovat JPEG-kuvia siitä, mitä renderöijä piirtää, joten jäljellä ei ole tekstikerrosta, jota voisi kopioida, ei edes valkoista tekstiä tai mustan laatikon taakse piilotettuja sanoja. Käsittele tätä sivuvaikutuksena ja tarkista silti esikatselu, kun peittäminen on tärkeää.
Mitä alkuperäisen PDF:n metatiedoille tapahtuu?
Työkalu kirjoittaa uuden PDF:n ja antaa sinun asettaa sen otsikon, tekijän, aiheen, avainsanat, tuottajan ja luojan lisäasetuspaneelissa. Täytä nämä kentät haluamallasi tavalla ennen lataamista ja tarkista sitten tuloksen asiakirjaominaisuudet PDF-katseluohjelmassasi.
Voiko skannatun PDF:n muuttaa takaisin muokattavaksi PDF:ksi?
Ei täsmälleen. Alkuperäinen tekstikerros, fontit, linkit ja lomakekentät ovat poissa. OCR voi tunnistaa kirjaimet ja lisätä uuden haettavan kerroksen, ja jotkin ohjelmat voivat rakentaa muokattavaa tekstiä sen pohjalta, mutta muotoilu ja tarkkuus eivät vastaa alkuperäistä. Säilytä alkuperäinen tiedosto.
Voinko ajaa OCR:n skannatulle PDF:lle jälkikäteen?
Kyllä. Mikä tahansa OCR-vaihe tietokoneen PDF-ohjelmassa käsittelee tulostetta kuin tavallista skannausta. Korkeampi tarkkuus ja vähäinen kohina antavat paremman tunnistustuloksen, joten käytä 2×- tai 3×-tarkkuutta ja Kohinaa lähellä nollaa, jos aiot ajaa tiedostolle OCR:n.
Mitä eroa on "PDF:n tasoittamisella" ja "PDF skannatuksi"?
Tasoittaminen suppeassa merkityksessä yhdistää lomakekentät ja huomautukset sivuun, mutta teksti voi silti pysyä valittavana. PDF:n muuttaminen skannatuksi muuttaa koko sivun, teksti mukaan lukien, kuvaksi. Jälkimmäinen on voimakkaampi, ja sitä työkalumme tekee.
Minkä tarkkuuden pitäisi valita, kun PDF muunnetaan skannatuksi PDF:ksi?
Käytä 2× (noin 144 dpi) tavallisille asiakirjoille ja 3× (noin 216 dpi) pienelle painotekstille, tiheille taulukoille tai allekirjoituksille. Pudota 1,5×:ään vain, kun tiedoston täytyy olla hyvin pieni ja teksti on vähintään 12 pistettä.
Miksi skannattu PDF:ni on niin paljon alkuperäistä suurempi?
Tekstipohjainen PDF tallentaa kirjaimet tiiviinä käskyinä; skannattu PDF tallentaa jokaisen sivun jokaisen pikselin. Harmaasävy värin sijaan, alempi Tarkkuus ja vähäisempi Kohina pienentävät kaikki kokoa. Tuomioistuimet raportoivat saman ilmiön: yksi 317-sivuinen testitiedosto vaihteli 23,86 megatavusta 374,47 megatavuun värimoodista ja tarkkuudesta riippuen.
Hyväksyykö tuomioistuin skannatuksi PDF:ksi muunnetun PDF:n?
Se riippuu tuomioistuimesta. Jotkin piirikunnat vaativat tekstihaettavia pääasiakirjoja, toiset vain suosittelevat niitä. Lue paikalliset CM/ECF-säännöt ensin; jos olet epävarma, jätä alkuperäinen digitaalinen PDF tai lisää OCR skannattuun versioon.
Toimiiko PDF skannatuksi PDF:ksi -työkalu puhelimessa?
Kyllä. Verkkosivusto toimii puhelimen selaimissa, käsittelee tiedostot paikallisesti puhelimella ja lataa skannatun PDF:n tiedostoihisi. Pitkät asiakirjat 3×-tarkkuudella kestävät pidempään ja käyttävät enemmän muistia puhelimissa, joten 2× on niissä turvallisempi valinta.
Onko PDF skannatuksi PDF:ksi -muunnin ilmainen?
Kyllä. Verkkotyökalu ja Chrome-laajennus ovat ilmaisia, eivät vaadi rekisteröitymistä eivätkä lisää vesileimaa, ellet itse valitse lisätä sellaista lisäasetuksista.
Muunna PDF skannatuksi PDF:ksi nyt
Pudota PDF ilmaiseen työkaluun, valitse tarkkuus ja harmaasävy ja lataa pelkistä kuvista koostuva skannattu PDF. Kaikki käsitellään paikallisesti selaimessasi.