Cos'è un PDF scansionato? Come distinguerlo da un PDF digitale in 10 secondi
Un PDF scansionato è un PDF le cui pagine sono immagini di fogli di carta, acquisite da uno scanner o dalla fotocamera di un telefono, invece che testo e forme vettoriali creati al computer. Se l'OCR non ha aggiunto un livello di testo nascosto, non puoi selezionarne, cercarne o copiarne le parole, e uno screen reader sulla pagina non legge nulla.
Hai ricevuto un PDF e devi capire che cosa sia davvero: un file esportato da un programma di videoscrittura, la scansione di un foglio di carta oppure una scansione con testo riconosciuto. La risposta stabilisce se puoi cercarci dentro, se un tribunale o un ente lo accetterà e se ha bisogno dell'OCR.
Questa guida ti offre una definizione precisa, un test da 10 secondi, un confronto tra i tre tipi di PDF e un glossario. I fatti provengono dalle linee guida sull'accessibilità del W3C, dai tribunali federali statunitensi, dall'USCIS, dalle norme di digitalizzazione di NARA e FADGI, da GOV.UK e dai team per l'accessibilità di alcune università, oltre che da ciò che abbiamo imparato costruendo uno strumento effetto scansione.
Che cos'è esattamente un PDF scansionato?
Un PDF scansionato è un contenitore PDF che racchiude un'immagine raster per ogni pagina, ottenuta fotografando o scansionando un foglio fisico. Le lettere che vedi sono pixel, non caratteri. I programmi trattano ogni pagina come una foto, quindi la normale ricerca nel testo, la copia e la reimpaginazione non funzionano senza OCR.
Il tribunale distrettuale degli Stati Uniti per il Northern District of California, citando le indicazioni dei National Archives sul trasferimento dei documenti, lo dice in una riga: «Il testo scansionato è una fotografia di una pagina stampata, prodotta da una fotocamera digitale o da uno scanner» (N.D. Cal., Preparing Your CM/ECF Filing). Il formato PDF in sé non cambia: un PDF scansionato resta un file ISO 32000 valido. Cambia ciò che si trova all'interno di ogni pagina.
Il team per l'accessibilità della James Madison University descrive il risultato dal punto di vista di chi legge: «I PDF di documenti scansionati sono spesso solo immagini dei documenti, simili a fotografie digitali, e di solito non contengono testo leggibile» (JMU Digital Accessibility). Questo solo fatto spiega quasi tutte le differenze pratiche descritte più avanti.
Ecco la definizione scomposta nelle sue parti verificabili, nello stesso modo in cui un addetto all'archivio o un revisore dell'accessibilità esaminerebbe un file.
- Contenuto della pagina
- Un'immagine bitmap per pagina (compressione JPEG, JBIG2, CCITT o simile), non glifi di caratteri e tracciati vettoriali.
- Livello di testo
- Assente in un PDF di sole immagini; un livello OCR invisibile in un PDF scansionato ricercabile.
- Origine
- Uno scanner piano o con alimentatore di fogli, una fotocopiatrice multifunzione o la fotocamera di un telefono con una funzione di scansione integrata nel sistema operativo.
- Risoluzione tipica
- Da 200 a 400 ppi; 300 ppi è il requisito più comune per i testi d'ufficio.
- Modalità colore
- Bitonale (bianco e nero a 1 bit), scala di grigi (8 bit) o colore (24 bit).
- Comportamento con lo zoom
- Con un forte ingrandimento i bordi si trasformano in blocchi di pixel visibili.
- Dimensione del file
- Di solito più pesante per pagina rispetto a un PDF di testo, soprattutto in scala di grigi o a colori.
In cosa un PDF scansionato è diverso da un PDF digitale?
Un PDF scansionato contiene immagini delle pagine, mentre un PDF digitale (nato digitale) contiene veri caratteri, font e grafica vettoriale esportati da un programma. Un terzo tipo, il PDF scansionato con OCR, conserva l'immagine della pagina ma aggiunge sotto di essa un testo nascosto leggibile dalla macchina, che lo rende un PDF ricercabile.
Il District of Massachusetts traccia la stessa distinzione nelle sue regole sul deposito telematico: un PDF scansionato nasce da un foglio di carta passato in uno scanner ottico, mentre un PDF «convertito elettronicamente» viene creato da un programma di videoscrittura ed è ricercabile nel testo (D. Mass. CM/ECF Administrative Procedures). La tabella mette a confronto i tre tipi.
| Proprietà | PDF nato digitale | PDF scansionato di sole immagini | PDF scansionato + OCR (ricercabile) |
|---|---|---|---|
| Come viene creato | Esportazione o stampa in PDF da Word, Documenti Google, un browser o qualsiasi app | Scanner, fotocopiatrice o fotocamera del telefono | Prima la scansione, poi un software OCR aggiunge il testo |
| Cosa contiene una pagina | Caratteri, font incorporati, linee vettoriali, immagini | Un'immagine raster | Un'immagine raster più testo invisibile |
| Selezionare e copiare il testo | Sì, in modo esatto | No | Sì, ma solo con la precisione dell'OCR |
| Ricerca con Ctrl/Cmd+F | Funziona | Non trova nulla | Funziona, ma può perdere parole lette male |
| Screen reader | Leggibile, al meglio se con tag | Muto | Leggibile, spesso senza struttura |
| Zoom al 400% | Bordi nitidi a qualsiasi dimensione | Pixelato | Pixelato |
| Dimensione tipica per pagina | Decine di KB | Da circa 75 KB (bitonale) a oltre 1 MB (scala di grigi o colore) | Come quello di sole immagini, più un piccolo livello di testo |
| Sembra carta | No | Sì | Sì |
Le dimensioni per pagina nella tabella derivano da test dei tribunali, non da supposizioni. Il Northern District of California ha scansionato un documento di 317 pagine: in bitonale a 300 ppi il file pesava 23,86 MB, circa 75 KB a pagina, mentre in scala di grigi a 400 ppi arrivava a 374,47 MB, circa 1,2 MB a pagina. Il Middle District of North Carolina osserva che 2 MB contengono circa quarantacinque pagine di testo PDF, meno di 50 KB a pagina.
Che differenza c'è tra copia scansionata e fotocopia?
Una copia scansionata è un file immagine digitale di un originale cartaceo, di solito consegnato come PDF scansionato o JPEG. Una fotocopia è un secondo foglio di carta stampato da una fotocopiatrice. Una copia autenticata è qualsiasi copia che una persona autorizzata ha confrontato con l'originale e ha firmato.
Le persone usano «copia scansionata» in modo generico, e i tre termini si confondono in moduli, email delle risorse umane ed elenchi di documenti per il visto. Le differenze contano, perché chi chiede l'una non si accontenta delle altre.
| Termine | Supporto | Chi la produce | Cosa dimostra |
|---|---|---|---|
| Copia scansionata | File digitale (PDF, JPEG, TIFF) | Chiunque abbia uno scanner o un telefono | Che esiste un'immagine del documento; nulla sulla sua autenticità |
| Fotocopia | Carta | Chiunque abbia una fotocopiatrice | Lo stesso: è una riproduzione, non l'originale |
| Copia autenticata (conforme) | Carta, a volte scansionata in seguito | Un professionista che ha visto l'originale | Che la copia corrisponde all'originale, sulla parola di quella persona |
| Originale | Carta o file digitale nativo | Chi lo emette | Il documento stesso |
Il governo britannico spiega la certificazione in modo semplice: «Puoi certificare un documento come copia conforme facendolo firmare e datare da un professionista, per esempio un avvocato» (GOV.UK, Certifying a document). La copia scansionata di quella pagina certificata resta una copia scansionata; la certificazione vive sulla carta, con la firma e la data.
Quindi, quando un proprietario di casa, un datore di lavoro o una scuola ti dice «mandami una copia scansionata», intende quasi sempre «un'immagine digitale nitida del foglio, in PDF». Quando invece parla di «copia autenticata», una scansione da sola non basta, per quanto realistica possa sembrare.
Come capire se un PDF è scansionato?
Per capire se un PDF è scansionato, prova a selezionare una parola sulla pagina e a cercare una parola che vedi. Se non si evidenzia nulla, il PDF è di sole immagini. Zoom, proprietà del documento, elenco dei font e dimensione del file confermano poi se il file è scansionato, digitale o scansionato con OCR.
I primi due controlli richiedono meno di 10 secondi e funzionano in qualsiasi visualizzatore PDF, compresi il visualizzatore integrato in Google Chrome e Microsoft Edge e Anteprima di macOS. Gli altri richiedono un minuto e risolvono i casi dubbi.
- Prova a selezionare il testo. Trascina il cursore lungo una riga. In un PDF nato digitale o con OCR, le singole parole si evidenziano. In un PDF di sole immagini non si evidenzia nulla, oppure alcuni visualizzatori disegnano un rettangolo intorno all'intera immagine della pagina.
- Cerca con Ctrl+F o Cmd+F. Digita una parola caratteristica che vedi chiaramente a pagina uno. Zero risultati per una parola che è lì, ben visibile, significa che non c'è un livello di testo. Un risultato indica testo vero o un livello OCR.
- Porta lo zoom al 400%. Osserva il bordo di una lettera. Il testo vettoriale resta nitidissimo a qualsiasi ingrandimento. Una pagina scansionata mostra scalini di pixel, sfumature grigie morbide, puntini e a volte i blocchi tipici del JPEG intorno alle lettere.
- Apri le proprietà del documento. Nel visualizzatore PDF di Chrome usa il menu con i tre puntini e scegli Proprietà del documento; in Anteprima di macOS usa Strumenti, poi Mostra Inspector. Il campo del produttore o dell'applicazione indica spesso uno scanner, il modello di una fotocopiatrice, una funzione di scansione del telefono o un motore OCR. Un programma di videoscrittura o «Print to PDF» fa pensare a un file nato digitale.
- Controlla l'elenco dei font. I software PDF per desktop mostrano una scheda Font nelle proprietà del documento. Un PDF nato digitale elenca i caratteri che usa. Una scansione di sole immagini non ne elenca nessuno. Una scansione con OCR spesso ne elenca uno solo, usato unicamente per il livello invisibile.
- Confronta la dimensione per pagina. Dividi la dimensione del file per il numero di pagine. Un PDF di testo di solito resta sotto i 50 KB a pagina. Una scansione in scala di grigi o a colori va spesso da diverse centinaia di KB a oltre 1 MB a pagina. Le scansioni bitonali sono compatte, quindi la dimensione è l'indizio più debole.
Il manuale sull'accessibilità della Cleveland State University consiglia lo stesso rapido test di ricerca: «Se la parola viene evidenziata sulla pagina, allora il documento contiene testo ricercabile e non è un'immagine scansionata di testo» (Heather Caprette, Cleveland State University).
I metadati sono un indizio, non una prova. I campi produttore e creatore si possono modificare con molti strumenti, compreso il nostro, quindi fidati più di come si comporta il contenuto della pagina con la selezione e lo zoom che di ciò che dice il pannello delle proprietà.
Perché i documenti scansionati sono difficili da cercare e leggere?
I documenti scansionati sono difficili da cercare e leggere perché un PDF di sole immagini non contiene caratteri che un programma possa indicizzare. Motori di ricerca, ricerca sul computer, copia e incolla, strumenti di traduzione e screen reader hanno tutti bisogno di testo. Senza un livello OCR, il PDF scansionato è un'immagine utilizzabile solo da chi vede.
La Web Accessibility Initiative del W3C è netta nella tecnica PDF7 delle linee guida WCAG: «Un documento costituito da immagini scansionate di testo è intrinsecamente inaccessibile, perché il contenuto del documento è fatto di immagini, non di testo ricercabile» (W3C WAI, WCAG Technique PDF7).
La stessa pagina del W3C elenca ciò che si perde: «Le tecnologie assistive non possono leggere né estrarre le parole; gli utenti non possono selezionare, modificare, ridimensionare o reimpaginare il testo, né cambiare i colori del testo e dello sfondo; e gli autori non possono intervenire sul PDF per renderlo accessibile». Il rimedio indicato è l'OCR, così che dietro l'immagine esista un testo vero.
L'ufficio per l'accessibilità della Georgetown University aggiunge la conseguenza pratica per chiunque si affidi alle tecnologie assistive: «I PDF scansionati sono una raccolta di immagini, quindi risultano illeggibili per la maggior parte degli screen reader standard» (Accessibility at Georgetown).
Nel settore pubblico c'è chi si è spinto oltre. Il Government Digital Service britannico sostiene che, rispetto all'HTML, le informazioni pubblicate in PDF sono più difficili da trovare, usare e mantenere aggiornate (blog del GDS, GOV.UK). Un PDF scansionato di sole immagini è la versione estrema di questo problema: nemmeno le parole sono leggibili dalla macchina.
| Attività | Nato digitale | Scansione di sole immagini | Scansione + OCR |
|---|---|---|---|
| Lettura con screen reader | Testo completo | Nessuna | Testo, spesso fuori ordine |
| Reimpaginazione sul telefono | Possibile se con tag | No | Raramente |
| Copiare una citazione | Esatta | Da ribattere a mano | Può contenere errori di OCR |
| Trovato dalla ricerca sul computer | Sì | Solo per nome del file | Sì |
| Traduzione automatica | Sì | Serve prima l'OCR | Sì |
Che cosa fa l'OCR a un PDF scansionato?
L'OCR, il riconoscimento ottico dei caratteri, legge le forme delle lettere in un PDF scansionato e scrive il testo corrispondente in un livello invisibile dietro ogni immagine di pagina. La pagina ha esattamente lo stesso aspetto, ma diventa un PDF ricercabile: le parole si possono trovare, selezionare, copiare e leggere ad alta voce.
La Federal Agencies Digital Guidelines Initiative lo definisce con precisione: «Il riconoscimento ottico dei caratteri (OCR) è il processo di conversione di un'immagine raster di testo in testo elettronico ricercabile» (FADGI Technical Guidelines, 3ª ed., 2023). L'OCR funziona sul testo dattiloscritto e stampato e, in modo meno affidabile, su quello scritto a mano.
Cosa risolve l'OCR in un documento scansionato
- La ricerca con Ctrl/Cmd+F e l'indicizzazione del testo completo iniziano a funzionare.
- Il testo si può selezionare, copiare e incollare in altri documenti.
- Gli screen reader hanno parole da pronunciare, il che soddisfa il rimedio di base indicato dalla tecnica PDF7 del W3C.
- I sistemi dei tribunali che richiedono atti con testo ricercabile possono accettare il file.
Cosa l'OCR non risolve
- Qualità dell'immagine. La pagina resta un'immagine, quindi con lo zoom si vedono ancora i pixel. La JMU osserva che, per chi ingrandisce, «il risultato diventa pixelato e distorto, perché l'eText si trova sotto l'immagine del testo».
- Precisione. Sfocatura, inclinazione, bassa risoluzione e rumore a puntini causano errori di lettura come «rn» al posto di «m» o «1» al posto di «l». Il testo nascosto può essere sbagliato mentre l'immagine sembra corretta.
- Struttura. Titoli, ordine di lettura, celle delle tabelle e testo alternativo delle immagini richiedono comunque tag inseriti a mano per un'accessibilità completa.
- Dimensione del file. Le immagini delle pagine restano, quindi un PDF scansionato con OCR è pesante quasi quanto la versione di sole immagini.
Quando enti e aziende chiedono una copia scansionata?
Enti e aziende chiedono una copia scansionata quando l'originale esiste su carta e serve loro una registrazione digitale: prove per pratiche di immigrazione, allegati per il tribunale, fascicoli di assunzione, contratti firmati e ricevute. Ognuno fissa le proprie regole su formato, risoluzione e dimensione del file, e alcuni tribunali richiedono PDF ricercabili invece di PDF di sole immagini.
Prove per l'immigrazione (USCIS)
L'U.S. Citizenship and Immigration Services accetta prove scansionate o fotografate per le domande online. Le sue istruzioni sono brevi: «Usa uno scanner o scatta una foto di ogni documento» e «Assicurati che ogni immagine allegata sia nitida e che tutto il testo sia leggibile» (USCIS, Tips for Filing Forms Online). Ogni file può pesare fino a 12 MB, in formato PDF, JPG o JPEG, con TIF o TIFF accettati per alcuni moduli.
Atti depositati nei tribunali federali (CM/ECF)
I sistemi federali di deposito telematico accettano solo PDF, e molti tribunali preferiscono i file nati digitali. Il Southern District of Florida stabilisce che «gli atti e i documenti principali depositati elettronicamente in CM/ECF devono essere in formato PDF con testo ricercabile» (S.D. Fla. CM/ECF FAQ). I PDF scansionati servono soprattutto per gli allegati e per i documenti cartacei firmati che non hanno un originale digitale.
Impostazioni di scansione e limiti di dimensione variano da un tribunale all'altro. Il Western District of Washington richiede una scansione a 300 dpi, in bianco e nero a meno che il colore non sia essenziale, e fissa un limite di 100 MB per documento (FAQ tecniche del W.D. Wash.). Il District of Minnesota limita ogni allegato a 35 MB nelle sue procedure ECF per i procedimenti penali.
Risorse umane, proprietari di casa, scuole e banche
Datori di lavoro e proprietari di casa di solito vogliono una copia scansionata di un documento d'identità, di un diploma, di una lettera di assunzione firmata o di una pagina del contratto d'affitto. Raramente pubblicano regole tecniche; la maggior parte cita un limite per gli allegati email e chiede che ogni parola sia leggibile. Quando un portale non indica limiti, un PDF in scala di grigi a 300 dpi sotto i 10 MB è un valore predefinito ragionevole secondo la nostra stima, non una regola ufficiale.
| Richiedente | Formato | Regola su dimensione o risoluzione | Testo ricercabile richiesto? |
|---|---|---|---|
| USCIS, domande online | PDF, JPG, JPEG (TIF/TIFF per alcuni moduli) | 12 MB per file | No; il testo deve essere leggibile |
| Tribunale W.D. Wash. | 300 dpi, B/N; 100 MB per documento | Dipende dal tipo di documento | |
| Tribunale S.D. Fla. | Si applicano i limiti del tribunale | Sì, per i documenti principali | |
| D. Minn., ECF penale | 35 MB per allegato | Verifica le regole locali | |
| Datore di lavoro o proprietario di casa | PDF o immagine | Di solito un limite per le email | Raramente |
Un PDF scansionato si può archiviare come PDF/A?
Un PDF scansionato si può salvare come PDF/A, la versione di archiviazione del PDF definita dalla norma ISO 19005, perché il PDF/A ammette immagini di pagina. Il PDF/A aggiunge regole per la leggibilità a lungo termine, come i font incorporati e l'assenza di cifratura, ma non rende ricercabile una pagina di sole immagini. L'OCR è un passaggio separato.
Il PDF/A è stato pubblicato per la prima volta il 1° ottobre 2005 e vieta le funzioni che rendono i file difficili da aprire a distanza di decenni, come il collegamento ai font esterni e la cifratura (Wikipedia, PDF/A). Microsoft Office può esportare direttamente file conformi alla ISO 19005-1 dalle opzioni di salvataggio in PDF.
I tribunali che richiedono il PDF/A spesso scoraggiano del tutto la scansione. L'Eastern District of Oklahoma raccomanda che, per contenere la dimensione dei file e garantire un testo ricercabile, i documenti PDF/A vengano creati con un programma di videoscrittura invece di essere stampati e poi scansionati (FAQ sul PDF/A dell'E.D. Okla.).
- PDF/A nato digitale
- Il più leggero e completamente ricercabile; la scelta migliore quando esiste un originale digitale.
- PDF/A scansionato con OCR
- Adatto all'archiviazione e ricercabile; la scelta giusta per i documenti che esistono solo su carta.
- PDF/A di sole immagini
- Valido per la conservazione, ma non ricercabile né accessibile.
Come si dà a un PDF digitale l'aspetto di un PDF scansionato?
Un PDF digitale assume l'aspetto di un PDF scansionato quando ogni pagina viene rasterizzata in un'immagine e riceve le imperfezioni di un vero scanner: una leggera rotazione, sfocatura, rumore, un tono grigio o da carta. Il risultato è un PDF di sole immagini che si comporta come una scansione, senza stampare nulla e senza possedere uno scanner.
È esattamente ciò che fa il nostro strumento effetto scansione gratuito. Visualizza ogni pagina del PDF nel tuo browser, applica gli effetti che scegli e salva ogni pagina come immagine JPEG all'interno di un nuovo PDF. I file vengono elaborati in locale e non vengono caricati su un server.
- Rotazione
- Da −10° a 10°, predefinito 1°, più una variazione casuale per pagina fino a 10°.
- Sfocatura
- Da 0 a 1, predefinito 0,3: ammorbidisce i bordi vettoriali come fa l'ottica di uno scanner.
- Rumore
- Da 0 a 1, predefinito 0,1: aggiunge una puntinatura simile a quella di un sensore.
- Luminosità e contrasto
- Da 0 a 2 ciascuno, predefinito 1.
- Ingiallimento
- Da 0 a 2, predefinito 0: dà alla pagina la tinta della carta invecchiata.
- Spazio colore
- Scala di grigi (predefinito) o A colori.
- Risoluzione
- Da 1× a 3×; le pagine PDF vengono visualizzate a 72 dpi moltiplicati per il fattore di scala, quindi 2× corrisponde a circa 144 dpi e 3× a circa 216 dpi.
Poiché il risultato è di sole immagini, eredita tutte le proprietà descritte sopra: niente testo selezionabile, niente ricerca, file più pesanti, nessuna lettura con lo screen reader. È proprio ciò che serve a chi vuole che un documento sembri una copia scansionata, ed è uno svantaggio per chi ha bisogno di poterci cercare dentro. Conserva il file digitale originale.
Per il procedimento completo, compresi i compromessi tra risoluzione e dimensione del file, leggi come convertire un PDF in PDF scansionato. Per tutti e sei i metodi, dalla stampa con successiva scansione alle opzioni integrate nel sistema operativo, consulta come far sembrare un PDF scansionato. Parti invece da una foto fatta con il telefono? La guida su come trasformare un'immagine in un PDF scansionato tratta JPG e PNG.
Abbiamo creato il nostro strumento per aggiungere un aspetto scansionato, e la domanda che riceviamo più spesso in realtà è: «Che cosa ho appena creato?». La risposta onesta è un PDF di sole immagini. Sembra carta, ma le parole sono pixel. Se chi legge deve poterci cercare dentro o ascoltarlo letto ad alta voce, tieni accanto l'originale digitale, oppure esegui l'OCR in un secondo momento. Preferiamo che le persone lo sappiano prima di premere Scarica.Il team Make PDF look scanned — creatori dello strumento web e dell'estensione Chrome
Glossario del documento scansionato: quali termini contano?
Un documento scansionato ha un suo vocabolario: dpi e ppi, profondità di colore, bitonale, OCR, rasterizzare, PDF/A e JBIG2. Conoscere questi sette termini basta per capire qualsiasi requisito di scansione di un tribunale, di un ente o di un datore di lavoro e per valutare un PDF scansionato che ricevi.
- dpi / ppi
- Punti o pixel per pollice: quanti campioni dell'immagine coprono un pollice di carta. La NARA richiede almeno 300 ppi per i documenti testuali moderni e 400 ppi per le fotografie e i documenti con dettagli fini. La geometria di pagina del PDF usa 72 punti per pollice, ed è per questo che una visualizzazione a 1× equivale a 72 dpi.
- Profondità di colore
- I bit memorizzati per ogni pixel. Il bitonale è a 1 bit, la scala di grigi a 8 bit (256 tonalità) e una tipica scansione a colori a 24 bit (8 bit per ciascuno dei tre canali).
- Bitonale
- La definizione della FADGI: «Immagini digitali prodotte usando solo due colori, il bianco e il nero». È il formato leggibile più leggero per il semplice testo.
- OCR
- Riconoscimento ottico dei caratteri: un software che trasforma le forme delle lettere di un'immagine in testo leggibile dalla macchina, creando un PDF ricercabile.
- Rasterizzare
- Convertire testo e forme vettoriali in una griglia di pixel. Rasterizzare un PDF digitale lo trasforma in un PDF di sole immagini.
- PDF/A
- La norma ISO 19005, il sottoinsieme del PDF pensato per l'archiviazione, pubblicato nel 2005; vieta funzioni come la cifratura e il collegamento ai font esterni.
- JBIG2
- Un metodo di compressione per scansioni bitonali che memorizza una sola volta i simboli ripetuti. Nel 2013 BBC News ha riferito che alcune fotocopiatrici da ufficio che usavano una modalità JBIG2 con perdita alteravano le cifre nelle scansioni, spesso trasformando un 6 in un 8; in un test la misura di una stanza di 21,11 m era diventata 14,13 m.
- PDF di sole immagini
- Un PDF scansionato senza alcun livello di testo.
- PDF ricercabile
- Un PDF con testo vero o testo OCR che si può cercare e selezionare.
Il caso JBIG2 è l'argomento più forte a favore della conservazione degli originali. Una copia scansionata è un'immagine, e le immagini possono essere alterate dalla compressione senza che nessuno se ne accorga (BBC News, 2013). Anche la NARA considera il rumore un artefatto indesiderato che «non fa parte del materiale di origine» (36 CFR 1236 Subpart E).
Domande frequenti sul PDF scansionato: cos'altro si chiede?
Queste domande sul PDF scansionato arrivano soprattutto da chi ha ricevuto un file, deve inviare una copia scansionata o deve rispettare una regola di un tribunale o di un ente. Ogni risposta è autonoma, quindi puoi passare direttamente a quella che corrisponde alla tua situazione e agire di conseguenza.
Che cos'è un PDF scansionato, in parole semplici?
Un PDF scansionato è un PDF composto da foto di pagine di carta. Il testo che vedi fa parte di un'immagine, quindi non puoi selezionarlo né cercarlo, a meno che non sia stato applicato l'OCR.
Un PDF scansionato è la stessa cosa di una copia scansionata?
Quasi. Una copia scansionata è qualsiasi immagine digitale di un documento cartaceo, e il PDF scansionato è il formato di file più comune per consegnarla. Una copia scansionata può anche essere un JPEG o un TIFF.
Come capisco in 10 secondi se un PDF è scansionato?
Prova a selezionare una parola, poi premi Ctrl+F o Cmd+F e cerca una parola che vedi. Se non si evidenzia nulla e la ricerca non trova niente, il PDF è una scansione di sole immagini. Porta lo zoom al 400% per averne conferma: il testo scansionato appare pixelato.
Un PDF scansionato può essere ricercabile?
Sì. L'OCR aggiunge un livello di testo invisibile dietro le immagini delle pagine e trasforma un PDF scansionato in un PDF ricercabile. La pagina continua a sembrare una scansione, e nel testo nascosto possono comparire parole lette male.
Perché non riesco a copiare il testo dal mio PDF?
Molto probabilmente il PDF è una scansione senza OCR, quindi non ci sono caratteri da copiare. Le FAQ del tribunale del Southern District of Florida dicono la stessa cosa: se un PDF non ha testo ricercabile, il suo testo non si può copiare. Esegui l'OCR o chiedi l'originale digitale.
I PDF scansionati sono accessibili agli screen reader?
Non senza OCR. Le linee guida del W3C definiscono le scansioni di sole immagini intrinsecamente inaccessibili. Dopo l'OCR gli screen reader possono leggere il testo, ma un'accessibilità completa richiede anche i tag per titoli, ordine di lettura e tabelle.
Perché un PDF scansionato è così pesante?
Ogni pagina è un'immagine completa. Una pagina in scala di grigi a 400 ppi può superare 1 MB, mentre una pagina di testo creata con un programma di videoscrittura spesso pesa meno di 50 KB. Scansionare a 300 ppi in scala di grigi o in bianco e nero contiene la dimensione.
Che risoluzione deve avere un documento scansionato?
Per il testo dattiloscritto o stampato, 300 dpi è il requisito standard nei tribunali federali statunitensi e il minimo fissato dalla NARA per i documenti testuali. Foto e dettagli fini richiedono 400 ppi.
Una copia scansionata è una copia legale o autenticata?
No, una copia scansionata da sola non dimostra nulla sull'autenticità. Una copia autenticata viene firmata e datata da un professionista che ha visto l'originale, come spiega GOV.UK. Chiedi a chi la richiede di quale tipo ha bisogno.
Posso far sembrare un PDF digitale un PDF scansionato?
Sì. Lo strumento gratuito Make PDF look scanned rasterizza ogni pagina e aggiunge rotazione, sfocatura, rumore e tono della carta nel tuo browser. Il risultato è un PDF di sole immagini, quindi conserva l'originale se ti serve la ricerca.
Un PDF scansionato deve essere per forza in PDF/A?
Solo se lo chiede il destinatario. Alcuni tribunali e archivi richiedono il PDF/A per la conservazione a lungo termine. Un PDF scansionato si può salvare come PDF/A, idealmente con OCR, così è anche ricercabile.
Posso scansionare più PDF contemporaneamente?
Con il nostro strumento sì: la Scansione multipla elabora più file e li scarica in un unico ZIP, con un PDF scansionato per ogni file in ingresso.
PDF scansionato: qual è la risposta in breve?
Un PDF scansionato è l'immagine di un foglio di carta racchiusa in un PDF. Verificalo selezionando e cercando il testo, aggiungi l'OCR quando ti servono ricerca o accessibilità, invia un PDF nato digitale quando un tribunale lo preferisce e usa un aspetto scansionato solo quando al lettore serve l'aspetto, non l'autenticità.
Se ti serve proprio l'aspetto, apri lo strumento di scansione gratuito, mantieni lo Spazio colore predefinito Scala di grigi e la Risoluzione 2× e controlla l'anteprima prima di scaricare.
Ti serve un PDF che sembri una copia scansionata?
Trascina un PDF digitale nello strumento gratuito, imposta inclinazione, rumore e tono della carta e scarica un PDF di immagini che sembra una vera scansione. Tutto nel browser.