¿Qué es un PDF escaneado? Cómo distinguirlo de un PDF digital en 10 segundos
Un PDF escaneado es un PDF cuyas páginas son imágenes de papel, capturadas con un escáner o con la cámara de un móvil, en lugar de texto y formas vectoriales creados en el ordenador. Salvo que el OCR (reconocimiento óptico de caracteres) haya añadido una capa de texto oculta, no puedes seleccionar, buscar ni copiar sus palabras, y un lector de pantalla no encuentra nada que leer en la página.
Has recibido un PDF y necesitas saber qué es en realidad: un archivo exportado desde un procesador de textos, un escaneo de papel o un escaneo con texto reconocido. La respuesta decide si puedes buscar en él, si un tribunal o un organismo lo aceptará y si necesita OCR.
Esta guía ofrece una definición precisa, una prueba de 10 segundos, una comparación de los tres tipos de PDF y un glosario. Los datos proceden de las pautas de accesibilidad del W3C, de tribunales federales de EE. UU., del USCIS, de las normas de digitalización de la NARA (Administración Nacional de Archivos y Registros de EE. UU.) y de FADGI, de GOV.UK y de equipos de accesibilidad universitarios, además de lo que hemos aprendido al crear una herramienta de efecto escaneado.
¿Qué es exactamente un PDF escaneado?
Un PDF escaneado es un contenedor PDF que guarda una imagen rasterizada por página, obtenida al fotografiar o escanear una hoja física. Las letras que ves son píxeles, no caracteres. El software trata cada página como una foto, así que la búsqueda de texto, la copia y la adaptación del texto a la pantalla no funcionan sin OCR.
El Tribunal de Distrito de EE. UU. para el Distrito Norte de California, citando una guía de transferencia de los Archivos Nacionales, lo resume en una línea: «El texto escaneado es una fotografía de una página impresa, producida por una cámara digital o por un escáner» (N.D. Cal., guía para preparar escritos en CM/ECF). El formato PDF en sí no cambia: un PDF escaneado sigue siendo un archivo ISO 32000 válido. Lo que cambia es lo que hay dentro de cada página.
El equipo de accesibilidad de la Universidad James Madison describe el resultado desde el punto de vista del lector: «Los PDF de documentos escaneados suelen ser simples imágenes de documentos, parecidas a fotografías digitales, y normalmente no contienen texto legible» (Accesibilidad digital de la JMU). Ese único dato explica casi todas las diferencias prácticas que se tratan a continuación.
Esta es la definición desglosada en partes comprobables, tal como examinaría un archivo un responsable de registros o un auditor de accesibilidad.
- Contenido de la página
- Una imagen de mapa de bits por página (con compresión JPEG, JBIG2, CCITT o similar), no glifos de fuentes ni trazados vectoriales.
- Capa de texto
- Ninguna en un PDF de solo imagen; una capa OCR invisible en un PDF escaneado con texto buscable.
- Origen
- Un escáner plano o con alimentador automático, una fotocopiadora multifunción o la cámara de un móvil con una función de escaneo integrada en el sistema operativo.
- Resolución típica
- De 200 a 400 ppp (dpi); 300 ppp es el requisito más habitual para texto de oficina.
- Modo de color
- Bitonal (blanco y negro de 1 bit), escala de grises (8 bits) o color (24 bits).
- Comportamiento al ampliar
- Con mucho aumento, los bordes se convierten en bloques de píxeles visibles.
- Tamaño del archivo
- Normalmente mayor por página que el de un PDF de texto, sobre todo en escala de grises o en color.
¿En qué se diferencia un PDF escaneado de un PDF digital?
Un PDF escaneado guarda imágenes de las páginas, mientras que un PDF digital (nativo digital) guarda caracteres reales, fuentes y gráficos vectoriales exportados desde un programa. Existe un tercer tipo, el PDF escaneado con OCR, que conserva la imagen de la página pero añade debajo un texto oculto legible por máquina, lo que lo convierte en un PDF buscable.
El Tribunal de Distrito de Massachusetts traza la misma línea en sus normas de presentación electrónica: un PDF escaneado procede de papel pasado por un escáner óptico, mientras que un PDF «convertido electrónicamente» se crea desde un procesador de textos y tiene texto buscable (D. Mass., procedimientos administrativos de CM/ECF). La siguiente tabla compara los tres tipos.
| Propiedad | PDF nativo digital | PDF escaneado de solo imagen | PDF escaneado + OCR (buscable) |
|---|---|---|---|
| Cómo se crea | Exportar o imprimir a PDF desde Word, Google Docs, un navegador o cualquier app | Escáner, fotocopiadora o cámara del móvil | Primero se escanea, luego un software de OCR añade el texto |
| Qué contiene una página | Caracteres, fuentes incrustadas, líneas vectoriales, imágenes | Una imagen rasterizada | Una imagen rasterizada más texto invisible |
| Seleccionar y copiar texto | Sí, exacto | No | Sí, pero solo tan preciso como el OCR |
| Búsqueda con Ctrl/Cmd+F | Funciona | No encuentra nada | Funciona, puede fallar en palabras mal reconocidas |
| Lectores de pantalla | Legible, mejor si está etiquetado | Silencio | Legible, a menudo sin estructura |
| Ampliar al 400% | Bordes nítidos a cualquier tamaño | Pixelado | Pixelado |
| Tamaño típico por página | Decenas de KB | Unos 75 KB (bitonal) hasta más de 1 MB (escala de grises o color) | Igual que el de solo imagen, más una pequeña capa de texto |
| Parece papel | No | Sí | Sí |
Los tamaños por página de la tabla proceden de pruebas judiciales reales, no de estimaciones. El Distrito Norte de California escaneó un documento de 317 páginas: en bitonal a 300 ppp dio 23,86 MB, unos 75 KB por página, y en escala de grises a 400 ppp llegó a 374,47 MB, unos 1,2 MB por página. El Distrito Medio de Carolina del Norte señala que 2 MB contienen aproximadamente cuarenta y cinco páginas de texto en PDF, menos de 50 KB por página.
¿Qué significa copia escaneada frente a fotocopia?
Una copia escaneada es un archivo de imagen digital de un original en papel, normalmente entregado como PDF escaneado o JPEG. Una fotocopia es una segunda hoja de papel impresa por una fotocopiadora. Una copia certificada es cualquier copia que una persona autorizada ha comprobado frente al original y ha firmado.
La gente usa «copia escaneada» de forma imprecisa, y los tres términos se mezclan en formularios, correos de recursos humanos y listas de requisitos de visado. Las diferencias importan, porque pedir una no se satisface con otra.
| Término | Soporte | Quién la hace | Qué demuestra |
|---|---|---|---|
| Copia escaneada | Archivo digital (PDF, JPEG, TIFF) | Cualquiera con un escáner o un móvil | Que existe una imagen del documento; nada sobre su autenticidad |
| Fotocopia | Papel | Cualquiera con una fotocopiadora | Lo mismo: es una reproducción, no el original |
| Copia certificada (fiel) | Papel, a veces escaneado después | Un profesional que ha visto el original | Que la copia coincide con el original, según la palabra de esa persona |
| Original | Papel o archivo digital nativo | El emisor | El propio documento |
El gobierno del Reino Unido explica la certificación con sencillez: «Puedes certificar un documento como copia fiel haciendo que lo firme y feche una persona con una profesión reconocida, como un abogado» (GOV.UK, Certificar un documento). Una copia escaneada de esa página certificada sigue siendo una copia escaneada; la certificación vive en el papel, con la firma y la fecha.
Así que cuando un casero, un empleador o un centro educativo dice «envía una copia escaneada», casi siempre quiere decir «una imagen digital clara del papel, en PDF». Cuando dice «copia certificada», un simple escaneo no basta, por realista que parezca.
¿Cómo saber si un PDF está escaneado?
Para saber si un PDF está escaneado, intenta seleccionar una palabra de la página y busca una palabra que veas. Si nada se resalta, el PDF es de solo imagen. Ampliar la vista, las propiedades del documento, la lista de fuentes y el tamaño del archivo confirman después si el archivo está escaneado, es digital o está escaneado con OCR.
Las dos primeras comprobaciones tardan menos de 10 segundos y funcionan en cualquier visor de PDF, incluido el integrado en Google Chrome, en Microsoft Edge y en Vista Previa de macOS. El resto tarda un minuto y resuelve los casos dudosos.
- Intenta seleccionar texto. Arrastra el cursor sobre una línea. En un PDF nativo digital o con OCR, cada palabra se resalta por separado. En un PDF de solo imagen, nada se resalta, o algunos visores dibujan un rectángulo alrededor de toda la imagen de la página.
- Busca con Ctrl+F o Cmd+F. Escribe una palabra distintiva que veas claramente en la primera página. Cero resultados para una palabra que está claramente ahí significa que no hay capa de texto. Un resultado indica texto real o una capa de OCR.
- Amplía al 400%. Fíjate en el borde de una letra. El texto vectorial se mantiene perfectamente nítido a cualquier ampliación. Una página escaneada muestra escalones de píxeles, bordes grises suaves, motas y a veces patrones de bloques JPEG alrededor de las letras.
- Abre las propiedades del documento. En el visor de PDF de Chrome usa el menú de tres puntos y elige Propiedades del documento; en Vista Previa de macOS usa Herramientas y luego Mostrar inspector. El campo de productor o aplicación suele nombrar un escáner, un modelo de fotocopiadora, una función de escaneo del móvil o un motor de OCR. Un procesador de textos o «Imprimir a PDF» sugiere un archivo nativo digital.
- Comprueba la lista de fuentes. El software de PDF de escritorio muestra una pestaña de fuentes en las propiedades del documento. Un PDF nativo digital enumera las tipografías que usa. Un escaneo de solo imagen no enumera ninguna. Un escaneo con OCR suele mostrar una única fuente usada solo para la capa invisible.
- Compara el tamaño por página. Divide el tamaño del archivo entre el número de páginas. Un PDF de texto suele quedarse por debajo de 50 KB por página. Un escaneo en escala de grises o en color suele ir de varios cientos de KB a más de 1 MB por página. Los escaneos bitonales son compactos, así que el tamaño es la pista más débil.
El manual de accesibilidad de la Universidad Estatal de Cleveland recomienda la misma prueba rápida de búsqueda: «Si la palabra se resalta en la página, entonces tiene texto buscable, en lugar de ser una imagen escaneada de texto» (Heather Caprette, Universidad Estatal de Cleveland).
Los metadatos son una pista, no una prueba. Los campos de productor y creador pueden editarse con muchas herramientas, incluida la nuestra, así que confía más en cómo se comporta el contenido de la página al seleccionar y ampliar que en lo que diga el panel de propiedades.
¿Por qué los documentos escaneados son difíciles de buscar y leer?
Los documentos escaneados son difíciles de buscar y leer porque un PDF de solo imagen no contiene caracteres que el software pueda indexar. Los motores de búsqueda, la búsqueda de escritorio, copiar y pegar, las herramientas de traducción y los lectores de pantalla necesitan texto. Sin una capa de OCR, el PDF escaneado es una imagen que solo pueden usar las personas que ven.
La Iniciativa de Accesibilidad Web del W3C lo dice sin rodeos en la técnica PDF7 de las pautas WCAG: «Un documento formado por imágenes escaneadas de texto es intrínsecamente inaccesible porque el contenido del documento son imágenes, no texto buscable» (W3C WAI, técnica WCAG PDF7).
La misma página del W3C enumera lo que se pierde: «Las tecnologías de asistencia no pueden leer ni extraer las palabras; los usuarios no pueden seleccionar, editar, redimensionar ni reajustar el texto, ni cambiar los colores de texto y de fondo; y los autores no pueden manipular el PDF para hacerlo accesible». Su remedio es el OCR, para que exista texto real detrás de la imagen.
La oficina de accesibilidad de la Universidad de Georgetown añade la consecuencia práctica para quien depende de tecnología de asistencia: «Los PDF escaneados son una recopilación de imágenes, por lo que son ilegibles para la mayoría de los lectores de pantalla estándar» (Accesibilidad en Georgetown).
Los organismos públicos han ido más allá. El Servicio Digital del Gobierno del Reino Unido sostiene que, en comparación con HTML, la información publicada en PDF es más difícil de encontrar, usar y mantener (blog de GDS, GOV.UK). Un PDF escaneado de solo imagen es la versión extrema de ese problema: ni siquiera las palabras son legibles por máquina.
| Tarea | Nativo digital | Escaneo de solo imagen | Escaneo + OCR |
|---|---|---|---|
| Salida del lector de pantalla | Texto completo | Ninguna | Texto, a menudo desordenado |
| Reajuste en el móvil | Posible si está etiquetado | No | Raramente |
| Copiar una cita | Exacta | Hay que teclearla a mano | Puede contener errores de OCR |
| Se encuentra con la búsqueda de escritorio | Sí | Solo el nombre del archivo | Sí |
| Traducción automática | Sí | Necesita OCR antes | Sí |
¿Qué hace el OCR con un PDF escaneado?
El OCR, reconocimiento óptico de caracteres, lee la forma de las letras en un PDF escaneado y escribe el texto de máquina correspondiente en una capa invisible detrás de la imagen de cada página. La página se ve exactamente igual, pero se convierte en un PDF buscable: las palabras se pueden encontrar, seleccionar, copiar y leer en voz alta.
La Iniciativa de Directrices Digitales de Agencias Federales (FADGI) lo define con precisión: «El reconocimiento óptico de caracteres (OCR) es el proceso de convertir una imagen rasterizada de texto en texto electrónico buscable» (Directrices técnicas de FADGI, 3.ª ed., 2023). El OCR funciona con texto escrito a máquina, impreso y, de forma menos fiable, manuscrito.
Qué arregla el OCR en un documento escaneado
- La búsqueda con Ctrl/Cmd+F y la indexación de texto completo empiezan a funcionar.
- El texto se puede seleccionar, copiar y pegar en otros documentos.
- Los lectores de pantalla obtienen palabras que leer, lo que cumple el remedio básico de la técnica PDF7 del W3C.
- Los sistemas judiciales que exigen escritos con texto buscable pueden aceptar el archivo.
Qué no arregla el OCR
- La calidad de imagen. La página sigue siendo una foto, así que al ampliar sigue pixelándose. La JMU señala que, para quienes amplían la vista, «el resultado se vuelve pixelado y distorsionado porque el texto electrónico está debajo de la imagen del texto».
- La precisión. El desenfoque, la inclinación, la baja resolución y el ruido con motas provocan errores de lectura, como confundir «rn» con «m» o «1» con «l». El texto oculto puede estar mal aunque la imagen se vea bien.
- La estructura. Los encabezados, el orden de lectura, las celdas de tabla y el texto alternativo de las imágenes siguen necesitando un etiquetado manual para lograr accesibilidad completa.
- El tamaño del archivo. Las imágenes de página se mantienen, así que un PDF escaneado con OCR pesa casi lo mismo que la versión de solo imagen.
¿Cuándo piden las organizaciones una copia escaneada?
Las organizaciones piden una copia escaneada cuando el original existe en papel y necesitan un registro digital: pruebas de inmigración, anexos judiciales, expedientes de incorporación de recursos humanos, contratos firmados y recibos. Cada una fija sus propias reglas de formato, resolución y tamaño de archivo, y algunos tribunales exigen PDF buscables en lugar de solo imagen.
Pruebas de inmigración (USCIS)
El Servicio de Ciudadanía e Inmigración de EE. UU. (USCIS) acepta pruebas escaneadas o fotografiadas en la presentación online. Su instrucción es breve: «Usa un escáner o haz fotos de cada documento» y «Asegúrate de que cada imagen que adjuntes sea clara y de que todo el texto se pueda leer» (USCIS, consejos para presentar formularios online). Cada archivo puede pesar hasta 12 MB, en PDF, JPG o JPEG, y se acepta TIF o TIFF para algunos formularios.
Escritos judiciales federales (CM/ECF)
Los sistemas federales de presentación electrónica solo aceptan PDF, y muchos tribunales prefieren archivos nativos digitales. El Distrito Sur de Florida establece que «los escritos y documentos principales presentados electrónicamente en CM/ECF deben estar en formato PDF con texto buscable» (Preguntas frecuentes de CM/ECF, D. Sur de Florida). Los PDF escaneados se usan sobre todo para anexos y papel firmado que no tiene original digital.
Los ajustes de escaneo y los límites de tamaño varían según el tribunal. El Distrito Oeste de Washington exige escanear a 300 dpi, en blanco y negro salvo que el color sea imprescindible, y limita cada documento a 100 MB (preguntas técnicas frecuentes, D. Oeste de Washington). El Distrito de Minnesota limita cada anexo a 35 MB en sus procedimientos de ECF penal.
Recursos humanos, caseros, centros educativos y bancos
Los empleadores y los caseros suelen pedir una copia escaneada de un documento de identidad, un título, una oferta de trabajo firmada o una página del contrato de alquiler. Rara vez publican reglas técnicas; la mayoría menciona un límite de tamaño para adjuntos de correo y pide que se lea bien cada palabra. Cuando un portal no indica límites, un PDF en escala de grises a 300 dpi de menos de 10 MB es una estimación razonable por defecto, no una norma establecida.
| Solicitante | Formato | Norma de tamaño o resolución | ¿Exige texto buscable? |
|---|---|---|---|
| Presentación online del USCIS | PDF, JPG, JPEG (TIF/TIFF para algunos formularios) | 12 MB por archivo | No; el texto debe ser legible |
| Tribunal del D. Oeste de Washington | 300 dpi, B/N; 100 MB por documento | Depende del tipo de documento | |
| Tribunal del D. Sur de Florida | Se aplican los límites del tribunal | Sí, para documentos principales | |
| ECF penal del D. de Minnesota | 35 MB por anexo | Consulta las normas locales | |
| Empleador o casero | PDF o imagen | Normalmente el límite del correo | Raramente |
¿Se puede archivar un PDF escaneado como PDF/A?
Un PDF escaneado se puede guardar como PDF/A, la versión de archivo ISO 19005 del PDF, porque PDF/A permite páginas con imágenes. PDF/A añade reglas para la lectura a largo plazo, como fuentes incrustadas y ausencia de cifrado, pero no hace buscable una página de solo imagen. El OCR es un paso aparte.
PDF/A se publicó por primera vez el 1 de octubre de 2005 y prohíbe funciones que dificultan abrir los archivos décadas después, como la vinculación de fuentes y el cifrado (Wikipedia, PDF/A). Microsoft Office puede exportar archivos conformes con ISO 19005-1 directamente desde sus opciones de guardar como PDF.
Los tribunales que exigen PDF/A a menudo desaconsejan por completo el escaneo. El Distrito Este de Oklahoma recomienda que, para mantener bajo el tamaño de archivo y garantizar escritos con texto buscable, los documentos PDF/A se creen en un procesador de textos en lugar de imprimirlos y escanearlos (preguntas frecuentes sobre PDF/A, D. Este de Oklahoma).
- PDF/A nativo digital
- El más pequeño y totalmente buscable; la mejor opción cuando existe un original digital.
- PDF/A escaneado con OCR
- De archivo y buscable; la opción adecuada para registros que solo existen en papel.
- PDF/A de solo imagen
- Válido para la conservación, pero no es buscable ni accesible.
¿Cómo consigue un PDF digital el aspecto de un PDF escaneado?
Un PDF digital consigue el aspecto de un PDF escaneado cuando cada página se rasteriza en una imagen y se le añaden las imperfecciones de un escáner real: una leve rotación, desenfoque, ruido, gris o tono de papel. El resultado es un PDF de solo imagen que se comporta como un escaneo, sin imprimir nada ni tener un escáner.
Eso es exactamente lo que hace nuestra herramienta de efecto escaneado gratuita. Renderiza cada página del PDF en tu navegador, aplica los efectos que elijas y guarda cada página como una imagen JPEG dentro de un PDF nuevo. Los archivos se procesan localmente y no se suben a ningún servidor.
- Rotación
- de −10° a 10°, valor predeterminado 1°, más una variación aleatoria por página de hasta 10°.
- Desenfoque
- de 0 a 1, valor predeterminado 0,3, suaviza los bordes vectoriales igual que la óptica de un escáner.
- Ruido
- de 0 a 1, valor predeterminado 0,1, añade motas al estilo del sensor.
- Brillo y contraste
- de 0 a 2 cada uno, valor predeterminado 1.
- Amarillento
- de 0 a 2, valor predeterminado 0, tiñe la página como papel envejecido.
- Espacio de color
- Gris (predeterminado) o Color.
- Resolución
- de 1× a 3×; las páginas del PDF se renderizan a 72 dpi multiplicado por la escala, así que 2× equivale a unos 144 dpi y 3× a unos 216 dpi.
Como el resultado es de solo imagen, hereda todas las propiedades descritas antes: sin texto seleccionable, sin búsqueda, archivos más grandes, sin salida para lectores de pantalla. Eso es justo lo que busca quien necesita que un documento parezca una copia escaneada, y un inconveniente para quien lo necesita buscable. Conserva el archivo digital original.
Para conocer el proceso completo, incluidas las ventajas e inconvenientes de resolución y tamaño de archivo, lee cómo convertir un PDF a PDF escaneado. Para ver los seis métodos, desde imprimir y escanear hasta las opciones integradas del sistema operativo, consulta cómo hacer que un PDF parezca escaneado. ¿Partes de una foto tomada con el móvil? La guía para convertir una imagen en PDF escaneado cubre JPG y PNG.
Creamos nuestra herramienta para añadir un aspecto escaneado, y la pregunta más habitual que recibimos es en realidad «¿qué acabo de crear?». La respuesta honesta es un PDF de solo imagen. Parece papel, pero las palabras son píxeles. Si alguien necesita buscar en él o escucharlo leído en voz alta, conserva el original digital junto a él, o aplica OCR después. Preferimos que la gente lo sepa antes de pulsar Descargar.El equipo de Make PDF look scanned — creadores de la herramienta web y de la extensión de Chrome
Glosario de documentos escaneados: ¿qué términos importan?
Un documento escaneado trae su propio vocabulario: dpi y ppi, profundidad de bits, bitonal, OCR, rasterizar, PDF/A y JBIG2. Conocer estos siete términos basta para entender cualquier requisito de escaneo de un tribunal, un organismo o un empleador, y para valorar un PDF escaneado que recibas.
- dpi / ppi
- Puntos o píxeles por pulgada: cuántas muestras de imagen cubren una pulgada de papel. La NARA exige al menos 300 ppp para registros de texto modernos y 400 ppp para fotografías y registros con mucho detalle. La geometría de página del PDF usa 72 puntos por pulgada, por eso un renderizado a 1× equivale a 72 dpi.
- Profundidad de bits
- Bits almacenados por píxel. El bitonal es de 1 bit, la escala de grises es de 8 bits (256 tonos), y un escaneo en color típico es de 24 bits (8 bits en cada uno de tres canales).
- Bitonal
- Definición de FADGI: «Imágenes digitales producidas usando solo dos colores, blanco y negro». El formato legible más pequeño para texto sencillo.
- OCR
- Reconocimiento óptico de caracteres: software que convierte la forma de las letras de una imagen en texto de máquina, creando un PDF buscable.
- Rasterizar
- Convertir texto y formas vectoriales en una cuadrícula de píxeles. Rasterizar un PDF digital lo convierte en un PDF de solo imagen.
- PDF/A
- ISO 19005, el subconjunto de archivo del PDF, publicado en 2005; prohíbe funciones como el cifrado y la vinculación de fuentes.
- JBIG2
- Un método de compresión para escaneos bitonales que almacena los símbolos repetidos una sola vez. BBC News informó en 2013 de que algunas fotocopiadoras de oficina, al usar un modo JBIG2 con pérdida, alteraban dígitos en los escaneos, convirtiendo a menudo un 6 en un 8; en una prueba, una habitación de 21,11 m pasó a medir 14,13 m.
- PDF de solo imagen
- Un PDF escaneado sin ninguna capa de texto.
- PDF buscable
- Un PDF con texto real o de OCR que se puede buscar y seleccionar.
El caso de JBIG2 es el argumento más contundente para conservar los originales. Una copia escaneada es una imagen, y las imágenes pueden alterarse por la compresión sin que nadie lo note (BBC News, 2013). La NARA también trata el ruido como un artefacto indeseable «que no forma parte del material de origen» (36 CFR 1236, Subparte E).
Preguntas frecuentes sobre el PDF escaneado: ¿qué más se pregunta?
Estas preguntas sobre el PDF escaneado surgen sobre todo entre quienes reciben un archivo, necesitan enviar una copia escaneada o deben cumplir una norma judicial o administrativa. Cada respuesta es independiente, así que puedes ir directo a la que se ajuste a tu situación y actuar.
¿Qué es un PDF escaneado en términos sencillos?
Un PDF escaneado es un PDF formado por fotos de páginas de papel. El texto que ves forma parte de una imagen, así que no puedes seleccionarlo ni buscarlo salvo que se le haya aplicado OCR.
¿Es lo mismo un PDF escaneado que una copia escaneada?
Casi. Una copia escaneada es cualquier imagen digital de un documento en papel, y el PDF escaneado es el formato de archivo más habitual para entregarla. Una copia escaneada también puede ser un JPEG o un TIFF.
¿Cómo sé si un PDF está escaneado en 10 segundos?
Intenta seleccionar una palabra, luego pulsa Ctrl+F o Cmd+F y busca una palabra que veas. Si nada se resalta y la búsqueda no encuentra nada, el PDF es un escaneo de solo imagen. Amplía al 400% para confirmarlo: el texto escaneado se ve pixelado.
¿Puede un PDF escaneado ser buscable?
Sí. El OCR añade una capa de texto invisible detrás de las imágenes de página, convirtiendo un PDF escaneado en un PDF buscable. La página sigue pareciendo un escaneo, y pueden aparecer palabras mal reconocidas en el texto oculto.
¿Por qué no puedo copiar texto de mi PDF?
Lo más probable es que el PDF sea un escaneo sin OCR, así que no hay caracteres que copiar. Las preguntas frecuentes del tribunal del Distrito Sur de Florida señalan lo mismo: si un PDF no tiene texto buscable, su texto no se puede copiar. Aplica OCR o pide el original digital.
¿Son accesibles los PDF escaneados para los lectores de pantalla?
No sin OCR. Las pautas del W3C consideran los escaneos de solo imagen intrínsecamente inaccesibles. Tras el OCR, los lectores de pantalla pueden leer el texto en voz alta, pero la accesibilidad completa también necesita etiquetas para encabezados, orden de lectura y tablas.
¿Por qué pesa tanto un PDF escaneado?
Cada página es una imagen completa. Una página en escala de grises a 400 ppp puede superar 1 MB, mientras que una página de texto de un procesador de textos suele pesar menos de 50 KB. Escanear a 300 ppp en escala de grises o en blanco y negro mantiene el tamaño bajo.
¿Qué resolución debe tener un documento escaneado?
Para texto escrito a máquina o impreso, 300 dpi es el requisito estándar en los tribunales federales de EE. UU. y el mínimo de la NARA para registros de texto. Las fotos y el detalle fino requieren 400 ppp.
¿Es una copia escaneada una copia legal o certificada?
No, una copia escaneada por sí sola no demuestra nada sobre la autenticidad. Una copia certificada la firma y fecha un profesional que ha visto el original, como explica GOV.UK. Pregunta a quien la solicita qué tipo necesita.
¿Puedo hacer que un PDF digital parezca un PDF escaneado?
Sí. La herramienta gratuita Make PDF look scanned rasteriza cada página y añade rotación, desenfoque, ruido y tono de papel en tu navegador. El resultado es un PDF de solo imagen, así que conserva el original si necesitas que sea buscable.
¿Tiene que ser PDF/A un PDF escaneado?
Solo si quien lo solicita lo pide. Algunos tribunales y archivos exigen PDF/A para el almacenamiento a largo plazo. Un PDF escaneado se puede guardar como PDF/A, idealmente con OCR para que también sea buscable.
¿Puedo escanear varios PDF a la vez?
Con nuestra herramienta, sí: el escaneo por lotes procesa varios archivos y los descarga en un solo ZIP, con un PDF escaneado por cada archivo de entrada.
¿Cuál es la respuesta corta sobre los PDF escaneados?
Un PDF escaneado es una imagen de papel envuelta en un PDF. Compruébalo seleccionando y buscando texto, añade OCR cuando necesites que sea buscable o accesible, envía un PDF nativo digital cuando un tribunal lo prefiera, y usa un aspecto escaneado solo cuando lo que necesita el lector es la apariencia, no la autenticidad.
Si lo que necesitas es la apariencia, abre la herramienta de escaneo gratuita, mantén el espacio de color Gris predeterminado y la resolución 2×, y revisa la vista previa antes de descargar.
¿Necesitas un PDF que parezca una copia escaneada?
Suelta un PDF digital en la herramienta gratuita, ajusta la inclinación, el ruido y el tono del papel y descarga un PDF de imágenes que parece un escaneo real. Todo funciona en tu navegador.