PDFを画像化してスキャンPDFに:変換・フラット化と読みやすさのコツ
PDFを画像化してスキャンPDFに変換するとは、すべてのページを画像としてレンダリングし、その画像を新しいPDFに保存することです。これにより、テキストレイヤー、リンク、フォームフィールドはすべて単なるピクセルになります。読みやすく軽いページにしたいなら、解像度は2×、カラーモードはグレーを選びましょう。スキャン風の見た目も欲しい場合に限り、軽いノイズと傾きを加えます。
PDFをスキャンPDFに変換する理由はさまざまです。提出先のポータルが画像だけのファイルを求めている、同僚からフラット化したコピーを頼まれた、あるいはオフィスのスキャナーを通したような見た目の書類が必要になった、といったケースです。このガイドでは、解像度、カラー、ファイルサイズ、検索のしやすさ、裁判所の規則といったトレードオフを、ツールの具体的な設定値、米国連邦裁判所の数値、アメリカ国立公文書記録管理局(NARA)とFADGIの基準とあわせて解説します。
PDFの画像化(スキャンPDFへの変換)とは?
PDFの画像化とは、デジタルPDFの各ページを指定したピクセル密度でキャンバスに描き、その結果を新しいPDFの中に画像として保存する処理です。見た目は元のままですが、文字も罫線もロゴも、1ページにつき1枚の画像の一部になります。
実際のスキャナーも、デジタルのページではなく紙を相手に同じことをしています。米国カリフォルニア州北部地区連邦地方裁判所は、その結果をわかりやすくこう説明しています。「スキャンされたテキストとは、デジタルカメラまたはスキャナーによって作成された、印刷ページの写真です。」ページが写真になると、誰かがOCR(光学文字認識)をかけるまで、文字の選択、コピー、検索はできなくなります。
混同されやすい用語が2つあります。厳密な意味でのPDFのフラット化は、フォームフィールド、コメント、スタンプといったインタラクティブな要素をページの内容に統合する処理で、テキストは選択できるまま残ることがあります。一方、PDFのラスタライズは、テキストも含めてすべてをピクセルに変える処理です。PDFをスキャンPDFに変換するのは後者で、より強力な処理です。
仕上がりには2つのタイプがあります。クリーンな画像PDFは、ページをくっきり、まっすぐに保ちます。スキャン風のPDFは、わずかな傾き、やわらかいピント、ノイズ、紙の色味を加えます。PDFを画像化してスキャンPDFにする無料ツールなら、同じ設定項目でどちらも作れます。どんなファイルがスキャンPDFにあたるのかについては、スキャンPDFとはをご覧ください。
スキャンPDFになると何が変わる?
PDFがスキャンPDFになると、ページの見た目はそのままで、ページ上の機械可読な要素はすべてピクセルに置き換わります。テキスト、フォント、リンク、フォームフィールド、注釈は独立したオブジェクトではなくなります。ファイルサイズはたいてい大きくなり、OCRをかけるまで検索、コピー、読み上げはできなくなります。
次の表は、ワープロソフトから書き出した一般的なPDFと、同じファイルをページ画像に変換したあとの状態を比べたものです。変換後(右端の列)の挙動は、このツールを含め、どの画像化の方法でも同じです。各ページがJPEG画像として新しいPDFに保存されるためです。
| 要素 | 元のデジタルPDF | PDFを画像化してスキャンPDFにしたあと |
|---|---|---|
| テキストレイヤー | 選択、コピー、検索ができる本物の文字 | ページから消え、文字はピクセルとしてだけ存在する |
| フォント | 埋め込み、または参照されたフォントファイル | フォントは不要になり、文字の形は画像に焼き込まれる |
| リンク | クリックできるURLや文書内ジャンプ | リンクの文字は見えるが、クリックはできない |
| フォームフィールド | 入力欄、チェックボックス、ドロップダウン | 入力できなくなる。どの値が画像に描き込まれたかはプレビューで確認する |
| 注釈 | コメント、ハイライト、スタンプが独立したオブジェクトとして存在 | 編集できるオブジェクトではなくなり、残ったものはすべて画像の一部になる |
| 文書のメタデータ | 作成アプリが設定したタイトル、作成者などのプロパティ | 新しいPDFが書き出される。タイトル、作成者、件名、キーワード、PDF変換ソフト、作成アプリケーションは、ツールの追加設定で指定できる |
| ファイルサイズ | テキストのページなら小さい | たいてい大きくなる。解像度、カラーモード、ページ数によって変わる |
| 検索のしやすさ | Ctrl+Fもスクリーンリーダーも使える | OCRでテキストレイヤーを加えるまで、検索もアクセシビリティ対応もできない |
2つの行は、もう少し詳しく見ておく価値があります。フォームフィールドと注釈が見た目として残るかどうかは、ページのレンダラーがそれを描画するかどうかで決まります。入力済みの値はたいてい印刷された文字として残りますが、ポップアップのコメントは消えることがあるので、ライブプレビューで確認してください。メタデータについては、追加設定のパネルで新しいPDFに持たせるプロパティを入力できます。送信する前に確認しましょう。
いちばん驚かれるのはファイルサイズの行です。ノースカロライナ州中部地区連邦地方裁判所は、2MBでPDFのテキストなら約45ページ分になると述べたうえで、「ほとんどのスキャンPDFは検索できず、ファイルサイズも大きくなります」と明記しています。テキストPDFは文字を記述するだけですが、スキャンPDFは文字のピクセルを1つ残らず保存するからです。
ブラウザでPDFを画像化してスキャンPDFにするには?
ブラウザでPDFを画像化してスキャンPDFにするには、pdflookscanned.com/scanの無料ツールを開き、ファイルをドロップして、解像度、カラーモード、スキャン効果を設定し、ライブプレビューを確認してからダウンロードします。処理はすべて端末内で行われ、時間がかかるのは長い文書や高い解像度のときだけです。
- スキャンツールを開く。最新のパソコン用またはスマホ用ブラウザでpdflookscanned.com/scanにアクセスするか、Chrome拡張機能のサイドパネルを開きます。アカウントも登録も必要ありません。
- PDFを追加する。ファイルをドロップエリアにドラッグするか、クリックして選択します。PDFはそのまま使われるので、いま見えているページのレイアウト、フォント、画像がそのままレンダリングされます。
- 解像度を選ぶ。一般的な手紙や申込書なら、解像度はデフォルトの2×(約144dpi)のままで十分です。脚注、細かい文字、情報量の多い表がある場合は、2.5×または3×(約216dpi)に上げてください。
- カラーモードを選ぶ。テキスト中心の書類はグレー(デフォルト)のままにします。グラフ、マーカーを引いた条項、カラーのロゴなど、色そのものに意味があるときだけカラーに切り替えます。
- 見た目を決める。クリーンなフラット化にするなら、回転、回転のばらつき、ぼかし、ノイズを0にします。スキャン風にするなら、デフォルト(回転1°、ぼかし0.3、ノイズ0.1)のままにするか、少しだけ調整します。
- 明るさと紙の色味を微調整する。明るさとコントラストのデフォルトは1です。グレーの文字が薄く見える場合は、コントラストを少し上げます。黄ばみは古い紙のような色味を加える設定で、デフォルトは0です。
- 必要に応じて追加設定を使う。任意で、テキストまたは画像の透かし、使用する権利のあるスタンプや署名の画像、文書のメタデータ(タイトル、作成者、件名、キーワード、PDF変換ソフト、作成アプリケーション)を追加できます。
- プレビューを確認してダウンロードする。プレビューでいちばん小さい文字を拡大してみます。きれいに読めれば、新しいスキャンPDFをダウンロードします。読みにくければ解像度を上げて、もう一度プレビューしてください。
元のファイルがWord、Google ドキュメント、スプレッドシートの場合は、先にPDFに書き出してください(Wordなら「ファイル」→「名前を付けて保存」→ PDF、Google ドキュメントなら「ファイル」→「ダウンロード」→「PDF ドキュメント(.pdf)」)。このツールはDOCXやXLSXも直接読み込めますが、取り出すのはテキストだけで、それをA4ページに11ポイントのHelveticaで組み直すため、書式、表、画像は失われます。
先にPDFに書き出しておけば、レイアウトはデザインしたとおりに保たれます。PDFをスキャンしたように見せる方法の完全ガイドでは、この方法をほかの5つの方法と比較しています。
スキャンPDFを読みやすく保つ解像度は?
スキャンPDFが読みやすいかどうかは、1文字あたりに十分なピクセルがあるかで決まります。このツールはPDFのページを72dpi×解像度の設定値でレンダリングするので、1×は約72dpi、2×は約144dpi、3×は約216dpiです。実際のアーカイブ用スキャンは200〜300ppiが目安なので、細かい文字には3×が向いています。
72という数字は、PDFのページの測り方に由来します。PDFとPostScriptの座標は1インチ=72ポイントが基準なので、レターサイズのページは612×792ポイントです。これを1×でレンダリングすると612×792ピクセル、2×なら1,224×1,584ピクセル、3×なら1,836×2,376ピクセルになります。ピクセル数は倍率の2乗で増えます。
- 1×(約72dpi)
- レターサイズで612×792px。大きな見出しやスライドなら問題ありませんが、本文の文字は崩れはじめます。ファイルはいちばん小さくなります。
- 1.5×(約108dpi)
- レターサイズで918×1,188px。画面上の12ポイントの文字なら許容範囲ですが、脚注には不向きです。
- 2×(約144dpi、デフォルト)
- レターサイズで1,224×1,584px。手紙、請求書、申込書の本文がはっきり読めます。バランスのよい選択です。
- 2.5×(約180dpi)
- レターサイズで1,530×1,980px。普通の本文と小さなラベルが混在する書類に使います。
- 3×(約216dpi)
- レターサイズで1,836×2,376px。細かい文字のある契約書、情報量の多い表、くっきり残したい署名に最適です。
スキャンPDFの解像度ごとの小さな文字の見え方
簡単な計算で、小さな文字にピクセルが多く必要な理由がわかります。8ポイントの脚注は、フォントサイズとしては8/72インチの高さです。1×では、上に伸びる部分や下に伸びる部分を含めた文字全体の高さが約8ピクセルしかなく、小文字の「e」と「c」がつぶれて見分けにくくなります。2×なら約16ピクセル、3×なら約24ピクセルになり、軽いぼかしやJPEG圧縮のあとでも楽に読めます。
比較のために挙げると、アメリカ国立公文書記録管理局(NARA)は連邦規則集36 CFR 1236 Subpart Eで、デジタル化する現代の文字記録には300ppi以上、写真や細部の多い記録には400ppi以上を求めています。FADGI(米国連邦政府機関のデジタル化ガイドライン)は2023年の技術ガイドラインで、綴じられていない書類を200ppi(1つ星)から250ppi、300ppiを経て400ppi(4つ星)までの星の段階で評価しています。これらの基準は、紙の原本を守るためのものです。
PDFの画像化は、しわのある紙ではなく完璧なデジタルのページから始まるので、くっきり見せるのにアーカイブ並みの密度は必要ありません。私たちの経験では、普通の10〜12ポイントの文字なら2×で十分で、3×(216dpi)は細かい文字に対してFADGIの1つ星レベルをわずかに上回ります。
NARAは同じ規則の中で、次のような有益な注意も添えています。「行政機関は、スキャナーのppi設定やカメラセンサーのメガピクセル数といった機器の仕様だけに頼って、デジタル画像の品質を確保することはできません。」実際には、数値ではなくプレビューで判断してください。
グレー・カラー・2値:ファイルが小さいのは?
同じ解像度なら、2値(純粋な白黒)のファイルがいちばん小さく、グレースケールが中間、カラーがいちばん大きくなります。PDFの画像化では、実用的なデフォルトはグレースケールです。アンチエイリアスのかかった文字の輪郭がなめらかに保たれ、カラーよりはるかに小さく収まります。カラーは、色が情報を持つときだけ使いましょう。
最も説得力のある実データは、カリフォルニア州北部地区連邦地方裁判所によるもので、同じ317ページの書類を2通りの方法でスキャンしています。300ppiの2値ファイルでは23.86MBで、判読性も保たれていました。一方、400ppiのグレースケールでは374.47MBにまで膨らみました。同じページでも約15倍の大きさで、その原因は色の深さと解像度の高さの両方にあります。
| モード | 1ピクセルあたりのビット数 | 相対的なサイズ | 向いている用途 |
|---|---|---|---|
| 2値(白黒) | 1 | 最小 | 文字だけの裁判所提出書類。このツールにはないモード |
| グレースケール(ツールでは「グレー」) | 8 | 中 | 手紙、契約書、申込書、署名のある書類全般 |
| カラー(ツールでは「カラー」) | 24 | 最大 | グラフ、カラーのスタンプ、写真、マーカーを引いた文字 |
このツールにはグレーとカラーがあり、各ページをJPEG画像として保存します。JPEGはグレーの階調を効率よく扱えますが、FADGIが指摘するとおり、「標準的なJPEG処理では8×8ピクセルのブロックが生じ、それは明らかに元のコンテンツには含まれないものです」。2×や3×なら、文字の上でこのブロックが目立つことはほとんどありません。
本当の1ビットの白黒が必要な場合は、カラーPDFを白黒に変換する方法のガイドで、違いと選択肢を説明しています。
スキャンPDFで引っかかりやすいファイルサイズの上限
アップロードの上限があるため、カラーの選択は見た目の問題ではなく実務上の問題になります。ワシントン州西部地区連邦地方裁判所は1書類あたり100MBの上限を設け、色が不可欠な場合を除いて300dpiの白黒スキャンを求めています。ミネソタ州連邦地方裁判所は刑事事件のECF手続きで、証拠書類1件あたり35MBを上限としています。アメリカ合衆国市民権・移民業務局(USCIS)は、アップロードする証拠ファイル1件あたり12MBまでに制限しています。
きれいにフラット化するか、スキャン風にするか?
相手が編集できるテキストのない画像PDFを求めているだけなら、クリーンなフラット化を選びます。スキャナーを通した紙のように見せる必要があるなら、スキャン風を選びます。どちらも同じツールでできます。回転、回転のばらつき、ぼかし、ノイズを0にすればクリーンなフラット化、0より大きくすればリアルなスキャン風になります。
クリーンなフラット化が正解になる場面は少なくありません。たとえば、テキストエディターで条項をこっそり打ち直されないように最終版の契約書を送るとき、入力済みのフォームの値を欄ごとに変更できないよう固定するとき、フォントやフォームフィールドを含むPDFを受け付けないシステムにページを提出するときです。こうした場面では、傾きや斑点は何の役にも立ちません。
| 設定(範囲) | クリーンなフラット化 | 軽いスキャン風 | 強めのスキャン風 |
|---|---|---|---|
| 回転(−10°〜10°) | 0° | 1°(デフォルト) | 1.5°〜2° |
| 回転のばらつき(0〜10°) | 0 | 0.5 | 1 |
| ぼかし(0〜1) | 0 | 0.3(デフォルト) | 0.4〜0.5 |
| ノイズ(0〜1) | 0 | 0.1(デフォルト) | 0.2〜0.3 |
| 明るさ/コントラスト(0〜2) | 1/1 | 1/1.1 | 1.05/1.2 |
| 黄ばみ(0〜2) | 0 | 0〜0.2 | 0.3〜0.5 |
| 枠線 | なし | なし | あり |
| カラーモード/解像度 | グレーまたはカラー/2×〜3× | グレー/2× | グレー/2× |
スキャン風の設定値は、アーキビストが取り除こうとする欠陥をまねたものです。NARAの規則はノイズを「デジタル化された記録に含まれる、原資料の一部ではない1つ以上の望ましくない画像アーティファクト」と定義し、傾きや不適切なトリミングも確認すべき欠陥として挙げています。どれも少しなら本物らしく見えますが、やりすぎると質の悪いコピーに見えます。
スキャン風にする際の注意点が2つあります。ぼかしを約0.5より上げると小さな文字がすぐにぼやけるので、ぼかしを上げるときは解像度も上げてください。また、2°を超える回転はページの角が切れてしまい、リアルというより雑な印象になります。アーティファクトの全体像とすぐに使える組み合わせについては、スキャン風加工の設定ガイドをご覧ください。
スキャンPDFが求められる場面、断られる場面は?
スキャンPDFは、画像のみのアップロードやフラット化した最終版など、求められることもありますが、テキスト検索が重要な場面では断られることも少なくありません。連邦裁判所やアクセシビリティの規則はテキスト検索可能なPDFを好む傾向があるので、PDFを画像化する前に提出先のルールを確認し、元のファイルは必ず残しておきましょう。
いちばんわかりやすい例は裁判所です。米国連邦司法府のFAQには「CM/ECFシステムは、PDF形式の書類のみを受け付けるように設計されています」とありますが、細かいルールは地区ごとに異なります。フロリダ州南部地区連邦地方裁判所は厳格で、「CM/ECFで電子的に提出する訴答書面・主要書類は、テキスト検索可能なPDF形式でなければなりません」としており、証拠書類もできる限り検索可能にするよう求めています。
禁止ではなく、好ましい形式を示すにとどめる地区もあります。マサチューセッツ州連邦地方裁判所は「CM/ECFへの提出には、スキャンしたものではなくPDFに変換した書類が望ましい」と記しています。ミネソタ州連邦地方裁判所は「テキスト検索可能なスキャンPDF書類が望ましいが、必須ではない」としています。オクラホマ州東部地区連邦地方裁判所は、ファイルを小さく検索可能に保つために、印刷してスキャンするのではなく、ワープロソフトから直接PDF/Aファイルを作成するよう勧めています。
断られる2つ目の理由はアクセシビリティです。W3CのWCAG実装方法PDF7には「テキストをスキャンした画像で構成された文書は、その内容が検索可能なテキストではなく画像であるため、本質的にアクセシブルではありません」とあります。行政機関、大学、多くの企業が一般向けに公開する書類はWCAGを満たす必要があるため、OCRを加えない限り、画像のみのファイルはふさわしい形式ではありません。
OCRでテキストレイヤーを戻す
フラット化した見た目と検索のしやすさを両立させたい場合は、先に変換してから、「テキスト認識」や「検索可能にする」といった機能のあるパソコン用のPDFソフトでOCRをかけます。OCRはページ画像の背後に見えないテキストを配置するので、見た目はスキャンのまま、Ctrl+Fが再び使えるようになります。OCRは文字を推定するものなので、重要な書類は必ず校正してください。
PDFの画像化をオンラインで行っても安全?
処理がブラウザ内で行われるなら、PDFの画像化をオンラインで行っても安全です。このツールはpdf.jsとブラウザのキャンバスを使ってページを端末内でレンダリングするため、ファイルが処理用サーバーにアップロードされることはありません。初回アクセス後はオフラインでも動作するので、そのことをご自身で確かめられます。
ローカル処理が重要なのは、フラット化されるのが署名済みの契約書、給与記録、医療関係の書類、税務書類といったファイルだからです。多くのオンライン変換サービスはPDFをアップロードしてサーバーで処理し、結果を送り返します。つまり、少なくとも一時的には、自分の管理外の機器にコピーが存在することになります。ブラウザ内でレンダリングすれば、ページはファイルを開いた端末から一歩も出ません。
- オフラインで試す。スキャンツールを一度読み込んだら、インターネット接続を切ってファイルを変換してみてください。接続なしで動けば、何もアップロードされていないということです。
- アカウント不要。登録がないので、書類の履歴があなたの身元と結びつくこともありません。
- Chromeでも同じエンジン。Chrome ウェブストアで5つ星評価のChrome拡張機能は、まったく同じローカルエンジンをサイドパネルで動かします。
複数のPDFをまとめてスキャンPDFにするには?
複数のPDFをまとめてスキャンPDFにするには、pdflookscanned.com/scan/bulkの一括スキャンページを開き、すべてのファイルを追加して設定を1つ選び、全ファイルを1つのZIPアーカイブとしてダウンロードします。各ファイルは、同じ解像度、カラーモード、効果で、それぞれ独立したスキャンPDFになります。
- 一括スキャンを開く。pdflookscanned.com/scan/bulkにアクセスします(Chrome拡張機能では、複数のファイルを追加するだけです)。
- ファイルを追加する。PDFをドロップします。JPGやPNGなどが混在していても大丈夫で、画像はそれぞれ1ページのPDFになります。
- 共通の設定を選ぶ。解像度、カラーモード、効果のスライダーを一度設定すれば、すべてのファイルに適用されます。
- ZIPをダウンロードする。一括処理を実行してZIPをダウンロードしたら、いくつかのファイルを抜き取りで確認し、小さな文字が読めるかチェックします。
一括スキャンでは、ファイルは意図的に別々のまま処理され、1つの書類に結合されることはありません。1つにまとめたスキャンPDFが必要な場合は、先に元のPDFを結合してから(たとえばmacOSの「プレビュー」なら、あるPDFのページを別のPDFのサイドバーにドラッグします。Windowsなら、複数の書類をまとめて「Microsoft Print to PDF」で印刷します)、結合したファイルを一度に変換してください。
回転のばらつきが活きるのも一括処理です。ページごとにランダムでわずかに異なる傾きがつくので、長い書類全体が自然に見えます。
スキャンPDFになったかを確かめる方法は?
変換したファイルは、テキストを選択してみる、単語を検索してみる、いちばん小さい文字を拡大してみる、の3つで確認します。本物のスキャンPDFでは、選択できるのはページ全体の画像だけで、Ctrl+Fで単語は見つからず、200%に拡大してもきれいに読めます。ファイルサイズとページ数もあわせて確認しましょう。
クリーブランド州立大学のアクセシビリティガイドは、最も手早い確認方法をこう説明しています。「ページ上でその単語がハイライトされれば、そのファイルはテキストをスキャンした画像ではなく、検索可能なテキストを持っています。」正しく変換されていれば何もハイライトされず、カーソルをドラッグすると単語ではなくページ画像が選択されます。
PDFの画像化でうまくいかないときの対処法は?
PDFの画像化でよくあるトラブルは、ほとんどが4つの設定に起因します。解像度が低すぎる(文字がぼやける)、解像度やカラーが高すぎる(ファイルが巨大になる)、元のファイルがPDFではない(ページサイズが違う)、回転がオンのまま(ページが傾く)、の4つです。どれもツール内で直接直せます。以下に、最初に変えるべき設定とあわせて紹介します。
スキャンPDFの文字がぼやける・崩れる
解像度を2.5×または3×に上げ、ぼかしを0.1〜0.2に下げます。クリーンなフラット化なら0にします。細いグレーの文字がまだ薄い場合は、コントラストを1.2程度に上げてください。ぼかしとノイズはレンダリングのあとに適用されるため、1×では小さなぼかしの値でも9ポイントの文字が読めなくなることがあります。
スキャンPDFのファイルが巨大になる
文字中心の書類なら、カラーモードをグレーに切り替え、解像度を3×から2×、または1.5×に下げます。ノイズもファイルサイズに影響します。ランダムな斑点はJPEGで圧縮しにくいため、長い書類ではノイズを0.1以下にしておきましょう。非常に長いファイルは、分割して何回かに分けて変換してください。
スキャンPDFに変換したらページサイズが変わった
PDFのページは元のサイズとレイアウトを保ちます。出力が飾り気のないHelveticaの文字が並んだA4ページになっている場合、元のファイルはDOCX、スプレッドシート、TXT、HTMLのいずれかです。ツールはこれらをテキストとしてA4に組み直します。まず元のアプリでPDFに書き出し、そのPDFを変換してください。
ページが傾く・角が切れる
まっすぐなページにするには、回転と回転のばらつきを0にします。デフォルト(回転1°)はリアルさのための設定ですが、裁判所への提出書類や自動処理に回される申込書は、ふつうまっすぐにしておくべきです。傾きをつけたい場合は、角がページ内に収まるよう2°未満にとどめましょう。
署名やスタンプがギザギザになる
署名の線は細いので、解像度が低いと真っ先に劣化します。2.5×または3×を使い、ぼかしは0.3以下にしてください。追加設定でスタンプや署名の画像を配置する場合は、高解像度のPNGを使いましょう。配置してよいのは、使用する権限のある署名とスタンプだけです。
解像度の設定は、数値に嘘がないよう、PDF自体の72ポイントのグリッドを基準に作りました。2×は144dpi、3×は216dpiで、隠れた処理はありません。デフォルトをグレーの2×にしているのもそのためです。普通の本文には十分くっきりしていて、同じページをカラーでレンダリングするよりはるかに小さくなります。処理をすべてブラウザ内で完結させているのは、フラット化されるファイルこそ、多くの人がいちばんアップロードしたくないファイルだからです。Make PDF look scanned チーム(Webツール・Chrome拡張機能の開発チーム)
PDFの画像化・スキャンPDF変換のよくある質問
ここでは、PDFを画像化してスキャンPDFに変換したあとによく寄せられる質問にお答えします。隠れたテキストやメタデータはどうなるのか、元に戻せるのか、OCRはどう関わるのか、どの設定を選べばよいのか、スマホでも使えるのか、といった内容です。どの回答も、ツールが実際に行う処理に基づいています。
PDFをスキャンPDFに変換すると、隠れたテキストは消えますか?
はい、ページの内容からは消えます。新しいページはレンダラーが描画したもののJPEG画像なので、白い文字や黒塗りの下に隠れた文字も含め、コピーできるテキストレイヤーは残りません。ただし、これはあくまで副次的な効果と考え、墨消しが重要な場合は必ずプレビューで確認してください。
元のPDFのメタデータはどうなりますか?
ツールは新しいPDFを書き出し、そのタイトル、作成者、件名、キーワード、PDF変換ソフト、作成アプリケーションを追加設定のパネルで指定できるようにしています。ダウンロードする前に各項目を希望どおりに入力し、仕上がったファイルの文書のプロパティをPDFビューアーで確認してください。
スキャンPDFを編集可能なPDFに戻せますか?
完全には戻せません。元のテキストレイヤー、フォント、リンク、フォームフィールドは失われています。OCRで文字を認識して新しく検索可能なレイヤーを加えることはでき、そこから編集可能なテキストを再構成できるソフトもありますが、書式も精度も元どおりにはなりません。元のファイルは残しておきましょう。
スキャンPDFにあとからOCRをかけられますか?
はい。パソコン用のPDFソフトのOCR機能なら、出力されたファイルを通常のスキャンと同じように扱います。解像度が高くノイズが少ないほど認識精度が上がるので、OCRをかける予定があるなら、2×または3×でノイズを0に近づけてください。
「PDFのフラット化」と「PDFの画像化」の違いは?
狭い意味でのフラット化は、フォームフィールドや注釈をページに統合するだけで、テキストは選択できるまま残ることがあります。PDFの画像化(スキャンPDFへの変換)は、テキストも含めてページ全体を画像にします。後者のほうが強力で、このツールが行うのはこちらです。
PDFをスキャンPDFに変換するとき、解像度はどれを選べばいいですか?
普通の書類には2×(約144dpi)、細かい文字、情報量の多い表、署名がある場合は3×(約216dpi)を使います。1.5×に下げるのは、ファイルをかなり小さくする必要があり、文字が12ポイント以上のときだけにしましょう。
スキャンPDFが元のファイルよりずっと大きくなるのはなぜですか?
テキストPDFは文字をコンパクトな命令として保存しますが、スキャンPDFはすべてのページのすべてのピクセルを保存するからです。カラーではなくグレーにする、解像度を下げる、ノイズを減らす、のいずれもサイズの削減に効果があります。裁判所も同じ現象を報告しており、317ページのテストファイル1つが、カラーモードと解像度によって23.86MBから374.47MBまで変わりました。
スキャンPDFに変換したPDFは裁判所で受理されますか?
裁判所によります。主要書類にテキスト検索可能であることを義務づけている地区もあれば、望ましいとするだけの地区もあります。まず各地区のCM/ECFのルールを確認し、迷ったときは元のデジタルPDFを提出するか、スキャンPDFにOCRを加えてください。
PDFを画像化するツールはスマホでも使えますか?
はい。ウェブサイトはスマホのブラウザで動作し、ファイルをスマホ内でローカルに処理して、スキャンPDFを端末に保存します。大きな書類を3×で処理すると、スマホでは時間がかかりメモリも多く使うため、2×のほうが無難です。
PDFをスキャンPDFに変換するツールは無料ですか?
はい。WebツールもChrome拡張機能も無料で、登録は不要です。追加設定でご自身が透かしを加えない限り、透かしが入ることもありません。
今すぐPDFを画像化してスキャンPDFに
PDFを無料ツールにドロップし、解像度とグレースケールを選んで、画像だけのスキャンPDFをダウンロードしましょう。処理はすべてブラウザ内でローカルに行われます。