Android 上のスキャン PDF とテキスト PDF: 簡単で実用的なテスト
2 つのファイルはどちらも .pdf で終わり、携帯電話ではまったく異なる動作をする場合があります。 1 つでは、すべての単語がテキストとして保存されます。また、各ページが写真だけの場合もあります。この違いにより、画面に合わせてテキストのサイズを変更できるかどうか、または元のページを表示する必要があるかどうかが決まります。このガイドでは、トラブルシューティングに時間を費やす前に、各タイプを識別する方法を説明します。
短い答え
一文を選択するか、目についた単語を検索してみてください。どちらかが機能する場合は、PDF に使用可能なテキスト レイヤーがある可能性があります。どちらも機能しない場合は、スキャンされた PDF または画像のみの PDF である可能性があります。 Scroll+ では、テキストベースのドキュメントには スマート抽出 を使用し、スキャン、図、表、またはページには オリジナル(学術) を使用します。正確なレイアウトが重要です。抽出品質はファイルによって異なります。
1. テキストベースの PDF とは何ですか?
テキストベースの PDF には、選択可能なコンテンツとして文字と単語が保存されます。ワード プロセッサ、出版ツール、またはデジタル ドキュメント システムからエクスポートされた可能性があります。 Android では、文章を押してドラッグしたり、コピーしたり、検索で見つけたりすることがよくあります。これらは有益な手がかりであり、完全な証拠ではありません。アクセス許可、異常なフォント、または破損したファイルが選択をブロックする可能性があります。
テキスト レイヤーが使用可能な場合、Scroll+ はデバイス上でそのテキストを準備し、携帯電話の幅に合わせて折り返すことができます。これは、小説、レポート、その他のほとんど直線的な文書の出発点として適しています。複雑な書式設定を持つドキュメントのモードを選択する前に、PDF リフローと元のページ ビューをお読みください。
2. スキャンされた PDF または画像のみの PDF とは何ですか?
スキャンされた PDF にはページの写真が含まれています。印刷された単語は表示されますが、ファイルにはそれらの単語が機械可読テキストとして含まれていない可能性があります。コピーした本、写真を撮ったレシート、または古いアーカイブのスキャンは、多くの場合この方法で機能します。画像を鮮明にしてもテキスト レイヤーは作成されず、通常のテキスト抽出ではその画像を確実に段落に変換することはできません。
Scroll+ は、画像のみのページをテキストに変換することを約束するものではありません。抽出によって単語がほとんど生成されない場合、アプリはテキスト生成量が低いことを特定し、空の読書ビューのままにするのではなく、書籍を オリジナル(学術) モードに切り替えることができます。元のページは表示されたままですが、小さな画面ではズームやパンが必要になる場合があります。
3. Android で次の 3 つのチェックを実行します。
まず、明確な文を長押しして、個々の単語が選択できるかどうかを確認します。次に、ページに印刷されている特徴的な単語を検索します。 3 番目に、ズームインします。画像のみのテキストは多くの場合、目に見えてピクセル化されますが、デジタルでレンダリングされたテキストは通常鮮明なままです。混合 PDF には実際のテキストとスキャンされたページの両方が含まれる可能性があるため、複数のテストを使用します。
ファイルをインポートして、Scroll+ で実際の結果をテストすることもできます。 Android PDF および EPUB インポート ガイド に従ってください。処理は携帯電話で行われるため、長い文書や密度の高い文書は、古いデバイスやメモリの少ないデバイスでは時間がかかる可能性があります。
4. 一部の PDF が真ん中に位置する理由
すべての文書がきれいなラベルに適合するわけではありません。 PDF には、デジタル目次とその後にスキャンされた章が含まれる場合や、画像として埋め込まれた図表を含む選択可能な本文テキストが含まれる場合があります。複数段組みの論文、脚注、数学的記法、特殊なエンコーディング、回転されたページによっても、テキストが間違った順序で生成される可能性があります。したがって、選択テストが成功しても、完全なリフローが保証されるわけではありません。
何を保存する必要があるかに基づいてモードを選択してください。中断されない本文テキストが最も重要な場合は、スマート抽出 を試してください。ページ番号、図、方程式、または空間関係に意味がある場合は、オリジナル(学術) を選択します。すべてのドキュメントを同じ読み方に強制するのではなく、ソース PDF を保持してアプローチを変更することができます。
5. Scroll+ が各タイプで行うこと
Scroll+ は PDF を保存し、デバイス上で PDF 処理を実行します。テキストベースのファイルは、リフロー可能な読み物コンテンツとして準備できます。スキャンされたファイルまたはローテキスト ファイルは、元のページ ビューにフォールバックできます。このプロセスの一部として書籍ファイルはアップロードされず、主要な読書にはアカウントは必要ありません。
スキャンされたファイルのフォールバックは Scroll+ 0.9.0 で改善されました。 0.9.0 リリース ノート では、検出とバックグラウンド キューについて説明しています。このフォールバックにより可読性は保護されますが、不正な PDF、暗号化された PDF、または異常に大きい PDF がすべて正常に開くという保証はありません。
原稿に合わせたモードを選ぶ
通常、テキスト PDF は、電話で読みやすいレイアウトとしてはより適切な候補です。通常、スキャンされた PDF は、元のページ ビューで表示した方が安全です。まず選択と検索をテストしてから、レイアウトと調整可能なテキストのどちらが重要かを検討してください。この単純な決定により、人々が PDF リーダー自体のせいにするフラストレーションのほとんどを防ぐことができます。
Scroll+ で両方の PDF 読み取りパスを試してください
Android デバイスから PDF をインポートし、スマート抽出 または オリジナル(学術) を選択し、書籍ファイルと処理を携帯電話に保存します。
📱 Google Play で Scroll+ を入手