Gescanntes PDF vs. Text-PDF auf Android: Ein schneller, praktischer Test
Zwei Dateien können beide auf .pdf enden und sich auf einem Telefon völlig unterschiedlich verhalten. In einem wird jedes Wort als Text gespeichert. Im anderen Fall kann jede Seite nur ein Foto sein. Dieser Unterschied entscheidet darüber, ob die Textgröße an Ihren Bildschirm angepasst werden kann oder ob Sie die Originalseite anzeigen müssen. In diesem Leitfaden erfahren Sie, wie Sie die einzelnen Typen identifizieren, bevor Sie Zeit mit der Fehlerbehebung verbringen.
Kurz gesagt
Versuchen Sie, einen Satz auszuwählen oder nach einem Wort zu suchen, das Sie sehen können. Wenn beides funktioniert, verfügt die PDF-Datei wahrscheinlich über eine verwendbare Textebene. Wenn beides nicht funktioniert, handelt es sich möglicherweise um eine gescannte oder nur aus Bildern bestehende PDF-Datei. Verwenden Sie in Scroll+ Intelligente Extraktion für ein textbasiertes Dokument und Original (Akademisch) für Scans, Diagramme, Tabellen oder Seiten, deren genaues Layout wichtig ist. Die Extraktionsqualität variiert immer noch je nach Datei.
1. Was ist ein textbasiertes PDF?
Ein textbasiertes PDF speichert Buchstaben und Wörter als auswählbaren Inhalt. Möglicherweise wurde es aus einem Textverarbeitungsprogramm, einem Veröffentlichungstool oder einem digitalen Dokumentensystem exportiert. Unter Android können Sie häufig auf einen Satz drücken und ihn ziehen, ihn kopieren oder ihn mit der Suche finden. Dies sind nützliche Hinweise, kein perfekter Beweis: Berechtigungen, ungewöhnliche Schriftarten oder eine beschädigte Datei können die Auswahl immer noch blockieren.
Wenn die Textebene verwendbar ist, kann Scroll+ den Text auf Ihrem Gerät vorbereiten und ihn auf die Breite Ihres Telefons umbrechen. Dies ist der bessere Ausgangspunkt für Romane, Reportagen und andere meist lineare Dokumente. Lesen Sie PDF-Reflow im Vergleich zur Originalseitenansicht, bevor Sie einen Modus für ein Dokument mit komplexer Formatierung auswählen.
2. Was ist ein gescanntes oder reines Bild-PDF?
Ein gescanntes PDF enthält Bilder von Seiten. Sie können die gedruckten Wörter sehen, die Datei enthält diese Wörter jedoch möglicherweise nicht als maschinenlesbaren Text. Ein fotokopiertes Buch, eine fotografierte Quittung oder ein alter Archivscan funktionieren oft auf diese Weise. Wenn Sie das Bild schärfer machen, entsteht keine Textebene, und die normale Textextraktion kann das Bild nicht zuverlässig in Absätze umwandeln.
Scroll+ verspricht nicht, reine Bildseiten in Text umzuwandeln. Wenn bei der Extraktion fast keine Wörter entstehen, kann die App die geringe Textausbeute erkennen und das Buch in den Original (Akademisch)-Modus wechseln, anstatt eine leere Leseansicht zu hinterlassen. Die Originalseiten bleiben sichtbar, Sie müssen jedoch möglicherweise auf einem kleinen Bildschirm zoomen und schwenken.
3. Führen Sie diese drei Prüfungen auf Android durch
Drücken Sie zunächst lange auf einen klaren Satz und prüfen Sie, ob einzelne Wörter ausgewählt werden können. Zweitens suchen Sie nach einem eindeutigen Wort, das auf der Seite aufgedruckt ist. Drittens: Zoomen Sie genau hinein: Nur Bildtext wird oft sichtbar verpixelt, während digital gerenderter Text normalerweise scharf bleibt. Verwenden Sie mehr als einen Test, da ein gemischtes PDF sowohl echten Text als auch gescannte Seiten enthalten kann.
Sie können die Datei auch importieren und Scroll+ das praktische Ergebnis testen lassen. Befolgen Sie die Android PDF- und EPUB-Importanleitung. Die Verarbeitung erfolgt auf Ihrem Telefon, daher kann ein langes oder dichtes Dokument auf einem älteren Gerät oder einem Gerät mit weniger Speicher mehr Zeit in Anspruch nehmen.
4. Warum manche PDFs in der Mitte liegen
Nicht jedes Dokument passt zu einem Clean Label. Eine PDF-Datei kann ein digitales Inhaltsverzeichnis, gefolgt von gescannten Kapiteln, oder einen auswählbaren Textkörper mit als Bilder eingebetteten Diagrammen enthalten. Auch mehrspaltige Arbeiten, Fußnoten, mathematische Notation, ungewöhnliche Kodierungen und gedrehte Seiten können zu Texten in der falschen Reihenfolge führen. Ein erfolgreicher Auswahltest ist daher keine Garantie für ein perfektes Reflow.
Wählen Sie den Modus basierend auf dem, was Sie bewahren möchten. Wenn ein ununterbrochener Textkörper am wichtigsten ist, versuchen Sie es mit Intelligente Extraktion. Wenn Seitenzahlen, Abbildungen, Gleichungen oder räumliche Beziehungen eine Bedeutung haben, wählen Sie Original (Akademisch). Sie können das Quell-PDF behalten und Ihren Ansatz ändern, anstatt jedes Dokument in den gleichen Lesestil zu zwingen.
5. Was Scroll+ mit jedem Typ macht
Scroll+ speichert das PDF und führt die PDF-Verarbeitung auf Ihrem Gerät durch. Textbasierte Dateien können als umfließbare Leseinhalte aufbereitet werden. Gescannte Dateien oder Dateien mit wenig Text können auf die ursprüngliche Seitenansicht zurückgreifen. Buchdateien werden im Rahmen dieses Prozesses nicht hochgeladen und für das Lesen grundlegender Bücher ist kein Konto erforderlich.
Der Fallback für gescannte Dateien wurde in Scroll+ 0.9.0 verbessert; In den Versionshinweisen zu 0.9.0 wird die Erkennungs- und Hintergrundwarteschlange erläutert. Dieser Fallback schützt die Lesbarkeit, ist jedoch keine Garantie dafür, dass jede fehlerhafte, verschlüsselte oder ungewöhnlich große PDF-Datei erfolgreich geöffnet wird.
Wählen Sie den Modus, der zum Dokument passt
Ein Text-PDF ist normalerweise der bessere Kandidat für ein telefonfreundliches Leselayout. Ein gescanntes PDF ist in der Originalseitenansicht normalerweise sicherer. Testen Sie zunächst die Auswahl und Suche und überlegen Sie dann, ob Layout oder anpassbarer Text wichtiger sind. Diese einfache Entscheidung verhindert, dass die meisten Frustrationen dem PDF-Reader selbst zugeschrieben werden.
Probieren Sie beide PDF-Lesepfade in Scroll+ aus
Importieren Sie eine PDF-Datei von Ihrem Android-Gerät, wählen Sie Intelligente Extraktion oder Original (Akademisch) und behalten Sie die Buchdatei und die Bearbeitung auf Ihrem Telefon.
📱 Holen Sie sich Scroll+ bei Google Play