[S] SCROLL+Читайте. Зарабатывайте. Развивайтесь.
Google Play
Назад к блогу

Сканированный PDF или текстовый PDF на Android: быстрый практический тест

Два файла могут заканчиваться на .pdf и вести себя на телефоне совершенно по-разному. В одном каждое слово сохраняется в виде текста. В другом случае на каждой странице может быть только фотография. Эта разница определяет, можно ли изменить размер текста в соответствии с вашим экраном или вам нужно просмотреть исходную страницу. В этом руководстве показано, как идентифицировать каждый тип, прежде чем тратить время на устранение неполадок.

Краткий ответ

Попробуйте выбрать одно предложение или найти слово, которое видите. Если что-то работает, PDF-файл, вероятно, имеет полезный текстовый слой. Если ни один из них не работает, возможно, это отсканированный PDF-файл или PDF-файл, содержащий только изображения. В Scroll+ используйте Умное извлечение для текстового документа и Оригинал (Академический) для сканирований, диаграмм, таблиц или страницы, точная компоновка которых имеет значение. Качество извлечения по-прежнему зависит от файла.

1. Что такое текстовый PDF-файл?

Текстовый PDF-файл хранит буквы и слова в виде выбираемого содержимого. Возможно, он был экспортирован из текстового процессора, издательского инструмента или системы цифровых документов. На Android вы часто можете нажать и перетащить предложение, скопировать его или найти с помощью поиска. Это полезные подсказки, а не идеальное доказательство: разрешения, необычные шрифты или поврежденный файл все равно могут блокировать выбор.

Когда текстовый слой станет доступен для использования, Scroll+ может подготовить этот текст на вашем устройстве и обернуть его по ширине вашего телефона. Это лучшая отправная точка для романов, отчетов и других, в основном линейных документов. Прочтите Перекомпоновка PDF в сравнении с исходным видом страницы, прежде чем выбирать режим для документа со сложным форматированием.

2. Что такое отсканированный PDF-файл или PDF-файл, содержащий только изображения?

Отсканированный PDF-файл содержит изображения страниц. Вы можете видеть напечатанные слова, но файл может не содержать этих слов в виде машиночитаемого текста. Ксерокопия книги, сфотографированная квитанция или сканирование старого архива часто работают таким образом. Увеличение резкости изображения не приводит к созданию текстового слоя, а обычное извлечение текста не может надежно превратить это изображение в абзацы.

Scroll+ не обещает конвертировать страницы, содержащие только изображения, в текст. Если при извлечении почти нет слов, приложение может определить низкий выход текста и переключить книгу в режим Оригинал (Академический) вместо того, чтобы оставлять пустое окно чтения. Исходные страницы остаются видимыми, но на маленьком экране может потребоваться масштабирование и панорамирование.

3. Запустите эти три проверки на Android.

Сначала нажмите и удерживайте четкое предложение и посмотрите, можно ли выделить отдельные слова. Во-вторых, найдите отличительное слово, напечатанное на странице. В-третьих, увеличьте масштаб: текст, содержащий только изображение, часто становится заметно пикселизированным, в то время как текст, отображаемый в цифровой форме, обычно остается четким. Используйте несколько тестов, поскольку смешанный PDF-файл может содержать как реальный текст, так и отсканированные страницы.

Вы также можете импортировать файл и позволить Scroll+ проверить практический результат. Следуйте руководству по импорту PDF и EPUB для Android. Обработка происходит на вашем телефоне, поэтому длинный или плотный документ может занять больше времени на старом устройстве или устройстве с меньшим объемом памяти.

4. Почему некоторые PDF сочетают оба типа

Не каждый документ соответствует «чистой этикетке». PDF-файл может содержать цифровое оглавление, за которым следуют отсканированные главы, или выбираемый основной текст с диаграммами, встроенными в виде изображений. Статьи с несколькими колонками, сноски, математические обозначения, необычные кодировки и повернутые страницы также могут создавать текст в неправильном порядке. Таким образом, успешный отборочный тест не гарантирует идеального оплавления.

Выберите режим в зависимости от того, что вам необходимо сохранить. Если важнее всего непрерывный основной текст, попробуйте Умное извлечение. Если номера страниц, рисунки, уравнения или пространственные отношения имеют значение, выберите Оригинал (Академический). Вы можете сохранить исходный PDF-файл и изменить свой подход, вместо того, чтобы заставлять каждый документ использовать один и тот же стиль чтения.

5. Что делает Scroll+ с каждым типом

Scroll+ сохраняет PDF-файл и выполняет его обработку на вашем устройстве. Текстовые файлы могут быть подготовлены как перекомпонуемый контент для чтения. Отсканированные файлы или файлы с небольшим количеством текста могут вернуться к исходному виду страницы. Файлы книг не загружаются в рамках этого процесса, и для основного чтения не требуется учетная запись.

Резервный вариант отсканированного файла был улучшен в Scroll+ 0.9.0; в примечаниях к выпуску 0.9.0 объясняются обнаружение и фоновая очередь. Этот запасной вариант защищает читаемость, но не является гарантией того, что каждый некорректный, зашифрованный или необычно большой PDF-файл будет успешно открыт.

Выберите режим, соответствующий документу

Текстовый PDF-файл обычно является лучшим кандидатом для удобного для чтения на телефоне макета. Отсканированный PDF-файл обычно безопаснее в исходном виде. Сначала проверьте выбор и поиск, а затем решите, что важнее: макет или настраиваемый текст. Это простое решение предотвращает большую часть разочарований, в которых люди обвиняют саму программу чтения PDF-файлов.

Попробуйте оба пути чтения PDF в Scroll+

Импортируйте PDF-файл со своего устройства Android, выберите Умное извлечение или Оригинал (Академический) и сохраните файл книги и его обработку на своем телефоне.

📱 Получите Scroll+ в Google Play