[S] SCROLL+Leia. Ganhe. Evolua.
Google Play
Voltar ao Blog

PDF digitalizado vs. PDF com texto no Android: um teste rápido e prático

Dois ficheiros podem terminar em .pdf e comportar-se de formas completamente diferentes num telemóvel. Num deles, todas as palavras estão armazenadas como texto. No outro, cada página pode ser apenas uma fotografia. Essa diferença determina se o texto pode ser redimensionado para se ajustar ao ecrã ou se é necessário visualizar a página original. Este guia mostra como identificar cada tipo antes de perder tempo a tentar resolver problemas.

Resposta curta

Tente selecionar uma frase ou pesquisar uma palavra visível. Se uma destas ações funcionar, é provável que o PDF tenha uma camada de texto utilizável. Se nenhuma funcionar, pode ser um PDF digitalizado ou composto apenas por imagens. No Scroll+, use Smart Extract para um documento baseado em texto e Original (Academic) para digitalizações, diagramas, tabelas ou páginas cuja disposição exata seja importante. A qualidade da extração continua a variar conforme o ficheiro.

1. O que é um PDF baseado em texto?

Um PDF baseado em texto armazena letras e palavras como conteúdo selecionável. Pode ter sido exportado de um processador de texto, uma ferramenta de publicação ou um sistema de documentos digitais. No Android, muitas vezes é possível pressionar e arrastar sobre uma frase, copiá-la ou encontrá-la através da pesquisa. Estes são indícios úteis, mas não constituem uma prova definitiva: permissões, tipos de letra invulgares ou um ficheiro danificado também podem impedir a seleção.

Quando a camada de texto é utilizável, o Scroll+ pode preparar esse texto no dispositivo e ajustá-lo à largura do telemóvel. Este é o melhor ponto de partida para romances, relatórios e outros documentos predominantemente lineares. Leia refluxo de PDF vs. visualização da página original antes de escolher um modo para um documento com formatação complexa.

2. O que é um PDF digitalizado ou composto apenas por imagens?

Um PDF digitalizado contém imagens de páginas. É possível ver as palavras impressas, mas o ficheiro pode não conter essas palavras como texto legível por máquina. Um livro fotocopiado, um recibo fotografado ou uma digitalização de arquivo antiga funcionam muitas vezes desta forma. Tornar a imagem mais nítida não cria uma camada de texto, e a extração de texto convencional não consegue transformar essa imagem em parágrafos de forma fiável.

O Scroll+ não promete converter páginas compostas apenas por imagens em texto. Se a extração produzir pouquíssimas palavras, a aplicação pode identificar a baixa quantidade de texto e mudar o livro para o modo Original (Academic), em vez de deixar uma vista de leitura vazia. As páginas originais permanecem visíveis, mas pode ser necessário ampliar e deslocar a página num ecrã pequeno.

3. Faça estas três verificações no Android

Primeiro, mantenha pressionada uma frase bem legível e veja se é possível selecionar palavras individuais. Depois, pesquise uma palavra distinta impressa na página. Por fim, amplie bastante: o texto presente apenas numa imagem costuma ficar visivelmente pixelizado, enquanto o texto renderizado digitalmente geralmente permanece nítido. Use mais de um teste, pois um PDF misto pode conter tanto texto real como páginas digitalizadas.

Também pode importar o ficheiro e deixar que o Scroll+ teste o resultado prático. Siga o guia para importar PDF e EPUB no Android. O processamento ocorre no telemóvel, por isso um documento longo ou denso pode demorar mais num dispositivo antigo ou com menos memória.

4. Por que alguns PDFs ficam a meio caminho

Nem todos os documentos se enquadram perfeitamente numa única categoria. Um PDF pode ter um índice digital seguido de capítulos digitalizados, ou texto selecionável no corpo com gráficos incorporados como imagens. Artigos com várias colunas, notas de rodapé, notação matemática, codificações invulgares e páginas rodadas também podem gerar texto na ordem errada. Por isso, conseguir selecionar o texto não garante um refluxo perfeito.

Escolha o modo com base no que precisa de preservar. Se o mais importante for a continuidade do texto principal, experimente Smart Extract. Se números de página, figuras, equações ou relações espaciais transmitirem significado, escolha Original (Academic). Pode manter o PDF de origem e mudar de abordagem, em vez de forçar todos os documentos a seguir o mesmo estilo de leitura.

5. O que o Scroll+ faz com cada tipo

O Scroll+ armazena o PDF e realiza o respetivo processamento no dispositivo. Os ficheiros baseados em texto podem ser preparados como conteúdo de leitura reajustável. Os ficheiros digitalizados ou com pouco texto podem recorrer à visualização da página original. Os ficheiros dos livros não são enviados durante este processo, e a leitura essencial não requer uma conta.

O recurso à visualização original para ficheiros digitalizados foi melhorado no Scroll+ 0.9.0; o guia de importação de PDF e EPUB explica a deteção e a fila de processamento em segundo plano. Este recurso ajuda a preservar a legibilidade, mas não garante que todos os PDFs malformados, encriptados ou invulgarmente grandes sejam abertos com sucesso.

Escolha o modo adequado ao documento

Um PDF com texto costuma ser o melhor candidato para uma disposição de leitura adaptada ao telemóvel. Um PDF digitalizado costuma ser mais seguro na visualização da página original. Teste primeiro a seleção e a pesquisa e, depois, avalie se é mais importante preservar a disposição ou ajustar o texto. Esta decisão simples evita grande parte da frustração que muitas pessoas atribuem ao próprio leitor de PDF.

Experimente as duas formas de ler PDF no Scroll+

Importe um PDF do seu dispositivo Android, escolha Smart Extract ou Original (Academic) e mantenha o ficheiro do livro e o processamento no telemóvel.

📱 Obter o Scroll+ no Google Play