Guias e tutoriais

Por que você não consegue selecionar o texto de um PDF

Você tenta selecionar uma palavra e acaba desenhando um retângulo. Não é o seu leitor de PDF com defeito: o documento simplesmente não contém texto. Veja como confirmar e como resolver.

1. Por que o texto não pode ser selecionado

Na imensa maioria dos casos há um único motivo: aquele PDF não contém texto, mas a fotografia de uma página.

É o que acontece quando um documento em papel passa por um scanner ou é fotografado com o celular. O arquivo resultante tem a extensão .pdf e abre como um PDF, mas dentro há uma imagem por página. As palavras que você lê sem dificuldade são, para um computador, apenas luz e sombra: não existem como caracteres, então não podem ser selecionadas, pesquisadas nem copiadas.

O mesmo vale para faxes, recibos digitalizados há anos e documentos produzidos por sistemas antigos que imprimem em imagem.

🔒
A solução é o reconhecimento óptico de caracteres. Com o 123 PDF Editor PRO ele roda localmente no navegador: o documento — muitas vezes um contrato ou um laudo médico — não é enviado a nenhum serviço externo.

🔍 2. Verificar em dois segundos

Antes de procurar soluções, vale ter certeza de que esse é mesmo o problema.

  1. Abra o PDF com qualquer leitor e tente arrastar o cursor sobre uma palavra.
  2. Se a palavra se destaca, o documento contém texto: o problema está em outro lugar (veja o ponto 6).
  3. Se, em vez disso, você desenha um retângulo de seleção como faria sobre uma imagem, você tem uma digitalização.
  4. Confira também: use a busca do leitor e procure uma palavra que você vê claramente na página. Se não for encontrada, o texto não está lá.

3. Tornar o texto selectável

O reconhecimento adiciona texto por cima da imagem: a aparência da página permanece idêntica, mas o conteúdo se torna utilizável.

O editor detecta páginas digitalizadas e oferece o OCR
Páginas sem texto selectável são detectadas automaticamente.
  1. Instale a extensão pela página de download e abra o arquivo com Escolher um PDF.
  2. Se a janela Páginas digitalizadas detectadas aparecer, prossiga a partir dela; caso contrário, abra o OCR local.
  3. Defina o idioma do documento, ou deixe Automático se não tiver certeza.
  4. Clique em Executar OCR local e aguarde o processamento terminar.
  5. Agora tente selecionar uma palavra: o texto responde como em qualquer outro PDF.
O texto fica selectável após o reconhecimento
Depois do OCR a página fica selectável, pesquisável e editável.

📋 4. Selecionar, copiar, pesquisar

Uma vez reconhecido o texto, todas as operações que estavam falhando voltam a ficar disponíveis.

  • Copiar e colar um parágrafo em outro documento.
  • Pesquisar uma palavra no arquivo inteiro, útil em documentos longos.
  • Destacar os trechos importantes, como explicado no guia sobre como destacar um PDF.
  • Editar o texto do jeito certo: veja o guia sobre como editar texto.
  • Arquivar o documento como um arquivo pesquisável, para encontrá-lo buscando por uma palavra em vez de lembrar o nome do arquivo.

5. Se o reconhecimento erra algo

Nenhum OCR é infalível, e a qualidade do resultado depende quase inteiramente da digitalização original.

  • Defina o idioma certo em vez de deixar a opção automática: reduz muito os erros em letras acentuadas.
  • Endireite páginas tortas antes do reconhecimento, usando a rotação no painel de páginas.
  • Confira a resolução: abaixo de 200 DPI os erros se multiplicam, 300 DPI é a referência usual para texto.
  • Revise números e códigos: um zero lido como a letra O passa fácil.
  • Escrita à mão permanece fora de alcance: o OCR lê caracteres impressos.
💡
Se a digitalização está muito desbotada, muitas vezes é melhor refazê-la com melhores configurações do que insistir no reconhecimento: nenhum software recupera o que não está na imagem.

6. Quando, em vez disso, o PDF está protegido

Há um segundo motivo, menos frequente, para a seleção não funcionar.

Alguns PDFs contêm sim texto de verdade, mas carregam restrições que proíbem a cópia: são as permissões definidas por quem criou o documento. Nesse caso o texto se destaca, mas copiar e colar não produz nada, ou o leitor avisa explicitamente que a operação não é permitida.

Essa é uma escolha de quem produziu o arquivo, e deve ser respeitada. Se você é o autor do documento, pode revisar as configurações seguindo o guia sobre como proteger um PDF, em que a seção Ações permitidas governa a cópia de texto.

? 7. Perguntas frequentes

As dúvidas que mais aparecem sobre este tema.

O OCR muda a aparência do documento?

Não: a imagem original permanece no lugar e o texto reconhecido é sobreposto de forma invisível. A página fica exatamente como antes, mas agora é selectável.

Preciso de conexão com a internet?

Não. O motor de reconhecimento vem junto com a extensão e funciona no seu computador: o OCR roda completamente offline.

Quais idiomas são reconhecidos?

São incluídos 10 idiomas, todos disponíveis offline, além da opção automática que carrega todos. Os detalhes estão no guia sobre OCR.

O documento é enviado online para o reconhecimento?

Nunca. É justamente essa a diferença em relação aos serviços de OCR online, em que o arquivo — muitas vezes um documento pessoal — é enviado a uma infraestrutura de terceiros.

Deixe o seu documento selectável

Instale a extensão, abra a digitalização e execute o reconhecimento — sem enviar o arquivo online.