Como OCR PDFs com PDNob - Guia do Usuário
O Reconhecimento Óptico de Caracteres (OCR) permite extrair texto editável de imagens ou PDFs digitalizados. Usando o PDNob PDF Editor, você pode rapidamente tornar PDFs pesquisáveis e editáveis. Este guia orienta você na instalação do recurso OCR e sua aplicação em seus documentos passo a passo.
1. Entendendo o OCR
OCR (Reconhecimento Óptico de Caracteres) é uma tecnologia que converte imagens digitalizadas ou PDFs baseados em imagens em texto editável e pesquisável. É especialmente útil para materiais impressos digitalizados e documentos escaneados, permitindo manipular conteúdos antes não editáveis.
2. Instalando o Recurso OCR
- Abra PDNob PDF Editor no seu computador.
- Na interface principal, clique no botão "OCR PDF" .
- Selecione os arquivos PDF do seu computador e clique em "Abrir" para importá-los para o PDNob PDF Editor.
- Se solicitado, clique no botão "Download" para instalar o módulo OCR.
3. Realizando OCR em PDFs
- Após a instalação, pressione o botão "OCR" na barra de ferramentas para iniciar o processamento.
- Na janela de configurações, selecione o modo OCR adequado às suas necessidades:
-
Converter para Texto Editável
Transforma o texto escaneado em conteúdo editável. Após o OCR, você pode editar, mover, copiar ou excluir o texto diretamente no PDF. -
Converter para Texto Pesquisável na Imagem
Mantém a imagem escaneada original intacta enquanto torna o texto pesquisável e selecionável, útil para indexação sem alterar o layout.
-
Converter para Texto Editável
- Clique em "Realizar OCR" para iniciar o reconhecimento.
- Quando o OCR for concluído, o texto se torna pesquisável e copiável. Escolher "Converter para Texto Editável" permite edição direta dentro do PDF.
4. Configurações Avançadas de OCR (Disponível no PDNob 2.0)
O PDNob 2.0 introduz Configurações Avançadas de OCR, melhorando a precisão do reconhecimento. Ativar esses recursos pode aumentar ligeiramente o tempo de processamento, mas melhora significativamente os resultados.
Acesse as opções avançadas abrindo o painel de configurações de OCR e clicando em Configurações Avançadas. Você pode ativar ou desativar várias opções de processamento de imagem e detecção de texto conforme necessário. Veja a captura de tela abaixo como referência.
Opções principais incluem:
- Corte Automático da Página – Detecta os limites do conteúdo e corta as margens para melhorar a precisão do OCR.
-
Alinhamento Automático da Página – Alinha páginas inclinadas horizontalmente, garantindo melhor reconhecimento do texto.
-
Melhorar Contraste Local – Aumenta o contraste em pequenas regiões para clarificar textos borrados, com mínima alteração de cor.
-
Remover Manchas Escuras – Limpa artefatos escuros menores para uma aparência de página mais clara.
-
Remover Ruído – Filtra pontos brancos e interferências visuais para melhorar a clareza do OCR.
-
Detectar Texto em Imagens – Extrai texto incorporado em imagens para cobertura completa do OCR.
5. OCR de Imagens
- Clique para escolher a imagem que deseja OCR, e clique em "Extrair Texto".
- Clique na caixa de texto reconhecida para selecionar o texto que deseja copiar, ou clique na opção "Selecionar Todo o Texto" para copiar todo o texto reconhecido da imagem.
- Então você pode colar o texto copiado no local desejado.