OCR de PDF: criar PDF pesquisável
OCR de PDF: adicione texto selecionável em português, inglês, espanhol ou russo a um relatório digitalizado de até 10 páginas e 10 MiB. Seus arquivos ficam no seu navegador.
Arquivos de reconhecimento ≈ 26 MB no primeiro uso, mais os dados de idioma.
Texto reconhecido
Esta ferramenta foi útil?
Testar com um exemplo
Baixar exemploDeixe o idioma Português selecionado. Baixe o PDF e pesquise por FATURA, 148,50, João, ENTREGA e 2048. As duas páginas devem ficar iguais ao exemplo, com texto que você pode selecionar e copiar; acentos e cedilha são preservados.
O que esperar
Cada página é reconhecida como imagem, em ordem. Estão disponíveis o reconhecimento em inglês, em russo e misto. O OCR pode ler letras, números, colunas e tabelas de forma errada: revise o resultado. Isso cria um novo PDF a partir de imagens das páginas renderizadas e de uma camada de texto invisível. O tamanho visível da página e a rotação são mantidos; formulários, links, marcadores, anexos e assinaturas digitais não são mantidos. O texto existente é reconhecido de novo; a qualidade da imagem é limitada pela resolução de renderização.
As páginas são renderizadas com até 4 megapixels cada. O carregamento e cada etapa de processamento podem levar até 90 segundos; o trabalho inteiro é interrompido após 10 minutos. Páginas em branco são marcadas no texto. Nenhum download é oferecido se o processamento falhar ou se nenhum texto for reconhecido.
PDF protegido?Desbloqueie-o primeiro com a senha dele.
Na primeira execução, os arquivos do conversor podem ser baixados e isso pode levar um momento. Se falhar, verifique sua conexão ou tente um arquivo menor. “Cancelar” interrompe o processamento em andamento; você pode selecionar outro arquivo e tentar novamente.
Licenças e código-fonte dos motores
Um guia prático
Busque e cite o texto da digitalização.
- Escolha o relatório digitalizado, com até 10 páginas e 10 MiB.
- Selecione português, inglês, espanhol ou russo para o reconhecimento.
- Busque um título no resultado para confirmar a camada de texto.
Teste este exemplo
Reconheça em português o resumo digitalizado de uma reunião de 4 páginas; a busca por um título de decisão na página 3 deve encontrá-lo no PDF resultante.
Antes de começar: O reconhecimento cobre apenas português, inglês, espanhol e russo, dentro de 10 páginas e 10 MiB; digitalizações de baixa resolução podem gerar erros de reconhecimento.