OCR PDF
Reconheça o texto de documentos digitalizados.
Como usar o OCR PDF
O OCR lê as letras da imagem e devolve o texto, permitindo copiar e pesquisar o conteúdo de um documento digitalizado.
Envie o PDF digitalizado ou a imagem.
Acompanhe o reconhecimento página a página.
Baixe o texto reconhecido.
O que é OCR, na prática
OCR é o reconhecimento das letras dentro de uma imagem. Um documento digitalizado é uma foto: o computador vê pixels, não palavras. O OCR analisa a imagem e devolve o texto, permitindo copiar, pesquisar e editar o conteúdo.
O acerto depende da qualidade da imagem de origem: digitalização nítida e reta produz texto muito mais fiel do que foto tirada de lado ou com sombra.
O que melhora o resultado
Digitalização reta, com boa iluminação e a partir de 300 DPI, produz reconhecimento bem mais preciso. Foto tremida, tirada em ângulo ou com sombra atravessando a folha reduz muito o acerto.
Letra manuscrita tem acerto baixo: o OCR é feito para texto impresso. Fonte muito estilizada, papel amarelado e carimbo por cima do texto também prejudicam.
Documento longo leva alguns minutos. A tela mostra o progresso página por página, então dá para acompanhar o andamento.