OCR de PDF

Extraia texto de um PDF escaneado usando reconhecimento óptico de caracteres.

Arraste um arquivo PDF ou clique para escolher um

Compatível com arquivos PDF

Exemplos de uso

Extrair texto de um documento de papel escaneado

Depois de escanear ou fotografar um documento de papel em PDF, reconheça o texto nele contido para poder copiá-lo e editá-lo.

Ler um PDF sem camada de texto

O OCR consegue extrair conteúdo de PDFs compostos só por imagens, que uma ferramenta comum de PDF para texto não consegue processar por não haver texto incorporado.

Reconhecer um documento em um idioma específico

Escolha o idioma correspondente, como inglês, coreano ou japonês, para melhorar a precisão do reconhecimento nesse documento.

Perguntas frequentes

Meu PDF enviado é transmitido a um servidor?

Não. Converter o PDF em imagens e reconhecer o texto acontecem inteiramente no seu navegador, e o PDF enviado ou seu conteúdo nunca são enviados a um servidor. A única exceção é que o arquivo do modelo de reconhecimento do idioma escolhido é baixado uma vez de uma CDN pública no primeiro uso — isso é apenas um arquivo de programa genérico, sem relação com o conteúdo do seu documento.

Posso usar em um PDF comum que já tem texto?

Pode, mas se o PDF já tiver uma camada de texto, nossa ferramenta PDF para texto será mais rápida e precisa. O OCR é indicado para PDFs compostos só por imagens, como documentos escaneados.

Qual a precisão do reconhecimento?

Depende da qualidade do escaneamento, da fonte e da nitidez. Documentos nítidos e de alta resolução são reconhecidos com mais precisão, enquanto letra manuscrita ou escaneamentos borrados podem ser reconhecidos com menos precisão.

Quanto tempo leva um PDF longo?

As páginas são reconhecidas uma de cada vez, então o tempo aumenta conforme o número de páginas. Você pode cancelar a qualquer momento durante o processamento se estiver demorando demais.