OCR PDF
Uma página digitalizada é uma imagem: o computador vê tinta, não palavras, e Ctrl+F não encontra nada. Esta ferramenta aplica o reconhecimento ótico de caracteres (OCR): lê os caracteres da imagem e acrescenta por cima uma camada de texto invisível, sem alterar o aspeto da digitalização. Útil para faturas arquivadas, um contrato assinado em papel ou páginas de livro fotografadas. São reconhecidos inglês, francês, espanhol, português e árabe. Os documentos digitalizados estão limitados a 10 páginas, pois cada página é analisada imagem a imagem.
Clique ou solte seu arquivo aqui
.pdf
Como funciona
1
Importar
Solte o seu PDF digitalizado
2
Reconhecer
Os caracteres são lidos
3
Baixar
Obtenha um PDF pesquisável
Funcionalidades
Sem alterações visuais
— a digitalização original é preservada pixel a pixel.Procura e cópia
— Ctrl+F funciona e o texto seleciona-se como em qualquer PDF.Documentos mistos
— as páginas que já têm texto ficam intactas.Cinco idiomas
— Inglês, francês, espanhol, português e árabe.Casos de uso comuns
Faturas em papel arquivadas como digitalizações, a procurar por fornecedor ou montante.
Um contrato assinado em papel e depois digitalizado, no qual precisa de encontrar uma cláusula.
Páginas de livro ou artigo fotografadas para estudo, para citar uma passagem sem a reescrever.
Antigos processos administrativos digitalizados em massa e impossíveis de consultar.
Documentos suportados
Any PDF whose pages are images: scanner output, photocopier output, or photos of paper turned into a PDF. Printed text gives excellent results. Handwriting is not reliably recognised. Scanned documents are limited to 10 pages per file; a PDF that already contains text can go up to 50.
Dicas para a melhor conversão
Digitalize a 300 ppp — abaixo de 200 ppp, os caracteres tornam-se difusos e os erros multiplicam-se.
Mantenha as páginas direitas: uma folha digitalizada torta perde precisão.
Prefira preto sobre branco liso a fundos coloridos ou texturados.
Defina o idioma do site para o do seu documento antes de enviar.
Os seus ficheiros são tratados com segurança
O seu ficheiro é processado com segurança nos nossos servidores e depois eliminado automaticamente logo após o processamento. Nunca é partilhado nem guardado.
Perguntas frequentes
Como sei se o meu PDF precisa de OCR?
Abra-o e tente selecionar uma linha com o rato, ou prima Ctrl+F e procure uma palavra visível no ecrã. Se nada for selecionável e a procura não encontrar nada, a página é uma imagem e precisa de OCR.
O documento manterá o mesmo aspeto?
Sim. A digitalização original permanece intacta e o texto reconhecido é acrescentado como camada invisível por cima. Visualmente nada muda: ganha apenas procura, seleção e cópia.
Que idiomas são reconhecidos?
Inglês, francês, espanhol, português e árabe. Defina o idioma do site para o do seu documento antes de enviar: a precisão depende muito disso.
Porque é que algumas palavras saem erradas?
A qualidade depende da digitalização. Páginas desfocadas, baixa resolução, folhas tortas, escrita à mão ou tipos de letra invulgares reduzem a precisão. Uma digitalização nítida a 300 ppp dá de longe os melhores resultados; uma foto tirada de lado e com pouca luz, os piores.
O que acontece às páginas que já têm texto?
Ficam tal como estão. Um documento pode misturar páginas digitalizadas e normais: só as páginas-imagem são processadas, pelo que nada de correto é reescrito.
Porquê o limite de 10 páginas para uma digitalização?
Cada página de uma digitalização é reconstruída como imagem antes de ser lida, o que demora cerca de oito segundos. Dez páginas mantêm a espera abaixo de minuto e meio e evitam que um único documento grande atrase o serviço para todos. Para uma digitalização mais longa, divida-a primeiro com a nossa ferramenta Dividir PDF.