OCR PDF

Adicione uma camada de texto real aos PDFs digitalizados para poder pesquisar, selecionar e copiar o texto. O reconhecimento é executado inteiramente no seu próprio dispositivo — o documento nunca sai dele.

  • Sem carregamentos
  • Funciona localmente
  • Sem registo

Dados de arquivos enviados nesta sessão: 0 B

Os seus ficheiros são processados localmente no seu navegador — nada é carregado.

Como aplicar OCR a um PDF

  1. Adicione o PDF digitalizado arrastando-o para a área de carregamento, ou clique para procurar (até 100 MB).
  2. Escolha uma qualidade de reconhecimento: Padrão (200 DPI) serve para a maioria dos documentos; Letra pequena (300 DPI) ajuda com texto pequeno; Rápida (150 DPI) é a mais veloz.
  3. Clique em “OCR PDF”. A primeira execução descarrega o motor de reconhecimento uma única vez; depois disso, arranca instantaneamente.
  4. Descarregue o PDF pesquisável — as mesmas páginas, agora com uma camada de texto real — ou obtenha apenas o texto extraído.

OCR a digitalizações confidenciais sem as enviar para lado nenhum

Os documentos digitalizados são muitas vezes dos mais sensíveis: contratos assinados, registos médicos, cópias de identificação, cartas antigas. A maioria dos serviços de OCR online obriga-o primeiro a carregá-los. O CoolPDF executa o motor de reconhecimento — Tesseract, compilado para WebAssembly — dentro do separador do seu navegador. O documento é lido e processado na sua própria máquina e nenhum byte atravessa a rede. Pode verificá-lo no painel de rede do navegador enquanto trabalha. E como não há nenhum servidor a fazer o trabalho, também não há quota de páginas nem limite diário: o seu dispositivo define o único limite.

Perguntas frequentes

Que idiomas consegue reconhecer?

Por agora, inglês (alfabeto latino). Os outros idiomas precisam dos seus próprios ficheiros de dados de treino, que não estão incluídos nesta versão — o suporte multilingue está planeado. Acentos e a pontuação europeia comum são tratados sem problema.

Funciona num PDF que já tem texto?

Destina-se a digitalizações e imagens sem camada de texto. Se o seu PDF já tiver texto selecionável, não precisa de OCR — a ferramenta PDF para Markdown consegue extrair o texto diretamente.

Porque é que a primeira execução demora mais?

A primeira execução descarrega o motor de OCR e os dados de idioma (cerca de 7 MB). Ambos ficam em cache no seu dispositivo, por isso as execuções seguintes arrancam instantaneamente — mesmo offline.

Os meus documentos são carregados para o OCR?

Não. O reconhecimento é executado inteiramente no seu navegador, no seu próprio processador. Nada é enviado para nenhum servidor — o contador de dados enviados acima permanece a zero enquanto trabalha.

Existem limites de uso?

Não. Todas as ferramentas são gratuitas e ilimitadas — sem limites diários, sem cotas e sem cadastro. O seu próprio dispositivo faz o trabalho, por isso não há custos de servidor para repassar. Para manter a estabilidade, cada ferramenta tem um generoso limite de tamanho por arquivo (50–150 MB, conforme a ferramenta), muito além do que documentos do dia a dia precisam.

O CoolPDF é um conjunto gratuito de ferramentas de PDF baseado no navegador. Ao contrário das ferramentas de PDF online tradicionais, o CoolPDF processa todos os ficheiros localmente no dispositivo do utilizador usando WebAssembly — os ficheiros nunca são enviados para nenhum servidor. As ferramentas não exigem conta, e-mail nem registo e são completamente grátis, sem limites de utilização. Isto torna o CoolPDF adequado para documentos confidenciais, como contratos, registos médicos e demonstrações financeiras.