Logotipo da PDFAreUsPDFAreUs

OCR grátis no navegador

Faça OCR de um PDF digitalizado online grátis

Extraia texto de verdade, pronto para usar, de um PDF digitalizado ou feito de imagens. Use a ferramenta abaixo para rodar o OCR e baixe o texto reconhecido.

OCR no navegador

Abra um PDF digitalizado ou feito de imagens e reconheça o texto de cada página. O mecanismo de OCR é baixado e roda inteiramente no seu navegador, então a primeira vez pode demorar um pouco, e o OCR em si é mais lento que as outras ferramentas daqui.

Seus arquivos são tratados com segurança

✔ O processamento acontece no seu navegador

✔ Seu arquivo nunca é enviado para um servidor

✔ Seus arquivos não são armazenados nem salvos em lugar nenhum

✔ Sem conta e sem cadastro

Saiba mais sobre como cuidamos da segurança →

Por que usar

Motivos comuns para usar OCR

Documentos digitalizados

Tire texto de verdade, pronto para usar, de um PDF feito de páginas digitalizadas ou fotos.

Papelada antiga

Transforme arquivos que só têm imagens em texto que você pode pesquisar, copiar e editar.

PDFs sem camada de texto

Recupere o conteúdo de PDFs em que Comprimir, Dividir e outras ferramentas de texto não encontram texto extraível.

Como funciona

Processo simples em 3 passos

1. Escolha seu PDF digitalizado

Escolha o PDF digitalizado ou feito de imagens que você quer ler.

2. Rode o OCR

Cada página é renderizada e um mecanismo de OCR que roda no navegador procura o texto.

3. Baixe o texto

Salve o texto reconhecido como arquivo .txt ou .docx.

Limites, com franqueza

OCR de verdade, com prós e contras de verdade

É reconhecimento de texto de verdade, não um atalho — por isso é mais lento e mais pesado que as outras ferramentas do site. Ele entrega o texto reconhecido em um arquivo .txt ou .docx, em vez de recriar um PDF pesquisável com uma camada de texto invisível posicionada. A qualidade depende da nitidez da digitalização e, por enquanto, ele só reconhece texto em inglês.

Perguntas frequentes

Perguntas sobre OCR em PDF

Por que o OCR é mais lento que as outras ferramentas?

O OCR roda um mecanismo real de reconhecimento de texto (Tesseract) inteiramente no seu navegador. No primeiro uso, o mecanismo é um download de vários megabytes, e reconhecer texto exige muito mais processamento do que as operações de arquivo de ferramentas como Comprimir ou Juntar.

Ele gera um PDF pesquisável ou só o texto?

Esta ferramenta extrai o texto reconhecido como arquivo .txt ou .docx. Ela não insere de volta no PDF uma camada de texto invisível e bem posicionada.

Quais idiomas são aceitos?

Por enquanto, esta ferramenta só reconhece texto em inglês.

Meu arquivo é enviado para um servidor?

Não. O OCR roda inteiramente no seu navegador, com um mecanismo de reconhecimento de texto em WebAssembly. Seu PDF nunca é enviado para um servidor, e nada fica armazenado.

Por enquanto, nossos guias estão em inglês.

Ver todos os guias PDF →