OCR grátis no navegador
Faça OCR de um PDF digitalizado online grátis
Extraia texto de verdade, pronto para usar, de um PDF digitalizado ou feito de imagens. Use a ferramenta abaixo para rodar o OCR e baixe o texto reconhecido.
OCR no navegador
Abra um PDF digitalizado ou feito de imagens e reconheça o texto de cada página. O mecanismo de OCR é baixado e roda inteiramente no seu navegador, então a primeira vez pode demorar um pouco, e o OCR em si é mais lento que as outras ferramentas daqui.
Seus arquivos são tratados com segurança
✔ O processamento acontece no seu navegador
✔ Seu arquivo nunca é enviado para um servidor
✔ Seus arquivos não são armazenados nem salvos em lugar nenhum
✔ Sem conta e sem cadastro
Por que usar
Motivos comuns para usar OCR
Documentos digitalizados
Tire texto de verdade, pronto para usar, de um PDF feito de páginas digitalizadas ou fotos.
Papelada antiga
Transforme arquivos que só têm imagens em texto que você pode pesquisar, copiar e editar.
PDFs sem camada de texto
Recupere o conteúdo de PDFs em que Comprimir, Dividir e outras ferramentas de texto não encontram texto extraível.
Como funciona
Processo simples em 3 passos
1. Escolha seu PDF digitalizado
Escolha o PDF digitalizado ou feito de imagens que você quer ler.
2. Rode o OCR
Cada página é renderizada e um mecanismo de OCR que roda no navegador procura o texto.
3. Baixe o texto
Salve o texto reconhecido como arquivo .txt ou .docx.
Limites, com franqueza
OCR de verdade, com prós e contras de verdade
É reconhecimento de texto de verdade, não um atalho — por isso é mais lento e mais pesado que as outras ferramentas do site. Ele entrega o texto reconhecido em um arquivo .txt ou .docx, em vez de recriar um PDF pesquisável com uma camada de texto invisível posicionada. A qualidade depende da nitidez da digitalização e, por enquanto, ele só reconhece texto em inglês.
Guias relacionados
Por enquanto, nossos guias estão em inglês.
Perguntas frequentes
Perguntas sobre OCR em PDF
Por que o OCR é mais lento que as outras ferramentas?
O OCR roda um mecanismo real de reconhecimento de texto (Tesseract) inteiramente no seu navegador. No primeiro uso, o mecanismo é um download de vários megabytes, e reconhecer texto exige muito mais processamento do que as operações de arquivo de ferramentas como Comprimir ou Juntar.
Ele gera um PDF pesquisável ou só o texto?
Esta ferramenta extrai o texto reconhecido como arquivo .txt ou .docx. Ela não insere de volta no PDF uma camada de texto invisível e bem posicionada.
Quais idiomas são aceitos?
Por enquanto, esta ferramenta só reconhece texto em inglês.
Meu arquivo é enviado para um servidor?
Não. O OCR roda inteiramente no seu navegador, com um mecanismo de reconhecimento de texto em WebAssembly. Seu PDF nunca é enviado para um servidor, e nada fica armazenado.