OCR PDF: leia scans e baixe um PDF pesquisável (imagem de cada página + texto invisível). Também copia e exporta .txt.
No celular: prefira PDFs com poucas páginas. OCR de várias páginas escaneadas pode demorar e usar muita memória.
PDF → Texto (OCR)
PDF digital vs escaneado
- Digital - o texto já está no arquivo; extração é rápida e fiel
- Escaneado - cada página é uma imagem; o OCR “lê” os pixels (pode errar em rascunhos ou fotos tortas)
O PDF sobe para o servidor?
Não. pdf.js, Tesseract e pdf-lib rodam no navegador. Só a biblioteca de idioma do OCR vem da CDN na primeira vez.
O que é PDF pesquisável?
Cada página vira imagem + texto invisível alinhado. Você busca e copia no leitor, mas continua vendo o scan.
Por que limitar páginas no OCR?
Renderizar + OCR é pesado na CPU e na memória. Para livros longos, processe em partes ou use o modo “só texto embutido” se o PDF for digital.
Qual a diferença para “PDF para texto”?
PDF para texto só lê texto embutido. Esta página adiciona OCR e exporta PDF pesquisável.
Funciona no celular?
Sim, com PDFs curtos. Em aparelhos antigos, prefira poucas páginas e boa iluminação no scan original.









