Texto e arquivos

OCR de Imagem

Extrair texto de fotos, scans e capturas de tela — em português, com o modelo baixado só na primeira vez. Sem upload: o OCR roda dentro do navegador.

  • sem upload
  • PT-BR
  • grátis

Quando OCR resolve — e quando não resolve

OCR (reconhecimento óptico de caracteres) é o caminho quando você tem uma imagem e precisa do texto dela em formato editável: foto de uma página de livro, scan de contrato, captura de tela de um documento, imagem de uma etiqueta com código. OROID copia o conteúdo visível e devolve texto solto — para edição, busca, tradução, anexação de e-mail.

Não é mágico, no entanto. Funciona bem em texto impresso, nítido, com bom contraste. Em manuscrito, foto tremida, baixa resolução, fundo ruidoso ou fonte decorativa, a precisão cai de 90% para 60% ou menos. Quanto mais próximo de preto-e-branco nítido, melhor o resultado — regra que o tesseract (a engine que usamos) segue desde sempre.

Por que “sem upload” muda tudo

Praticamente todo serviço de OCR online — CamScanner, Adobe Scan, FineScanner — envia a imagem para um servidor, processa, devolve. É a única forma de rodar um modelo de OCR pesado do lado deles. Aqui, usamos tesseract.js, que roda o mesmo tipo de OCR dentro do seu navegador, em web worker. O modelo treinado (~10 MB) é baixado em CDN público na primeira vez, depois cacheado no IndexedDB; nas próximas vezes, nenhuma chamada de rede.

Para um comprovante fiscal com endereço, um contrato com nome de terceiros, uma foto de um laudo médico, um documento sob NDA — nada disso sai da sua máquina.

Modelo de português: download só uma vez

O modelo treinado de OCR (‘traineddata’ do tesseract) tem cerca de 10 MB. Na primeira vez que você clicar em ‘Extrair texto’, o navegador baixa o modelo a partir de um CDN público (jsdelivr/unpkg) e cacheia no IndexedDB. Em subsequentes, mesmo em sessões diferentes da ferramenta, o modelo já está lá — nenhuma chamada de rede. Isso é importante em conexões móveis e mantém a ‘gratuidade’ honesta: não há ‘uso grátis limitado por servidor’, porque não há servidor.

Como melhorar a precisão

  • Resolução maior — uma foto de página A4 a 300 DPI gera OCR muito melhor que a mesma foto em 72 DPI. Se a origem é um PDF, converta via PDF para JPG em 300 DPI antes.
  • Contraste alto — texto preto sobre fundo branco. Fotos de página de livro com papel amarelado ainda funcionam, mas se a página está a meio caminho do cinza, o tesseract tropeça.
  • Alinhado — o OCR lida com rotação de até ~10° sem se perder; mais do que isso, gire a imagem antes.
  • Idioma certo — use ‘Português + Inglês’ em documentos mistos. O modelo combinado ocupa mais memória mas diminui os erros em palavras de outro idioma.

Por que o texto é só uma estimativa

Tesseract é hoje o motor open-source de OCR mais maduro. Google Lens, Apple Live Text e similares usam modelos proprietários treinados com bilhões de imagens — melhor qualidade, mas rodam na nuvem ou em chip de celular caro. O tesseract roda em qualquer navegador; o custo é precisão um pouco menor. A página é honesta sobre o trade-off: confiança média é mostrada por imagem, e o texto extraído é editável em textarea, pronto para você revisar antes de usar.

Antes de rir do resultado, releia: o tesseract copiou 90% do texto de uma foto de um PDF escaneado, sem um servidor, na sua máquina. Em 1995 isso era ficção científica.

## faq

Perguntas frequentes

A imagem é enviada para algum servidor?

Não. A imagem fica na sua máquina; o OCR roda em um web worker dentro do seu navegador. O modelo treinado de português (~10 MB) é baixado em CDN público na primeira vez e cacheado no IndexedDB do navegador — nas próximas vezes, não há download. Nenhum texto sai da sua máquina.

Qual a precisão do OCR?

Em texto impresso nítido e com bom contraste (uma foto de página de livro, um scan de contrato, uma captura de tela de documento), esperamos 85-92% de precisão — suficiente para localizar e reusar o texto. Em manuscrito, foto tremida, baixa resolução ou fundo com escolhas ruidosas, cai bastante. O OCR não é mágico: revise o texto extraído antes de confiar.

Quais idiomas são suportados?

Português (default), Inglês ou os dois juntos (Português + Inglês). O modelo combinado é útil em documentos mistos, como manuais bilingual, artigos acadêmicos ou capturas de interfaces em português com botões em inglês. O custo é um modelo maior (~20 MB no lugar de 10 MB).

Funciona em PDF?

Não diretamente — só em imagem (JPG, PNG, WebP). Para OCR de PDF, primeiro converta o PDF em imagens com a nossa ferramenta PDF para JPG, depois traga as imagens aqui. Esse caminho dá controle do DPI e de quais páginas processar, e mantém o OCR isolado em uma imagem por vez — melhor para memória.

Tem limite de tamanho ou quantidade?

Não há limite imposto, porque não há servidor. O teto é a memória do seu navegador. Para múltiplas imagens, o OCR é feito em série (uma de cada vez), em web worker — a UI continua responsiva enquanto extrai. Cada imagem de página A4 nítida costuma levar 5-10 segundos em desktop, 10-30 em celular.

Posso editar o texto extraído?

Sim — o texto aparece em um textarea abaixo da imagem, pronto para você copiar, baixar como .txt ou editar antes de usar. Esse é o fluxo recomendado: OCR extrai, você revisa.

OCR digitalizou caractere errado — tem como melhorar?

Em documentos com baixa resolução, aumentar o DPI da imagem de origem (via pdf-para-jpg em 300 DPI, ou reshoot com melhor iluminação) costuma resolver. O tesseract lida mal com fontes decorativas e texto de baixo contraste — quanto mais próximo do preto-e-branco nítido, melhor o resultado.

## outras ferramentas