$ ocr --extrair --por
Texto e arquivosOCR de Imagem
Extrair texto de fotos, scans e capturas de tela — em português, com o modelo baixado só na primeira vez. Sem upload: o OCR roda dentro do navegador.
- sem upload
- PT-BR
- grátis
Quando OCR resolve — e quando não resolve
OCR (reconhecimento óptico de caracteres) é o caminho quando você tem uma imagem e precisa do texto dela em formato editável: foto de uma página de livro, scan de contrato, captura de tela de um documento, imagem de uma etiqueta com código. OROID copia o conteúdo visível e devolve texto solto — para edição, busca, tradução, anexação de e-mail.
Não é mágico, no entanto. Funciona bem em texto impresso, nítido, com bom contraste. Em manuscrito, foto tremida, baixa resolução, fundo ruidoso ou fonte decorativa, a precisão cai de 90% para 60% ou menos. Quanto mais próximo de preto-e-branco nítido, melhor o resultado — regra que o tesseract (a engine que usamos) segue desde sempre.
Por que “sem upload” muda tudo
Praticamente todo serviço de OCR online — CamScanner, Adobe Scan, FineScanner — envia a imagem para um servidor, processa, devolve. É a única forma de rodar um modelo de OCR pesado do lado deles. Aqui, usamos tesseract.js, que roda o mesmo tipo de OCR dentro do seu navegador, em web worker. O modelo treinado (~10 MB) é baixado em CDN público na primeira vez, depois cacheado no IndexedDB; nas próximas vezes, nenhuma chamada de rede.
Para um comprovante fiscal com endereço, um contrato com nome de terceiros, uma foto de um laudo médico, um documento sob NDA — nada disso sai da sua máquina.
Modelo de português: download só uma vez
O modelo treinado de OCR (‘traineddata’ do tesseract) tem cerca de 10 MB. Na primeira vez que você clicar em ‘Extrair texto’, o navegador baixa o modelo a partir de um CDN público (jsdelivr/unpkg) e cacheia no IndexedDB. Em subsequentes, mesmo em sessões diferentes da ferramenta, o modelo já está lá — nenhuma chamada de rede. Isso é importante em conexões móveis e mantém a ‘gratuidade’ honesta: não há ‘uso grátis limitado por servidor’, porque não há servidor.
Como melhorar a precisão
- Resolução maior — uma foto de página A4 a 300 DPI gera OCR muito melhor que a mesma foto em 72 DPI. Se a origem é um PDF, converta via PDF para JPG em 300 DPI antes.
- Contraste alto — texto preto sobre fundo branco. Fotos de página de livro com papel amarelado ainda funcionam, mas se a página está a meio caminho do cinza, o tesseract tropeça.
- Alinhado — o OCR lida com rotação de até ~10° sem se perder; mais do que isso, gire a imagem antes.
- Idioma certo — use ‘Português + Inglês’ em documentos mistos. O modelo combinado ocupa mais memória mas diminui os erros em palavras de outro idioma.
Por que o texto é só uma estimativa
Tesseract é hoje o motor open-source de OCR mais maduro. Google Lens, Apple Live Text e similares usam modelos proprietários treinados com bilhões de imagens — melhor qualidade, mas rodam na nuvem ou em chip de celular caro. O tesseract roda em qualquer navegador; o custo é precisão um pouco menor. A página é honesta sobre o trade-off: confiança média é mostrada por imagem, e o texto extraído é editável em textarea, pronto para você revisar antes de usar.
Antes de rir do resultado, releia: o tesseract copiou 90% do texto de uma foto de um PDF escaneado, sem um servidor, na sua máquina. Em 1995 isso era ficção científica.
## faq
Perguntas frequentes
A imagem é enviada para algum servidor?
Não. A imagem fica na sua máquina; o OCR roda em um web worker dentro do seu navegador. O modelo treinado de português (~10 MB) é baixado em CDN público na primeira vez e cacheado no IndexedDB do navegador — nas próximas vezes, não há download. Nenhum texto sai da sua máquina.
Qual a precisão do OCR?
Em texto impresso nítido e com bom contraste (uma foto de página de livro, um scan de contrato, uma captura de tela de documento), esperamos 85-92% de precisão — suficiente para localizar e reusar o texto. Em manuscrito, foto tremida, baixa resolução ou fundo com escolhas ruidosas, cai bastante. O OCR não é mágico: revise o texto extraído antes de confiar.
Quais idiomas são suportados?
Português (default), Inglês ou os dois juntos (Português + Inglês). O modelo combinado é útil em documentos mistos, como manuais bilingual, artigos acadêmicos ou capturas de interfaces em português com botões em inglês. O custo é um modelo maior (~20 MB no lugar de 10 MB).
Funciona em PDF?
Não diretamente — só em imagem (JPG, PNG, WebP). Para OCR de PDF, primeiro converta o PDF em imagens com a nossa ferramenta PDF para JPG, depois traga as imagens aqui. Esse caminho dá controle do DPI e de quais páginas processar, e mantém o OCR isolado em uma imagem por vez — melhor para memória.
Tem limite de tamanho ou quantidade?
Não há limite imposto, porque não há servidor. O teto é a memória do seu navegador. Para múltiplas imagens, o OCR é feito em série (uma de cada vez), em web worker — a UI continua responsiva enquanto extrai. Cada imagem de página A4 nítida costuma levar 5-10 segundos em desktop, 10-30 em celular.
Posso editar o texto extraído?
Sim — o texto aparece em um textarea abaixo da imagem, pronto para você copiar, baixar como .txt ou editar antes de usar. Esse é o fluxo recomendado: OCR extrai, você revisa.
OCR digitalizou caractere errado — tem como melhorar?
Em documentos com baixa resolução, aumentar o DPI da imagem de origem (via pdf-para-jpg em 300 DPI, ou reshoot com melhor iluminação) costuma resolver. O tesseract lida mal com fontes decorativas e texto de baixo contraste — quanto mais próximo do preto-e-branco nítido, melhor o resultado.
## outras ferramentas