Pular para o conteúdo
Glossário

OCR (reconhecimento óptico de caracteres)

OCR é a tecnologia que converte a imagem de um documento, como um PDF escaneado ou a foto de uma nota, em texto que o computador consegue ler. Ele só lê: saber qual número é o valor total e se ele confere é trabalho de outra etapa.

Para o computador, um documento escaneado é uma foto. Não existe a palavra "total" ali, existe um conjunto de pontos escuros. O OCR reconhece as letras e os números nessa imagem e devolve texto. É um passo necessário e, sozinho, raramente resolve o problema de quem comprou.

O mal-entendido está em achar que ler é o mesmo que extrair. O OCR entrega uma sequência de texto, com a ordem que conseguiu deduzir da página. Descobrir que aquele número ao lado de "vencimento" é uma data, que o CNPJ pertence ao fornecedor e não ao cliente, e que o valor bate com o pedido, é extração e validação. Documento de layout fixo facilita; documento que muda a cada fornecedor exige regra por modelo ou um modelo de IA que entenda o contexto.

O ponto de quebra é a qualidade da origem. Foto torta, carimbo por cima do campo, papel amassado, letra de mão: cada um derruba a leitura, e o erro não avisa. Um 8 lido como 3 passa adiante com a mesma confiança de um acerto.

O que decide o resultado é o que acontece depois da leitura: a regra que confere o campo contra outra fonte, o limite abaixo do qual o documento vai para uma pessoa revisar e o registro do que foi corrigido. Sem essa fila de exceção, o erro de leitura vira erro de lançamento.

Quando se aplica

  • Documentos chegam em papel, PDF escaneado ou foto, e alguém digita o conteúdo em um sistema.
  • O volume de comprovantes, boletos ou laudos cresce e a digitação virou gargalo da área.
  • Existe uma fonte para conferir o dado lido, como o pedido de compra ou o cadastro do fornecedor.
  • O arquivo digital existe, mas o texto dele não é pesquisável e ninguém encontra o que precisa.

Quando não se aplica

  • O dado já existe em formato estruturado, como o XML de uma nota eletrônica. Ler a imagem do que já está em texto é retrabalho.
  • O documento é raro e variado demais. Montar e manter a extração custa mais do que a digitação que ela evita.
  • Não há quem trate a exceção. Sem revisão do que foi lido com baixa confiança, o erro entra no sistema sem ninguém perceber.
Frente relacionada
Automação de processos na Composto Web

Leitura, extração, validação e fila de exceção desenhadas como um processo só.

Termos relacionados

Ler o documento é a parte fácil. O difícil é confiar no que foi lido.

O diagnóstico levanta os tipos de documento, a qualidade de origem, contra o que cada campo pode ser conferido e quem revisa a exceção.

Agendar diagnóstico