OCR (reconhecimento óptico de caracteres)
OCR é a tecnologia que converte a imagem de um documento, como um PDF escaneado ou a foto de uma nota, em texto que o computador consegue ler. Ele só lê: saber qual número é o valor total e se ele confere é trabalho de outra etapa.
Para o computador, um documento escaneado é uma foto. Não existe a palavra "total" ali, existe um conjunto de pontos escuros. O OCR reconhece as letras e os números nessa imagem e devolve texto. É um passo necessário e, sozinho, raramente resolve o problema de quem comprou.
O mal-entendido está em achar que ler é o mesmo que extrair. O OCR entrega uma sequência de texto, com a ordem que conseguiu deduzir da página. Descobrir que aquele número ao lado de "vencimento" é uma data, que o CNPJ pertence ao fornecedor e não ao cliente, e que o valor bate com o pedido, é extração e validação. Documento de layout fixo facilita; documento que muda a cada fornecedor exige regra por modelo ou um modelo de IA que entenda o contexto.
O ponto de quebra é a qualidade da origem. Foto torta, carimbo por cima do campo, papel amassado, letra de mão: cada um derruba a leitura, e o erro não avisa. Um 8 lido como 3 passa adiante com a mesma confiança de um acerto.
O que decide o resultado é o que acontece depois da leitura: a regra que confere o campo contra outra fonte, o limite abaixo do qual o documento vai para uma pessoa revisar e o registro do que foi corrigido. Sem essa fila de exceção, o erro de leitura vira erro de lançamento.
Quando se aplica
- Documentos chegam em papel, PDF escaneado ou foto, e alguém digita o conteúdo em um sistema.
- O volume de comprovantes, boletos ou laudos cresce e a digitação virou gargalo da área.
- Existe uma fonte para conferir o dado lido, como o pedido de compra ou o cadastro do fornecedor.
- O arquivo digital existe, mas o texto dele não é pesquisável e ninguém encontra o que precisa.
Quando não se aplica
- O dado já existe em formato estruturado, como o XML de uma nota eletrônica. Ler a imagem do que já está em texto é retrabalho.
- O documento é raro e variado demais. Montar e manter a extração custa mais do que a digitação que ela evita.
- Não há quem trate a exceção. Sem revisão do que foi lido com baixa confiança, o erro entra no sistema sem ninguém perceber.
Leitura, extração, validação e fila de exceção desenhadas como um processo só.
Termos relacionados
Ler o documento é a parte fácil. O difícil é confiar no que foi lido.
O diagnóstico levanta os tipos de documento, a qualidade de origem, contra o que cada campo pode ser conferido e quem revisa a exceção.
Agendar diagnóstico
