OCR (reconhecimento óptico de caracteres)
Definição
OCR converte digitalizações, fotos e PDFs em texto legível por máquina. É a etapa de entrada da automação de documentos e entrega apenas caracteres — o significado, a validação e a lógica de lançamento são adicionados pelas camadas acima dele.
O OCR moderno trata layout, tabelas e idiomas mistos com confiabilidade, mas a qualidade ainda depende da fonte: resolução, contraste e orientação da digitalização.
Trate a saída do OCR como matéria-prima que deve ser validada, nunca como um valor já verificado.
Na prática
- A qualidade depende da resolução e do layout da fonte
- A saída exige validação antes de ser lançada em qualquer lugar
- É um dos blocos de construção do processamento inteligente de documentos
Termos relacionados
- Processamento inteligente de documentos (IDP)O processamento inteligente de documentos extrai dados estruturados de faturas, notas de entrega, contratos ou formulários, valida-os contra dados mestres e os lança no sistema de destino. Combina OCR para leitura com modelos para interpretação e regras para verificação.
- Integração de APIUma integração de API conecta dois sistemas por meio de suas interfaces de programação, de forma que os dados fluam automática e confiavelmente. É a alternativa estável à redigitação manual, à troca de arquivos CSV e aos robôs de interface, e é a espinha dorsal de qualquer automação séria.