Tablets robustos, dispositivos portáteis e soluções de computação móvel personalizadas, fabricadas sob encomenda (ODM), para aplicações industriais.
O que é a tecnologia OCR?
O Reconhecimento Óptico de Caracteres (em inglês: Optical Character Recognition, OCR) refere-se ao processo de análise e reconhecimento de arquivos de imagem contendo textos para obter informações sobre o texto e seu layout.
Assim como nas tecnologias de reconhecimento de imagem e visão computacional, o processo de processamento da tecnologia OCR também é dividido em entrada, pré-processamento, processamento intermediário, pós-processamento e saída.
digitar
Para diferentes formatos de imagem, existem diferentes formatos de armazenamento e diferentes métodos de compressão. Atualmente, existem o OpenCV, o CxImage, etc.
Pré-processamento – binarização
A maioria das fotos tiradas por câmeras digitais hoje em dia são imagens coloridas, que contêm uma enorme quantidade de informações e não são adequadas para a tecnologia OCR.
Para o conteúdo da imagem, podemos simplesmente dividi-la em primeiro plano e plano de fundo. Para que o computador seja mais rápido e execute melhor os cálculos relacionados ao OCR, precisamos processar a imagem colorida primeiro, de modo que apenas as informações do primeiro plano e do plano de fundo permaneçam na imagem. A binarização também pode ser entendida simplesmente como "preto e branco".
redução de ruído da imagem
Para diferentes imagens, a definição de ruído pode ser diferente, e o processo de remoção de ruído de acordo com as características do ruído é chamado de redução de ruído.
correção de inclinação
Como os usuários comuns têm dificuldade em fotografar documentos com alinhamento horizontal e vertical perfeito, as imagens inevitavelmente ficam distorcidas, exigindo correção por meio de softwares de edição de imagem.
Processamento a médio prazo – análise de layout
O processo de dividir imagens de documentos em parágrafos e ramificações é chamado de análise de layout. Devido à diversidade e complexidade dos documentos reais, essa etapa ainda precisa ser otimizada.
corte de personagem
Devido às limitações das condições de fotografia e escrita, os caracteres muitas vezes ficam presos e as canetas quebram. O uso direto dessas imagens para análise OCR limita consideravelmente o desempenho do processo. Portanto, é necessário segmentar os caracteres, ou seja, separá-los.
reconhecimento de caracteres
Na fase inicial, a correspondência de modelos era o método principal utilizado, enquanto na fase posterior, a extração de características tornou-se a principal estratégia. Devido à influência de fatores como deslocamento do texto, espessura do traço, falhas na caneta, aderência, rotação, etc., a dificuldade da extração de características é significativamente afetada.
Restauração do layout
As pessoas esperam que o texto reconhecido seja mantido organizado como na imagem do documento original, e que os parágrafos, posições e ordem sejam preservados em documentos do Word, PDFs, etc., e esse processo é chamado de restauração de layout.
pós-processamento
De acordo com a relação do contexto linguístico específico, o resultado do reconhecimento é corrigido.
saída
Exiba os caracteres reconhecidos como texto em um formato específico.
Quais são as aplicações de terminais portáteis baseados na tecnologia OCR?
Por meio de um terminal portátil PDA com software de reconhecimento de caracteres OCR, diversas aplicações podem ser implementadas, como: reconhecimento de placas de veículos, reconhecimento de números de contêineres, reconhecimento de etiquetas de peso de carne bovina e ovina importada, reconhecimento da área de leitura mecânica de passaportes, reconhecimento de leitura de medidores de energia elétrica e reconhecimento de caracteres impressos em bobinas de aço.
Shenzhen: 8º andar, Edifício A, Centro de Inovação Zhihui, Zona Industrial Hang Cheng, Distrito de Bao'an, Shenzhen, China
Hong Kong: Sala 605, 6º andar, Edifício Comercial FA Yuen, Rua FA Yuen, 75-77, MongKok, Kowloon, Hong Kong.