Key points are not available for this paper at this time.
Neste artigo, uma nova arquitetura de Rede Neural Convolucional (CNN) é proposta para o reconhecimento de caracteres sintéticos em urdu e inglês em imagens de cena natural. As características são extraídas usando três sub-modelos separados da CNN que são então fundidos em um vetor de características. A rede é treinada exclusivamente com imagens de caracteres sintéticos de textos em inglês e urdu em imagens naturais. Para o texto em inglês, é utilizado o conjunto de dados Chars74k-Font e para o texto em urdu, o conjunto de dados sintético é criado através da recorte automático de patches de imagem de quatro conjuntos de dados de imagem de fundo e, em seguida, posicionando caracteres em posições aleatórias dentro do patch da imagem. A rede é avaliada em um conjunto de dados sintético combinado de caracteres em inglês e urdu e nos conjuntos de dados de caracteres sintéticos separados em urdu e inglês. Os resultados experimentais mostram que a rede apresenta um bom desempenho em conjuntos de dados sintéticos.
Ali et al. (Sat,) estudaram esta questão.