ZeroCap: Generación de Texto a partir de Imágenes sin Ejemplos para Aritmética Visual-Semántica | Synapse