SMGT: A self-supervised multimodal graph transformer with coverage-aware selection for video summarization with nanotechnology-inspired nanoscale representation learning | Synapse