Kompakte Vision--Sprachmodelle ermöglichen effiziente und interpretierbare automatisierte OCT-Analyse durch lagen-spezifisches multimodales Lernen | Synapse