IA-VLA: Eingangsaugmentation für Vision-Language-Action-Modelle in Umgebungen mit semantisch komplexen Aufgaben | Synapse