摘要。室内点云的语义分割是3D场景理解中的一项基本任务,支持虚拟现实、室内导航和建筑管理等应用。基于点的变换器模型实现了高精度,但需要大量的计算资源,而基于超点的方法更高效但往往精度较低。为了解决这个权衡问题,我们提出了LGFormer,一个集成了图卷积网络(GCN)和变换器的轻量级框架,能够共同捕捉局部和全局上下文特征。该方法构建了一个基于超点的拓扑图,通过GCN提取局部特征,并通过变换器层建模全局依赖关系。在S3DIS和ScanNet++数据集上的实验表明,LGFormer分别达到了90.7%和88.5%的分割精度,同时将推理时间减少了99%以上。通过有效利用超点和局部-全局特征融合,LGFormer在显著降低计算成本的情况下提供了具有竞争力的精度,使其适用于大规模室内场景分析。
Zhang等人(周五)研究了这个问题。